La plateforme

La chaîne complète, de l'enregistrement à la livraison du corpus.

De la voix au dataset

Huit états, deux étages de validation humaine. Chaque étape porte le statut technique que porte la donnée dans le système — ce n'est pas un schéma d'intention, c'est la machine à états réelle.

  1. 01
    STIMULUS_AVAILABLEQui intervient : Soumissionnaire

    Le stimulus est proposé

    Un texte ou une image cadré par le projet s'affiche. Le contributeur enregistre sa voix depuis son navigateur, ou passe au suivant si la consigne ne lui convient pas.

  2. 02
    AUDIO_SUBMITTEDQui intervient : Système

    L'audio est analysé

    Dès la réception : format, intégrité, durée, niveau sonore, silences, doublons. Un score de qualité est calculé avant qu'un humain n'écoute.

  3. 03
    AUDIO_IN_REVIEWQui intervient : Validateur audio

    Un validateur écoute

    Quelqu'un d'autre que l'auteur écoute et décide : approuver, rejeter, ou demander une correction. Tout ce qui n'est pas une approbation exige un commentaire.

  4. 04
    AUDIO_VALIDATEDAUDIO_REJECTEDQui intervient : Système

    L'audio part, ou revient

    Approuvé, il rejoint la file des transcripteurs. Rejeté, il revient au soumissionnaire avec le motif — qui peut réenregistrer.

  5. 05
    TRANSCRIPTION_IN_PROGRESSQui intervient : Transcripteur

    La transcription est saisie

    Seul l'audio validé est transcrit. La tâche est verrouillée sur son transcripteur le temps qu'il travaille : deux personnes ne transcrivent jamais le même segment.

  6. 06
    TRANSCRIPTION_SUBMITTEDQui intervient : Système

    La transcription part en relecture

    Le texte rejoint la file de validation, apparié à son audio.

  7. 07
    TRANSCRIPTION_IN_REVIEWQui intervient : Validateur de transcription

    Un second valideur compare

    Audio et texte côte à côte. Le valideur approuve, rejette, ou corrige directement la transcription.

  8. 08
    COMPLETEDQui intervient : Système

    La paire est prête

    Audio et transcription validés, avec leurs métadonnées et leur historique de décisions, prêts pour l'export.

Ce que la machine vérifie avant l'humain

La validation humaine n'est pas le seul filet. Un enregistrement passe six contrôles automatiques avant qu'un validateur y consacre une seconde.

  • Format et intégrité

    Type MIME vérifié, fichier réellement lisible.

  • Doublons

    Empreinte SHA-256 : le même enregistrement soumis deux fois est repéré.

  • Durée et signal

    Durée, fréquence d'échantillonnage, niveau sonore.

  • Silence excessif

    Un enregistrement majoritairement vide est détecté.

  • Score de qualité

    Une note de 0 à 100, affichée au validateur avant qu'il écoute.

  • Rejet automatique

    Sous le seuil défini par le projet, l'enregistrement ne va pas plus loin.

Quatre rôles, quatre files

Chaque rôle a sa file de travail et ses propres écrans. Personne ne valide son propre travail.

Soumissionnaire

Reçoit un stimulus, enregistre, écoute, envoie. Il peut passer un stimulus qui ne lui convient pas plutôt que d'enregistrer à contrecœur.

Validateur audio

Une file d'écoutes. Approuve, rejette ou demande une correction, motif à l'appui.

Transcripteur

Une file d'audios déjà validés. Écoute et saisit le texte, la tâche verrouillée le temps qu'il travaille.

Validateur de transcription

Audio et texte côte à côte. Approuve, rejette, ou corrige directement.

Un même contributeur peut tenir des rôles différents sur des projets différents. L'accès à un rôle supérieur est accordé par l'administrateur du projet.

Menez votre collecte vous-même

La plateforme se loue en marque blanche : vos stimuli, vos règles de validation, votre équipe, sous votre nom de domaine.

  • Import de stimuli en lot

    Vos textes ou vos images, versés en une fois.

  • Workflow et seuils

    Étapes de validation, seuils de qualité, barème de rémunération — ou pas de rémunération du tout.

  • Formulaire de participation

    Les informations que vous voulez sur vos contributeurs — dialecte, région, années de pratique — livrées avec le dataset.

  • Membres et rôles

    Demandes d'accès, attribution des rôles, co-administrateurs.

  • À votre nom

    Votre logo, votre couleur et votre propre nom de domaine pour la page de recrutement.

  • Tableau de bord

    Volume par statut, qualité moyenne, progression, journal d'audit.

  • Export

    Les données validées, avec leurs métadonnées et leur chaîne de décisions.

Aujourd'hui la voix, demain le reste

La plateforme est construite par types de projet : ajouter un type ne demande pas de toucher au cœur du système. La voix est livrée aujourd'hui ; le reste suit, sans échéance annoncée tant qu'elle n'est pas tenable.

  • STTDisponible

    Parole vers texte

    Collecte vocale, transcription et double validation humaine.

  • TTSÀ venir

    Texte vers parole

    Lectures enregistrées pour la synthèse vocale.

  • NLPÀ venir

    Traitement du langage

    Classification, entités nommées, sentiment, traduction.

  • VisionÀ venir

    Vision

    Annotation et segmentation d'images.

Parlons de votre corpus.

Décrivez votre besoin : langues, volume, format, délai. Nous revenons vers vous avec un cadrage.

Se connecter