1.Enregistrer ou importer
Enregistrez une note vocale ou choisissez un fichier audio ou vidéo pris en charge.

Importez un fichier audio ou vidéo, ou enregistrez une note vocale, puis obtenez une transcription modifiable. Essayez des enregistrements de 3 minutes maximum sans compte.
Formats pris en charge : MP3, WAV, M4A, MP4, et plus encore
MP3, WAV, M4A, FLAC, OGG, AAC, MP4, MOV, AVI, MKV, WebM
Jusqu’à 3 minutes sans compte ; les comptes gratuits disposent de 15 minutes par jour. Les fichiers sont envoyés de manière sécurisée au service de transcription distant pour traitement. Détails de confidentialité
Passer à Pro →Enregistrez une note vocale ou choisissez un fichier audio ou vidéo pris en charge.

Après l’enregistrement ou l’import, envoyez le fichier au service de transcription et suivez sa progression.

Relisez et modifiez la transcription, puis copiez-la ou exportez-la au format voulu.

La technologie de reconnaissance vocale transforme la parole enregistrée en langage écrit. Cet outil utilise un flux de travail basé sur des fichiers : il enregistre ou accepte un fichier audio ou vidéo complet, envoie ce fichier au service de transcription, puis renvoie un texte que vous pouvez relire et modifier.
Commencez par un enregistrement contenant une parole audible. Vous pouvez enregistrer une note vocale dans l’espace de travail ou télécharger un fichier existant depuis un téléphone, un ordinateur, une application de messagerie, une plateforme de réunion ou une caméra.
Après avoir choisi Transcrire, le service analyse le signal audio et prédit les mots qui correspondent le mieux aux sons parlés et au contexte. Il peut aussi retourner une langue détectée et des informations de synchronisation lorsque ces détails sont disponibles.
La transcription retournée s’ouvre dans un espace de travail éditable. Corrigez les formulations incertaines, ajoutez une mise en forme, copiez le texte, exportez-le ou utilisez la transcription comme source pour l’assistant, le résumé et les outils de traduction.
Le contrôle de téléchargement accepte les conteneurs audio et vidéo courants, notamment MP3, WAV, M4A, FLAC, OGG, AIFF, WMA, OPUS, AAC, MP4, MOV, AVI, MKV et WebM. Choisir un flux de travail spécifique au format peut vous aider à préparer le bon fichier source et à l’exporter.
Le MP3 est utile pour les interviews, conférences et enregistrements partagés car il est largement supporté et généralement plus petit qu’un fichier non compressé. La transcription nécessite néanmoins une relecture lorsque la compression, le bruit ou un volume faible rendent la parole difficile à comprendre.
Pour des détails de préparation et de relecture adaptés à ce format, utilisez le guide de conversion MP3 en texte avant de soumettre un enregistrement important.
M4A, AAC, OGG et OPUS sont courants sur les téléphones et applications de messagerie. Vous pouvez télécharger directement l’enregistrement sauvegardé lorsque son extension de fichier est acceptée ; il n’est pas nécessaire de convertir chaque note vocale en MP3 au préalable.
Les enregistrements sauvegardés par les appareils Apple peuvent suivre le flux de travail M4A vers texte pour des vérifications spécifiques au format.
Les fichiers WAV et AIFF conservent souvent plus du signal original, bien qu’un fichier plus volumineux ne garantisse pas une meilleure transcription. Le placement du microphone, la saturation, le chevauchement et le bruit de fond restent importants.
Pour les enregistrements sans perte ou de type studio, consultez le guide WAV vers texte et sa liste de contrôle qualité.
Les fichiers MP4, MOV, AVI, MKV et WebM peuvent être soumis lorsque la bande sonore parlée est l’information dont vous avez besoin. Le service transcrit la parole audible du média plutôt que de décrire ce qui apparaît visuellement dans chaque image.
Pour les interviews, présentations et séquences filmées, le flux de travail MP4 vers texte explique comment préparer l’audio vidéo pour la relecture.
Une transcription éditable est utile pour la lecture, tandis que les sous-titres nécessitent aussi des données de synchronisation et une structure de fichier de sous-titres. Les comptes Pro peuvent exporter des fichiers SRT et VTT après vérification de la transcription.
Si les sous-titres sont le livrable final, suivez le guide audio vers sous-titres SRT pour vérifier la synchronisation et les coupures de ligne.
Une extension familière ne prouve pas qu’un fichier contient un audio lisible. Confirmez que l’enregistrement s’ouvre, contient de la parole et n’est pas vide avant de le télécharger. Si un appareil a produit un format inhabituel, exportez une copie prise en charge sans recompression répétée.
Le service de transcription peut détecter et transcrire plusieurs langues parlées, mais le résultat dépend toujours de la langue, de l'accent, de la qualité audio et de la clarté de l'enregistrement. L'interface du site web est localisée en 13 langues, et l'espace de travail de traduction actif offre actuellement 13 choix de langues cibles.
Vous n’avez pas à supposer une précision universelle à partir d’une étiquette de langue. Soumettez l’enregistrement, vérifiez la langue détectée affichée avec le résultat quand elle est disponible, et relisez si les noms, phrases bilingues et expressions locales ont été correctement interprétés.
Pour un exemple bilingue ciblé, consultez le guide de transcription audio en espagnol et ses critères de relecture.
L’interface est disponible en anglais, allemand, espagnol, français, italien, portugais, russe, chinois, arabe, japonais, polonais, néerlandais et vietnamien. La langue de l’interface modifie les étiquettes et les indications ; elle ne force pas l’enregistrement téléchargé à utiliser la même langue.
Une fois la transcription réalisée, l'outil de traduction propose l'anglais, l'allemand, l'espagnol, le français, l'italien, le portugais, le russe, le chinois, l'arabe, le japonais, le polonais, le néerlandais et le vietnamien. Le menu des langues cibles est une fonctionnalité distincte de la détection automatique de la langue de l'enregistrement.
Une fois la transcription prête, l’espace de travail peut utiliser ce texte comme contexte pour trois tâches distinctes. Ces outils ne remplacent pas la transcription ; ils vous aident à la questionner, la condenser ou créer une version traduite de travail.
Utilisez le panneau de chat IA pour poser des questions basées sur la transcription, telles que quelles décisions ont été prises, quelles dates ont été mentionnées ou quelles tâches de suivi apparaissent dans la conversation. Vérifiez les éléments cités par rapport à la transcription avant d’agir.
L’outil de résumé condense la transcription pour que vous puissiez parcourir les idées principales avant de lire les passages importants en entier. Un résumé peut omettre la nuance, les qualifications ou les points de vue minoritaires, il doit donc être utilisé comme aide à la navigation plutôt que comme remplacement de la relecture.
Choisissez une langue cible après la transcription pour créer une version traduite du texte. La qualité de la traduction varie selon le contexte et la terminologie ; les noms, chiffres, langage juridique, médical et technique doivent être vérifiés par un relecteur fluent ou qualifié.
Les messages vocaux sont faciles à envoyer mais difficiles à rechercher, citer ou parcourir discrètement. Sauvegardez ou partagez le fichier audio réel sur votre appareil, téléchargez-le dans l’espace de travail, attendez le traitement, puis relisez la transcription éditable.
Les messages vocaux WhatsApp utilisent couramment les formats audio OGG ou OPUS. Sauvegardez ou partagez le fichier de la note vocale depuis le téléphone, puis sélectionnez ce fichier dans l’outil de téléchargement. Si le système d’exploitation modifie le conteneur lors du partage, vérifiez que le fichier résultant est toujours lisible avant de le soumettre.
Pour les messages enregistrés au téléphone et les clips sauvegardés, le guide de transcription de mémo vocal couvre un flux complet mobile vers texte.
Les mémos vocaux Apple produisent souvent des fichiers M4A, tandis que les applications d’enregistrement Android peuvent créer des fichiers M4A, AAC, OGG ou un autre format pris en charge. Téléchargez l’enregistrement original clair lorsque c’est possible, car le transfert et la compression répétée peuvent rendre la parole faible plus difficile à reconnaître.
Si vous devez capturer un nouveau message dans le navigateur, utilisez le flux de travail de transcription d’enregistreur vocal depuis l’enregistrement jusqu’à la relecture.
Exportez ou sauvegardez l’audio du message vocal plutôt que de le rejouer dans un autre microphone lorsque l’appareil le permet. L’audio direct évite généralement l’écho de pièce et une seconde couche de compression, bien que les noms et numéros de rappel nécessitent toujours une vérification attentive.
Pour les détails de rappel et le tri des messages, suivez le guide de transcription de messages vocaux avant de vous fier au texte.
La transcription crée un document de travail consultable à partir de matériel parlé. Le flux de travail le plus utile dépend de si vous devez trouver des preuves, préparer du contenu, capturer des décisions, faire des sous-titres ou créer une version texte pour l’accessibilité et la relecture.
Une transcription aide les producteurs à trouver des citations, structurer les épisodes, rédiger les notes d’émission et identifier les segments à corriger. Les noms des intervenants, marques et affirmations sensibles au temps doivent être vérifiés par rapport à l’audio avant publication.
Pour la préparation d’épisodes et les vérifications éditoriales, utilisez le flux de travail de transcription de podcast comme référence spécifique au format.
Le texte consultable peut faciliter la localisation des décisions, questions et thèmes plutôt que de parcourir un long enregistrement. Confirmez le consentement et les règles institutionnelles avant l’enregistrement, puis distinguez les déclarations textuelles des résumés générés ultérieurement par l’IA.
Les pensées enregistrées peuvent devenir un brouillon plus facile à modifier qu’une page blanche. Une transcription peut aussi fournir une alternative texte au matériel parlé, mais la publication accessible peut nécessiter l’identification des locuteurs, des indices sonores, la synchronisation et une correction manuelle au-delà de la simple transcription brute.
Il n’existe pas de pourcentage unique honnête de précision pour chaque enregistrement. Les résultats varient selon la langue parlée, la qualité du microphone et du codec, le bruit de fond, les chevauchements de locuteurs, la distance au microphone, la prononciation et le vocabulaire utilisé.
Utilisez l’enregistrement original lorsque c’est possible, maintenez la parole à un niveau audible stable et évitez la saturation. Si vous contrôlez l’enregistrement, placez le microphone assez près pour une parole claire et réduisez musique, écho, vent et conversations concurrentes.
Les noms, numéros de téléphone, adresses e-mail, dates, prix, mesures, citations et termes spécialisés peuvent changer de sens si un caractère ou un mot est erroné. Comparez ces détails directement avec l’audio avant de partager ou d’utiliser la transcription.
La transcription est une représentation générée par un modèle de l’enregistrement, pas une preuve que chaque mot est correct. Un résumé ou une réponse de chat ajoute une couche interprétative supplémentaire. Conservez l’audio, la transcription corrigée et la sortie IA dérivée séparément pour que les lecteurs sachent quelle source ils utilisent.
Vous pouvez tester un enregistrement jusqu’à 3 minutes sans compte. Un compte gratuit inclut 15 minutes de transcription par jour et 10 appels IA par jour. Les fichiers sont téléchargés en toute sécurité vers le service de transcription distant pour traitement.
L’utilisation anonyme est destinée aux essais courts. Un compte gratuit offre les quotas journaliers indiqués pour la transcription et l’IA. Le Pro est proposé à 9 $ par mois ou 84 $ par an et s’adresse aux personnes ayant besoin du flux de travail payant et des options d’exportation.
Vous pouvez éditer et copier le résultat dans l’espace de travail. Les comptes gratuits peuvent exporter en TXT et JSON. Les comptes Pro peuvent en plus exporter en SRT, VTT, PDF et DOCX, donc le choix dépend si vous avez besoin de texte brut, de données structurées, de sous-titres ou d’un document.
L’enregistrement est envoyé à un service distant ; il n’est pas transcrit entièrement dans votre navigateur. Avant de télécharger un audio confidentiel, réglementé ou tiers, confirmez que vous avez la permission et que le flux de travail respecte les règles de confidentialité, de conservation, contractuelles et organisationnelles applicables au matériel.
Réponses claires sur l’enregistrement, les fichiers pris en charge, les langues, l’édition, les outils IA, les limites de compte, les exports et le traitement à distance.