Transcription audio
Transforme un enregistrement audio en texte horodaté.
Cet outil fonctionne avec JavaScript. Pour l’utiliser, activez JavaScript dans votre navigateur et rechargez la page.
TRANSFORMEZ L'ENREGISTREMENT EN TEXTE.
La Transcription audio transforme en texte la parole d’un enregistrement audio ou vidéo. Il y a trois sorties : le texte brut rassemble la parole en paragraphes aux fins de phrase et convient pour en faire directement un écrit; le texte horodaté place au début de chaque ligne l’heure sous la forme [00:01:23], pratique pour les comptes rendus de réunion et les retranscriptions d’entretien; le JSON donne le début et la fin de chaque mot, pour un usage dans votre propre application ou au montage. Pour la reconnaissance vocale, le modèle ouvert Whisper d’OpenAI tourne sur le serveur; 16 langues dont le turc sont proposées, ou elle est détectée automatiquement.
Vous téléversez l'enregistrement uniquement depuis votre propre appareil; il n'y a pas de champ pour un lien. Le son est extrait du fichier, ramené à 16 kHz mono et confié au modèle Whisper du serveur; il ne part vers aucun service extérieur et il est supprimé à la fin de la tâche. Les passages sans parole (silences de plus d'une demi-seconde, attentes) sont écartés avant la transcription. Il y a trois modèles : « Rapide » donne un brouillon approximatif; « Équilibré » suffit pour la plupart des enregistrements; « Meilleur » saisit mieux les noms mais est 3 à 4 fois plus lent et fonctionne pour les enregistrements jusqu'à 10 minutes. Un enregistrement peut faire au plus 30 minutes; découpez un cours ou une réunion plus longs en parties avec « Couper un audio » et envoyez-les l'une après l'autre. Choisissez la langue si vous la connaissez; si la détection automatique n'est pas sûre, l'écran de résultat vous le dit.
Du début à la fin
- Importez votre fichier audio ou vidéo. MP3, WAV, M4A, FLAC, MP4, MOV, MKV… La durée est lue.
- Choisissez la langue et la sortie. Texte brut, texte horodaté ou JSON. Modèle : Équilibré; Meilleur si les noms comptent.
- Téléchargez le texte. Le texte s'affiche à l'écran et se copie; le fichier se télécharge. Relisez et corrigez.
Questions fréquentes
À quoi sert le texte horodaté?
L'heure en début de ligne indique où cette phrase se trouve dans l'enregistrement; on s'en sert pour les comptes rendus de réunion, les retranscriptions d'entretien et pour retrouver un passage dans une vidéo. La sortie JSON donne la même information mot par mot.
Distingue-t-il les intervenants?
Non. Le texte arrive d'un seul tenant; qui parle n'est pas indiqué. Pour une interview à deux, le plus rapide est de choisir « Texte horodaté » et d'ajouter les noms en début de ligne en écoutant l'enregistrement.
Comment les paragraphes se forment-ils dans le texte brut?
Le modèle transcrit la parole par segments; la sortie en texte brut les assemble et commence un nouveau paragraphe à la première fin de phrase après environ 400 caractères. La ponctuation et les majuscules viennent aussi du modèle et peuvent manquer si l'on parle vite ou dans le bruit. Relisez le texte une fois avant de le publier et vérifiez surtout les noms propres.
Mon fichier reste-t-il sur le serveur?
Non. Votre fichier n’arrive sur le serveur que pour être traité et il est supprimé une fois l’opération terminée; le résultat est lui aussi supprimé dès que vous l’avez téléchargé et quitté l’outil. Aucun compte, nom ou adresse courriel n’est nécessaire, et vos fichiers ne sont jamais envoyés à un service tiers. L’utilisation est gratuite : aucun quota horaire ou journalier sur le nombre de traitements, aucune publicité à regarder avant le traitement et aucun filigrane ajouté au résultat.
Autres outils Audio
RUPO Studio