Transcrivez facilement vos enregistrements audio.
ou déposez, collez ou choisissez depuis le cloud
La détection automatique gère la plupart des enregistrements. Vous pouvez aussi définir vous-même la langue parmi plus de 90 options. Cela évite qu’un extrait court ou bruyant soit reconnu dans la mauvaise langue.
Téléchargez la transcription en fichier TXT à coller dans un document. Ou récupérez un fichier SRT avec horodatage que votre lecteur vidéo peut charger comme sous-titres.
Le convertisseur fonctionne dans votre navigateur sur tous les appareils. Les transferts sont chiffrés et vos enregistrements ne sont jamais partagés.
Téléchargez votre fichier audio.
Sélectionnez la langue parlée dans votre fichier audio.
Cliquez sur le bouton "START" pour lancer la conversion.
Téléchargez le fichier texte.
Speech to Text est un outil en ligne gratuit qui convertit automatiquement les mots prononcés dans vos enregistrements audio en texte écrit. Cette fonctionnalité peut vous faire gagner des heures de transcription manuelle, ce qui la rend utile pour les journalistes, les chercheurs, les étudiants et les professionnels. Que vous ayez besoin de transcrire une interview, un cours ou une réunion, notre fonctionnalité Speech to Text rend cela rapide et simple.
On l’appelle aussi reconnaissance vocale, transcription automatique ou simplement audio en texte. Un modèle de reconnaissance écoute l’enregistrement et le découpe en petites unités sonores. Il les compare ensuite à des schémas appris à partir de milliers d’heures de parole enregistrée.
Vous obtenez une transcription que vous pouvez lire, rechercher, citer et modifier. Rien n’est tapé à la main, donc une interview d’une heure prend quelques minutes au lieu d’un après-midi.
La précision dépend surtout de l’enregistrement lui-même. Une parole claire, une seule personne qui parle à la fois et peu de bruit de fond produisent la meilleure transcription. Un enregistrement téléphonique pris à l’autre bout d’une pièce bruyante sera toujours plus difficile à lire qu’un enregistrement avec un casque.
Définir la langue parlée au lieu de laisser la détection automatique est le moyen le plus simple d’améliorer le résultat. La détection peut se tromper sur un court extrait, avec un fort accent ou quand 2 langues apparaissent dans le même fichier. Une mauvaise détection affecte toutes les lignes suivantes.
Un paramètre de vitesse de traitement gère le reste du compromis. Les modèles rapides renvoient le texte plus tôt, tandis que les modèles lents lisent l’audio plus attentivement et reconnaissent plus de mots. Choisissez un modèle plus lent quand l’enregistrement est long, peu sonore ou technique.
Les formats audio courants fonctionnent, notamment MP3, WAV, M4A, FLAC, OGG et AAC. La conversion par lot est prise en charge, vous pouvez donc ajouter plusieurs enregistrements à la fois et obtenir une transcription distincte pour chacun.
Deux formats de sortie sont disponibles. TXT est du texte brut, prêt à être collé dans un document ou une application de notes. SRT découpe le même texte en lignes de sous-titres horodatées, le format attendu par les lecteurs et éditeurs vidéo.
Plus de 90 langues parlées sont couvertes, dont l’arabe, le chinois, le néerlandais, le français, l’allemand, l’hindi, l’italien, le japonais, le coréen, le polonais, le portugais, le russe, l’espagnol, le turc, l’ukrainien et le vietnamien.
Oui. Téléversez un enregistrement, lancez la conversion et téléchargez la transcription sans payer et sans créer de compte. Un abonnement n’intervient que pour les enregistrements longs et pour un volume quotidien élevé.
Cela dépend de l’emplacement de votre audio. Les applications de dictée saisissent ce que vous dites dans un microphone en temps réel. Cette page fait l’inverse : elle prend un enregistrement que vous avez déjà et renvoie un fichier texte. Si l’audio existe sous forme de fichier, un convertisseur comme celui-ci est la voie la plus rapide.
Google Cloud Speech-to-Text est une API conçue pour les développeurs, et Google Docs propose la saisie vocale pour la dictée en direct. Aucun des deux ne permet de déposer un fichier audio existant dans une page web et de télécharger une transcription. Ce convertisseur le permet, sans code et sans compte.
Une parole claire, un seul interlocuteur et peu de bruit de fond donnent les meilleurs résultats. Choisir la langue parlée au lieu de la détection automatique élimine une source fréquente d’erreurs, et les réglages de vitesse de traitement plus lents lisent l’audio plus attentivement. Prévoyez de relire les noms, le jargon et les nombres.
Plus de 90, dont l’arabe, le chinois, le néerlandais, le français, l’allemand, l’hindi, l’italien, le japonais, le coréen, le polonais, le portugais, le russe, l’espagnol, le turc, l’ukrainien et le vietnamien. Laissez le paramètre sur auto et la langue sera détectée à partir de l’audio.
Les fichiers audio courants fonctionnent, notamment MP3, WAV, M4A, FLAC, OGG et AAC. Plusieurs fichiers peuvent être téléversés en une seule fois, et chacun revient avec sa propre transcription.
Oui. Choisissez SRT comme format de sortie et la transcription sera renvoyée sous forme de lignes de sous-titres horodatées qu’un lecteur ou éditeur vidéo peut charger directement. Choisissez TXT pour un fichier texte brut.
Oui. Ouvrez cette page dans un navigateur mobile et choisissez l’enregistrement depuis votre téléphone ou depuis un stockage cloud. Il n’y a aucune application à installer, et les étapes sont les mêmes que sur un ordinateur.
Everything here runs in the browser, with no install and no sign-up.