Transcribe fácilmente tus grabaciones de audio.
o arrastra, pega o elige desde la nube
La detección automática sirve para la mayoría de las grabaciones. También puedes fijar tú mismo el idioma entre más de 90 opciones. Eso evita que un clip corto o con ruido se lea en el idioma equivocado.
Descarga la transcripción como archivo TXT para pegarla en un documento. O descarga un archivo SRT con marcas de tiempo que un reproductor de video puede cargar como subtítulos.
El conversor se ejecuta en tu navegador en cualquier dispositivo. Las transferencias están cifradas y tus grabaciones nunca se comparten con nadie.
Sube tu archivo de audio.
Selecciona el idioma hablado en tu archivo de audio.
Haz clic en el botón "START" para iniciar la conversión.
Descarga el archivo de texto.
Speech to Text es una herramienta en línea gratuita que convierte automáticamente las palabras habladas de tus grabaciones de audio en texto escrito. Esta función puede ahorrarte horas de transcripción manual, por lo que es útil para periodistas, investigadores, estudiantes y profesionales. Ya sea que necesites transcribir una entrevista, una clase o una reunión, nuestra función Speech to Text lo hace rápido y sencillo.
También se llama reconocimiento de voz, transcripción automática o simplemente audio a texto. Un modelo de reconocimiento escucha la grabación y la divide en pequeñas unidades de sonido. Luego las compara con patrones aprendidos de miles de horas de voz grabada.
El resultado es una transcripción que puedes leer, buscar, citar y editar. Nada se escribe a mano, así que una entrevista de una hora toma minutos en lugar de toda una tarde.
La precisión depende sobre todo de la propia grabación. Voz clara, una persona hablando a la vez y poco ruido de fondo producen la mejor transcripción. Una grabación hecha con el móvil desde el otro lado de una sala llena de gente siempre será más difícil de leer que una hecha con auriculares con micrófono.
Fijar el idioma hablado en lugar de dejarlo en automático es el ajuste más sencillo. La detección puede fallar en un clip corto, con un acento fuerte o cuando aparecen 2 idiomas en el mismo archivo. Una sola detección errónea afecta a todas las líneas siguientes.
Un ajuste de velocidad de procesamiento controla el resto del equilibrio. Los modelos más rápidos devuelven el texto antes, mientras que los más lentos leen el audio con más cuidado y aciertan más palabras. Elige uno más lento cuando la grabación sea larga, silenciosa o técnica.
Funcionan los formatos de audio más comunes, incluidos MP3, WAV, M4A, FLAC, OGG y AAC. Se admite la conversión por lotes, para que puedas añadir varias grabaciones a la vez y obtener una transcripción independiente para cada una.
Hay dos formatos de salida disponibles. TXT es texto sin formato, listo para pegar en un documento o app de notas. SRT divide el mismo texto en líneas de subtítulos con tiempo, que es el formato que esperan los reproductores y editores de video.
Se cubren más de 90 idiomas hablados. Incluyen árabe, chino, neerlandés, francés, alemán, hindi, italiano, japonés, coreano, polaco, portugués, ruso, español, turco, ucraniano y vietnamita.
Sí. Sube una grabación, inicia la conversión y descarga la transcripción sin pagar y sin crear una cuenta. Una suscripción solo entra en juego para grabaciones largas y para un volumen diario alto.
Depende de dónde esté tu audio. Las apps de dictado escriben lo que dices al micrófono mientras hablas. Esta página hace el otro trabajo: toma una grabación que ya tienes y devuelve un archivo de texto. Si el audio existe como archivo, un conversor como este es la opción más rápida.
Google Cloud Speech-to-Text es una API para desarrolladores, y Google Docs ofrece escritura por voz para dictado en tiempo real. Ninguno de los dos te permite soltar un archivo de audio existente en una página del navegador y descargar una transcripción. Este conversor sí lo hace, sin código y sin cuenta.
Voz clara, un solo hablante y poco ruido de fondo dan los mejores resultados. Elegir el idioma hablado en lugar de la detección automática elimina una fuente común de errores, y los ajustes de velocidad de procesamiento más lentos leen el audio con más cuidado. Espera tener que revisar nombres, jerga y números.
Más de 90, incluidos árabe, chino, neerlandés, francés, alemán, hindi, italiano, japonés, coreano, polaco, portugués, ruso, español, turco, ucraniano y vietnamita. Si dejas el ajuste en automático, el idioma se detecta a partir del audio.
Funcionan los archivos de audio más comunes, incluidos MP3, WAV, M4A, FLAC, OGG y AAC. Se pueden subir varios archivos de una vez y cada uno vuelve como su propia transcripción.
Sí. Elige SRT como formato de salida y la transcripción se devuelve como líneas de subtítulos con tiempo que un reproductor o editor de video puede cargar directamente. Elige TXT para un archivo de texto simple.
Sí. Abre esta página en un navegador móvil y elige la grabación desde tu teléfono o desde un servicio en la nube. No hay ninguna app que instalar y los pasos son los mismos que en un ordenador.
Todo se ejecuta en el navegador, sin instalación y sin registro.