Transcriu les teves gravacions d'àudio fàcilment.
o arrossega, enganxa o selecciona des del núvol
L'opció de detecció automàtica funciona per a la majoria de gravacions. També pots establir tu mateix l'idioma entre més de 90 opcions. Això és el que evita que un clip curt o amb soroll es llegeixi en l'idioma equivocat.
Descarrega la transcripció com a fitxer TXT per enganxar-la en un document. O descarrega un fitxer SRT amb marques de temps que un reproductor de vídeo pot carregar com a subtítols.
El convertidor s'executa al navegador en qualsevol dispositiu. Les transferències estan xifrades i les teves gravacions no es comparteixen amb ningú.
Puja el teu fitxer d'àudio.
Selecciona l'idioma que es parla al teu fitxer d'àudio.
Fes clic al botó "START" per iniciar la conversió.
Descarrega el fitxer de text.
Speech to Text és una eina en línia gratuïta que converteix automàticament les paraules pronunciades dels teus enregistraments d'àudio en text escrit. Aquesta funció et pot estalviar hores de transcripció manual, i és útil per a periodistes, investigadors, estudiants i professionals d'empresa. Tant si has de transcriure una entrevista, una classe o una reunió, la nostra funció de Speech to Text ho fa ràpid i senzill.
També es coneix com a reconeixement de veu, transcripció automàtica o simplement àudio a text. Un model de reconeixement escolta la gravació i la divideix en petites unitats de so. Després les compara amb patrons apresos a partir de milers d'hores de veu enregistrada.
El resultat és una transcripció que pots llegir, cercar, citar i editar. No s'escriu res a mà, així que una entrevista d'una hora triga minuts en lloc d'una tarda sencera.
La precisió depèn sobretot de la gravació. Una veu clara, una sola persona parlant a la vegada i poc soroll de fons produeixen la millor transcripció. Una gravació de telèfon feta des de l'altra banda d'una sala plena sempre serà més difícil de llegir que una gravació amb auriculars i micròfon.
Ajustar l'idioma parlat en lloc de deixar-lo en automàtic és el canvi més senzill. La detecció pot equivocar-se en un clip curt, amb un accent marcat o quan hi ha 2 idiomes en el mateix fitxer. Una sola detecció errònia afecta totes les línies següents.
La resta del compromís es controla amb l'ajust de velocitat de processament. Els models més ràpids retornen el text abans, mentre que els més lents llegeixen l'àudio amb més cura i encerten més paraules. Tria'n un de més lent quan la gravació sigui llarga, poc sonora o tècnica.
Funcionen els formats d'àudio habituals, com ara MP3, WAV, M4A, FLAC, OGG i AAC. S'admet la conversió per lots, així que pots afegir diverses gravacions alhora i obtenir una transcripció separada per a cadascuna.
Hi ha dos formats de sortida disponibles. TXT és text senzill, a punt per enganxar en un document o en una app de notes. SRT divideix el mateix text en línies de subtítols amb temps, que és el format que esperen els reproductors i editors de vídeo.
Es cobreixen més de 90 idiomes parlats. Inclouen àrab, xinès, neerlandès, francès, alemany, hindi, italià, japonès, coreà, polonès, portuguès, rus, espanyol, turc, ucraïnès i vietnamita.
Sí. Puja una gravació, inicia la conversió i descarrega la transcripció sense pagar i sense crear un compte. La subscripció només és necessària per a gravacions llargues i per a un volum diari alt.
Depèn d'on sigui el teu àudio. Les apps de dictat escriuen allò que dius al micròfon mentre parles. Aquesta pàgina fa l'altra feina: agafa una gravació que ja tens i en retorna un fitxer de text. Si l'àudio ja existeix com a fitxer, un convertidor com aquest és la via més ràpida.
Google Cloud Speech-to-Text és una API pensada per a desenvolupadors, i Google Docs ofereix escriptura per veu per al dictat en directe. Cap de les dues et permet deixar anar un fitxer d'àudio existent en una pàgina del navegador i descarregar-ne una transcripció. Aquest convertidor sí que ho fa, sense codi i sense compte.
Una veu clara, un sol interlocutor i poc soroll de fons donen els millors resultats. Triar l'idioma parlat en lloc de l'opció automàtica elimina una font habitual d'errors, i els ajustos de velocitat de processament més lents llegeixen l'àudio amb més cura. Preveu revisar noms propis, argot i xifres.
Més de 90, incloent-hi àrab, xinès, neerlandès, francès, alemany, hindi, italià, japonès, coreà, polonès, portuguès, rus, espanyol, turc, ucraïnès i vietnamita. Deixa l'ajust en automàtic i l'idioma es detectarà a partir de l'àudio.
Funcionen els fitxers d'àudio habituals, com ara MP3, WAV, M4A, FLAC, OGG i AAC. Es poden pujar diversos fitxers d'una sola vegada, i cadascun es retorna amb la seva pròpia transcripció.
Sí. Tria SRT com a format de sortida i la transcripció es retornarà com a línies de subtítols amb temps que un reproductor o editor de vídeo pot carregar directament. Tria TXT per obtenir un fitxer de text senzill.
Sí. Obre aquesta pàgina en un navegador mòbil i tria la gravació des del telèfon o des d'un servei d'emmagatzematge al núvol. No cal instal·lar cap app i els passos són els mateixos que en un ordinador.
Tot el que fas aquí s'executa al navegador, sense instal·lació ni registre.