Transcreva facilmente suas gravações de áudio.
ou solte, cole ou escolha da nuvem
A detecção automática resolve a maioria das gravações. Você também pode definir o idioma manualmente entre mais de 90 opções. Isso impede que um clipe curto ou com ruído seja lido no idioma errado.
Baixe a transcrição como um arquivo TXT para colar em um documento. Ou baixe um arquivo SRT com marcações de tempo que um reprodutor de vídeo pode carregar como legendas.
O conversor roda no seu navegador em qualquer dispositivo. As transferências são criptografadas e suas gravações nunca são compartilhadas com ninguém.
Envie seu arquivo de áudio.
Selecione o idioma falado no seu arquivo de áudio.
Clique no botão "START" para iniciar a conversão.
Baixe o arquivo de texto.
Speech to Text é uma ferramenta online gratuita que converte automaticamente as palavras faladas nas suas gravações de áudio em texto escrito. Esse recurso pode economizar horas de transcrição manual, sendo útil para jornalistas, pesquisadores, estudantes e profissionais de negócios. Seja para transcrever uma entrevista, aula ou reunião, o recurso Speech to Text torna o processo rápido e simples.
Também é chamado de reconhecimento de fala, transcrição automática ou simplesmente áudio para texto. Um modelo de reconhecimento escuta a gravação e a divide em pequenas unidades de som. Depois, ele as compara com padrões aprendidos a partir de milhares de horas de fala gravada.
O resultado é uma transcrição que você pode ler, pesquisar, citar e editar. Nada é digitado à mão, então uma entrevista de uma hora leva minutos em vez de uma tarde.
A precisão depende principalmente da própria gravação. Fala clara, uma pessoa por vez e pouco ruído de fundo produzem a melhor transcrição. Uma gravação de celular feita do outro lado de uma sala cheia de gente será sempre mais difícil de ler do que uma gravação com headset.
Definir o idioma falado em vez de deixar no automático é o ajuste mais simples. A detecção pode errar em um clipe curto, com sotaque forte ou quando 2 idiomas aparecem no mesmo arquivo. Um palpite errado afeta todas as linhas seguintes.
Uma configuração de velocidade de processamento controla o restante do equilíbrio. Os modelos mais rápidos devolvem o texto antes, enquanto os mais lentos leem o áudio com mais cuidado e acertam mais palavras. Escolha um mais lento quando a gravação for longa, baixa ou técnica.
Formatos de áudio comuns funcionam, incluindo MP3, WAV, M4A, FLAC, OGG e AAC. A conversão em lote é compatível, então você pode adicionar várias gravações de uma vez e obter uma transcrição separada para cada uma.
Dois formatos de saída estão disponíveis. TXT é texto simples, pronto para colar em um documento ou app de notas. SRT divide o mesmo texto em linhas de legenda com tempo, que é o formato esperado por reprodutores e editores de vídeo.
Mais de 90 idiomas falados são contemplados. Eles incluem árabe, chinês, holandês, francês, alemão, hindi, italiano, japonês, coreano, polonês, português, russo, espanhol, turco, ucraniano e vietnamita.
Sim. Envie uma gravação, inicie a conversão e baixe a transcrição sem pagar e sem criar uma conta. Uma assinatura só entra em jogo para gravações longas e para alto volume diário.
Depende de onde está o seu áudio. Apps de ditado digitam o que você fala em um microfone em tempo real. Esta página faz o outro trabalho: pega uma gravação que você já tem e devolve um arquivo de texto. Se o áudio existe como arquivo, um conversor como este é o caminho mais rápido.
O Google Cloud Speech-to-Text é uma API feita para desenvolvedores, e o Google Docs oferece digitação por voz para ditado em tempo real. Nenhum deles permite soltar um arquivo de áudio existente em uma página do navegador e baixar uma transcrição. Este conversor permite, sem código e sem conta.
Fala clara, um único locutor e pouco ruído de fundo geram os melhores resultados. Escolher o idioma falado em vez de detecção automática remove uma fonte comum de erros, e as configurações de velocidade de processamento mais lentas leem o áudio com mais cuidado. Espere revisar nomes, jargões e números.
Mais de 90, incluindo árabe, chinês, holandês, francês, alemão, hindi, italiano, japonês, coreano, polonês, português, russo, espanhol, turco, ucraniano e vietnamita. Deixe a configuração em automático e o idioma é detectado a partir do áudio.
Arquivos de áudio comuns funcionam, incluindo MP3, WAV, M4A, FLAC, OGG e AAC. Vários arquivos podem ser enviados de uma vez, e cada um volta como a sua própria transcrição.
Sim. Escolha SRT como formato de saída e a transcrição é devolvida como linhas de legenda com tempo que um reprodutor ou editor de vídeo pode carregar diretamente. Escolha TXT para um arquivo de texto simples.
Sim. Abra esta página em um navegador móvel e escolha a gravação do seu celular ou do armazenamento em nuvem. Não há app para instalar e as etapas são as mesmas que no computador.
Everything here runs in the browser, with no install and no sign-up.