Легко расшифровывайте ваши аудиозаписи в текст.
или перетащите, вставьте или выберите из облака
Автоопределение подходит для большинства записей. Можно также вручную задать язык из более чем 90 вариантов. Это помогает, чтобы короткий или шумный фрагмент не распознавался на неверном языке.
Скачайте расшифровку в виде TXT-файла и вставьте в документ. Или возьмите SRT-файл с таймкодами, который видеоплеер может загрузить как субтитры.
Конвертер работает в вашем браузере на любом устройстве. Передача данных шифруется, и ваши записи никому не передаются.
Загрузите аудиозапись.
Выберите язык, на котором ведется речь в аудиофайле.
Нажмите кнопку "START", чтобы запустить конвертацию.
Скачайте текстовый файл.
Speech to Text - это бесплатный онлайн-инструмент, который автоматически преобразует произнесенные слова из ваших аудиозаписей в текст. Эта функция помогает сэкономить часы ручной расшифровки, поэтому она удобна для журналистов, исследователей, студентов и бизнес-пользователей. Нужно расшифровать интервью, лекцию или совещание? Функция Speech to Text сделает это быстро и просто.
Его также называют распознаванием речи, автоматической транскрибацией или просто конвертацией аудио в текст. Модель распознавания «слушает» запись и делит ее на небольшие звуковые единицы. Затем она сопоставляет их с образцами, изученными по тысячам часов записанной речи.
Результатом становится расшифровка, которую можно читать, искать, цитировать и редактировать. Ничего не набирается вручную, поэтому часовое интервью обрабатывается за минуты, а не за весь день.
Точность больше всего зависит от самой записи. Четкая речь, один говорящий за раз и минимум фонового шума дают наиболее качественный текст. Запись с телефона через шумную комнату всегда будет хуже читаться, чем запись с гарнитуры.
Ручной выбор языка вместо автоопределения - самое простое улучшение. Автоопределение может ошибиться на коротком фрагменте, при сильном акценте или если в одном файле встречаются 2 языка. Одна ошибка влияет на все последующие строки.
Остальной компромисс задается настройкой скорости обработки. Более быстрые модели возвращают текст раньше, а более медленные тщательнее «читают» аудио и точнее распознают слова. Выбирайте более медленную модель для длинных, тихих или технических записей.
Работают распространенные форматы аудио, включая MP3, WAV, M4A, FLAC, OGG и AAC. Поддерживается пакетная конвертация, поэтому можно добавить несколько записей сразу и получить отдельную расшифровку для каждой.
Доступно два формата вывода. TXT - это простой текст, готовый для вставки в документ или приложение для заметок. SRT разбивает тот же текст на строки субтитров с таймкодами, в таком формате их ожидают видеоплееры и видеоредакторы.
Поддерживается более 90 языков. Среди них арабский, китайский, нидерландский, французский, немецкий, хинди, итальянский, японский, корейский, польский, португальский, русский, испанский, турецкий, украинский и вьетнамский.
Да. Загрузите запись, запустите конвертацию и скачайте расшифровку без оплаты и без регистрации. Подписка нужна только для длинных записей и при большом ежедневном объеме.
Зависит от того, где находится ваше аудио. Приложения для диктовки печатают то, что вы говорите в микрофон, в режиме реального времени. Эта страница решает другую задачу: берет уже готовую запись и возвращает текстовый файл. Если у вас есть аудио как файл, конвертер вроде этого - более быстрый вариант.
Google Cloud Speech-to-Text - это API для разработчиков, а в Google Docs есть голосовой ввод для живой диктовки. Ни один из этих сервисов не позволяет просто перетащить готовый аудиофайл в страницу браузера и скачать расшифровку. Этот конвертер позволяет, без кода и без аккаунта.
Лучшие результаты дают четкая речь, один говорящий и низкий фоновый шум. Выбор языка речи вместо автоопределения убирает частый источник ошибок, а более медленные режимы обработки тщательнее читают аудио. Ожидайте, что имена, профессиональные термины и числа придется проверять.
Более 90 языков, включая арабский, китайский, нидерландский, французский, немецкий, хинди, итальянский, японский, корейский, польский, португальский, русский, испанский, турецкий, украинский и вьетнамский. Оставьте автоопределение, и язык будет выбран по аудио.
Подходят распространенные аудиофайлы, включая MP3, WAV, M4A, FLAC, OGG и AAC. Можно загружать несколько файлов за один раз, и каждый вернется как отдельная расшифровка.
Да. Выберите SRT как формат вывода, и расшифровка будет возвращена в виде строк субтитров с таймкодами, которые видеоплеер или редактор может загрузить напрямую. Выберите TXT для простого текстового файла.
Да. Откройте эту страницу в мобильном браузере и выберите запись из памяти телефона или из облачного хранилища. Устанавливать приложение не нужно, и шаги те же, что и на компьютере.
Everything here runs in the browser, with no install and no sign-up.