轻松转写您的音频录音。
或拖放、粘贴,或从云端选择
自动检测可处理大多数录音。你也可以从 90 多种选项中自行设置语言。这样可以避免短录音或嘈杂片段被识别成错误的语言。
将转录下载为 TXT 文件,以便粘贴到文档中。或者下载带时间戳的 SRT 文件,让视频播放器直接加载为字幕。
转换器在浏览器中运行,适用于任何设备。传输过程已加密,你的录音不会与任何人共享。
上传你的音频文件。
选择音频文件中的语音语言。
点击“START”按钮开始转换。
下载文本文件。
语音转文字是一款免费的在线工具,可将音频录音中的语音自动转换为文本。此功能能为你节省大量手动转写时间,适合记者、研究人员、学生和商务人士使用。无论是采访、讲座还是会议记录,我们的语音转文字功能都能让转写变得快速而简单。
它也被称为语音识别、自动转录,或简单的音频转文本。识别模型会“聆听”录音并将其拆分为小的声音单元,然后与从数千小时语音录音中学习到的模式进行匹配。
结果是一份你可以阅读、搜索、引用和编辑的转录文本。无需手动输入,一小时的访谈只需几分钟即可完成,而不是一整个下午。
准确性主要取决于录音本身。语音清晰、一次只有一人说话、背景噪声少时,转录效果最好。隔着嘈杂房间用手机录音,始终会比用耳机麦克风录音更难识别。
将口语语言改为手动设置而不是自动检测,是最简单有效的改进。对短音频、重口音,或同一文件中有两种语言时,自动检测可能猜错。一旦猜错,后面每一行都会受影响。
处理速度设置决定了其余的取舍。更快的模型能更早给出文本,而更慢的模型会更仔细地“阅读”音频,正确识别更多词语。录音时间长、声音较轻或内容偏专业时,选择较慢的模型。
常见音频格式均可使用,包括 MP3、WAV、M4A、FLAC、OGG 和 AAC。支持批量转换,你可以一次添加多个录音,并为每个录音单独生成转录文本。
提供两种输出格式。TXT 为纯文本,可直接粘贴到文档或笔记应用中。SRT 会将相同文本拆分成带时间轴的字幕行,这是视频播放器和视频编辑软件所使用的格式。
支持 90 多种口语语言,包括阿拉伯语、中文、荷兰语、法语、德语、印地语、意大利语、日语、韩语、波兰语、葡萄牙语、俄语、西班牙语、土耳其语、乌克兰语和越南语。
是的。上传录音、开始转换并下载转录文本,无需付费,也无需创建账号。只有在录音很长或每天用量较大时才需要订阅。
取决于你的音频在哪里。听写应用会在你对着麦克风说话时实时输入文字。本页面则做另一件事:接收你已经拥有的录音并返回文本文件。如果音频已经是文件形式,使用这样的转换器会更快。
Google Cloud Speech-to-Text 是为开发者打造的 API,Google Docs 提供的是实时听写的语音输入功能。它们都不支持把现有音频文件直接拖到浏览器页面中并下载转录文本。而这个转换器可以做到,无需编写代码,也无需账号。
语音清晰、说话人单一且背景噪声较低时,效果最好。手动选择口语语言而不是使用自动检测,可以消除常见错误来源;而较慢的处理速度设置会更仔细地“阅读”音频。建议对人名、术语和数字进行校对。
支持 90 多种语言,包括阿拉伯语、中文、荷兰语、法语、德语、印地语、意大利语、日语、韩语、波兰语、葡萄牙语、俄语、西班牙语、土耳其语、乌克兰语和越南语。如果将设置保留为自动检测,系统会从音频中识别语言。
常见音频文件均可使用,包括 MP3、WAV、M4A、FLAC、OGG 和 AAC。你可以一次上传多个文件,每个文件都会生成各自的转录文本。
可以。将输出格式选择为 SRT,转录内容会以带时间轴的字幕行形式返回,视频播放器或编辑器可以直接加载。选择 TXT 则会得到纯文本文件。
可以。在手机浏览器中打开此页面,从手机或云存储中选择录音。无需安装应用,操作步骤与电脑上相同。