音声テキスト変換ツール

音声録音をかんたんに文字起こしできます。

ファイルをアップロード

または、ファイルをドロップ、貼り付けるか、クラウドから選択

URLを貼り付け サンプルを試す
Google Drive Dropbox OneDrive
100%無料 インストール不要 安全でプライベート
広告
導入実績
Samsung Amazon Walmart eBay Yale University
このツールを評価
4.1/5 · 108 件の投票

ここで音声をテキストに変換する理由

話されている言語を指定できます

自動検出はほとんどの録音に対応します。90以上の選択肢から言語を自分で設定することもできます。これによって、短いクリップやノイズの多い録音が別の言語として読まれてしまうのを防げます。

プレーンテキストまたはタイムコード付き字幕

書き起こし結果をTXTファイルとしてダウンロードして、文書に貼り付けられます。あるいは、動画プレーヤーが字幕として読み込めるタイムスタンプ付きSRTファイルとして保存することもできます。

登録不要・インストール不要

コンバーターは、どの端末でもブラウザ上で動作します。転送は暗号化され、録音が第三者と共有されることはありません。

音声をテキストに変換する方法

1

アップロード

音声ファイルをアップロードします。

2

言語

音声ファイルで話されている言語を選択します。

3

変換

"START"ボタンをクリックして変換を開始します。

4

ダウンロード

テキストファイルをダウンロードします。

音声認識(Speech to Text)とは?

Speech to Textは、音声録音の話し言葉を自動でテキストに変換できる無料のオンラインツールです。手作業での文字起こしにかかる時間を大幅に削減できるため、記者、研究者、学生、ビジネスパーソンに役立ちます。インタビュー、講義、会議など、どのような音声でも、Speech to Text機能なら素早く簡単に文字起こしできます。

音声認識、音声自動書き起こし、あるいは単に音声からテキストへの変換とも呼ばれます。認識モデルが録音を聞き取り、小さな音の単位に分割します。そのうえで、何千時間分もの録音音声から学習したパターンと照合します。

結果として、読み取り・検索・引用・編集ができるテキストの書き起こしが得られます。手で文字起こしする必要はないので、1時間のインタビューでも午後をつぶさず数分で済みます。

正確な書き起こしを得るコツ

精度は録音の質に最も左右されます。はっきりした声、1人ずつの発話、少ない背景ノイズで、より正確な書き起こしが得られます。混雑した部屋の反対側からのスマホ録音は、ヘッドセット録音よりどうしても読みにくくなります。

自動検出のままにせず、話されている言語を指定するのが最も簡単で効果的な対策です。短いクリップや強い訛り、1つのファイルに2つの言語が含まれる場合などは、自動検出が誤ることがあります。一度間違うと、その後の行すべてに影響します。

残りの調整は、処理速度の設定で行えます。高速モデルは早くテキストを返し、低速モデルは音声をより丁寧に読み取って正しい単語を増やします。録音が長い・小さい声・専門的な内容の場合は、より遅いモデルを選びましょう。

対応オーディオファイルと出力形式

一般的な音声形式に対応しており、MP3、WAV、M4A、FLAC、OGG、AACなどが使えます。一括変換にも対応しているため、複数の録音をまとめて追加し、それぞれ別々の書き起こしとして受け取れます。

出力形式は2種類です。TXTはプレーンテキストで、文書やメモアプリに貼り付けるのに適しています。SRTは同じテキストをタイムコード付きの字幕行に分割したもので、動画プレーヤーや編集ソフトで一般的に使われる形式です。

90以上の話し言葉に対応しています。アラビア語、中国語、オランダ語、フランス語、ドイツ語、ヒンディー語、イタリア語、日本語、韓国語、ポーランド語、ポルトガル語、ロシア語、スペイン語、トルコ語、ウクライナ語、ベトナム語などが含まれます。

広告

音声認識(Speech to Text)FAQ

この音声からテキストへのコンバーターは無料ですか?

はい。録音をアップロードして変換を開始し、アカウント登録や支払いなしで書き起こしをダウンロードできます。長時間の録音や、1日の利用量が多い場合にのみ、サブスクリプションが必要になります。

無料の音声からテキストアプリで一番良いのはどれですか?

音声がどこにあるかによって異なります。ディクテーションアプリは、話しながらマイク入力をその場でテキスト化します。このページは別の用途で、すでにある録音ファイルを受け取り、テキストファイルとして返します。音声がファイルとして存在するなら、このようなコンバーターの方が早い方法です。

Googleに音声からテキストへのコンバーターはありますか?

Google Cloud Speech-to-Textは開発者向けのAPIであり、Googleドキュメントにはリアルタイムの音声入力機能があります。どちらも、既存の音声ファイルをブラウザページにドラッグ&ドロップして書き起こしをダウンロードすることはできません。このコンバーターなら、コードもアカウントも不要で実現できます。

音声からテキストへの精度はどのくらいですか?

はっきりした発話、単一話者、少ない背景ノイズが最も良い結果をもたらします。自動検出ではなく話されている言語を指定することで、よくある誤りを減らせます。また、低速の処理速度を選ぶと音声をより丁寧に読み取ります。固有名詞、専門用語、数字については校正が必要だと考えてください。

どの言語を文字起こしできますか?

アラビア語、中国語、オランダ語、フランス語、ドイツ語、ヒンディー語、イタリア語、日本語、韓国語、ポーランド語、ポルトガル語、ロシア語、スペイン語、トルコ語、ウクライナ語、ベトナム語などを含む90以上の言語に対応しています。設定を自動にしておけば、音声から言語が検出されます。

どの音声形式をテキストに変換できますか?

一般的な音声ファイルに対応しており、MP3、WAV、M4A、FLAC、OGG、AACなどが使えます。複数ファイルを一度にアップロードでき、それぞれ個別の書き起こしとして返ってきます。

プレーンテキストではなく字幕として取得できますか?

はい。出力形式でSRTを選ぶと、動画プレーヤーや編集ソフトがそのまま読み込めるタイムコード付き字幕行として書き起こしを取得できます。プレーンテキストが必要な場合はTXTを選んでください。

スマホで音声をテキストに書き起こせますか?

はい。このページをモバイルブラウザで開き、スマホ内またはクラウドストレージから録音を選択してください。アプリのインストールは不要で、手順はパソコンと同じです。