無料ツール · お使いのデバイス上で
音声・動画の文字起こしが無料
音声ファイルや動画ファイルの話し言葉を、テキストに:ボイスメモ、インタビュー、講義、ポッドキャストのエピソード。文字起こしはお使いのデバイス上のWhisperで実行されます。テキストを確認し、コピーするか、TXT(段落ごと、またはタイムスタンプつき)かSRTでダウンロードできます。
- 無料、無料アカウントが必要です
- TXTとSRT
- 音声がデバイスの外に出ることはありません
- 音声または動画を追加
- 文字起こし
- 確認してダウンロード
使い方
3つのステップ。
音声または動画を追加
音声入りのMP3、WAV、M4A、OGG、MP4、WebM、MOV(10分まで)。言語を選べます:スペイン語、英語、または自動検出。
文字起こし
「テキストに文字起こし」を押してください。初回はモデルがダウンロードされ、その後は最近のパソコンで音声の長さと同じくらいかかります。
確認してダウンロード
テキストを修正して、コピーするか、段落ごとまたはタイムスタンプ付きのTXTと、文ごとのSRTをダウンロードしてください。
次のステップ
これらのツールで続けましょう
テキストに文字起こし:よくある質問
文字起こしの精度はどのくらいですか?
はっきりした話し方でノイズが少なければ、たいていほとんどの単語を正しく認識します。名前、BGM、強いなまり、重なった声は間違えることがあり、話者の区別はしません。使う前にテキストを確認してください。
WhatsAppのボイスメッセージでも使えますか?
はい、ブラウザがそのファイルを再生できる場合(ボイスメモは通常OGGまたはOPUSで、Chrome、Edge、Firefoxで読み取れます)。デバイスに保存して、ここに追加してください。
音声が10分より長い場合は?
最大10分ごとに分割して、1つずつ文字起こししてください。15分までの音声ファイルは、MP3カットでここでカットできます。動画や、それより長い音声ファイルは、スマートフォンのギャラリーや編集ソフトでカットしてください(「動画をトリミング」も10分で止まります)。この制限により、スマートフォンでも快適に動作します。
文字起こしは何をしますか?
Whisper(OpenAIの音声認識モデル、MITライセンスの重み)を、transformers.js(Apache 2.0ライセンス)でブラウザ内で実行しています。「自動字幕」ツールと同じものです。初回のみモデルをダウンロード(「標準」で約77 MB、「高精度」で約250 MB)し、ブラウザに保存します。
音声はサーバーにアップロードされますか?
いいえ。音声はブラウザ内で読み込まれて文字起こしされ、Cocuyoやサードパーティには送信されません。音声認識モデルだけが、当社のサーバーから一度だけダウンロードされます。
本当に無料ですか?
はい。登録前に試せます。使い続けるには無料アカウントが必要です(サブスクリプションは不要)。クレジットは使わず、30回のウェルカム利用にも数えません。利用回数に制限はありません。
制限はありますか?
ブラウザで再生できる、300 MB・10分までの音声または動画ファイルを1つ。文字起こしはデバイス上で行われるため、スマートフォンではパソコンよりずっと時間がかかることがあります。
やり方を学ぶ…
そのほかの無料ツール
そのほかの音声ツール
すべての無料ツール
作りたいとき
AIで声とナレーションを作成。
Cocuyoのスタジオには、画像、動画、音声の30以上のAIモデルが集まっています。生成前にクレジット費用を確認でき、クレジットに有効期限はありません。