90以上の言語 · 話者ラベル · SRT / VTT · 約1分で完了

音声・動画 を正確なテキストに

ポッドキャスト、会議、講義など、音声でも動画でもドロップするだけ。言語を自動判定し、誰が話したかをラベル付けして、検索でき、クリックで再生できるテキストと字幕ファイルをお返しします。

ログインして最初のファイルを文字起こし

無料アカウントは毎日3回の文字起こしが可能。クレジットカード不要、トライアル期限もありません。

無料プラン:1日3ファイル、各30分まで、UTC午前0時にリセット · 30分の録音は約1分で完了 · クレジットカード不要

対応形式MP3WAVM4AAACFLACOGGMP4MOVWEBMMKV

毎日、無料。

1日3回の文字起こしが無料 — しかもどのファイルにも、機能制限なしのフルツールキットが付きます。

話者ラベル

チェックひとつで、すべての行が声ごとにラベル付けされ、タイムコード付きで返ってきます。

クリック再生エディタ

文をクリックすると、その瞬間の音声を再生。引用の確認が数秒で終わります。

ワンクリックで字幕

SRTやVTTで書き出して、YouTube、Premiere、Final Cutへそのまま投入。

6種類の書き出し形式

TXT、DOCX、PDF、CSV、SRT、VTT — 複数まとめてダウンロードできます。

検索できるアーカイブ

何時間も聞き直す代わりに、話題が出た瞬間を検索で見つけられます。

動画をそのまま

MP4、MOV、WEBM、MKVをそのままアップロード — 音声の抽出は不要です。

こんな方にポッドキャスタージャーナリスト学生研究者プロダクトチーム弁護士医師動画編集者講座制作者

Whisper搭載。

OpenAIの音声モデルがファイルを処理します — 正確な場合と、そうでない場合を正直にお伝えします。

2つのエンジンを自動振り分け

ほとんどのファイルはWhisperが担当し、複数話者や長時間の音声は話者分離エンジンが引き継ぎます。ファイルに応じて自動で決まる — モデルを選ぶ必要はありません。

正直な精度

きちんとしたマイクならほぼ完璧。名前や専門用語、同時発話では誤りが出ます — 100%は約束しません。まずは自分の音声で無料でお試しを。

検証できるタイムスタンプ

モデル由来のタイミングで、通常は1秒以内の精度。行をクリックして音声と照合できます。

90以上の言語を自動判定

英語、スペイン語、日本語、中国語など。複数言語が混在する録音は主要な言語に解決されます。

デフォルトでプライベート

暗号化して保存、モデルの学習には一切使わず、人間が聴くこともありません — 削除すれば消えます。

定額制。メーターのように料金は上がりません。

分単位課金のサービスでは、たった1時間の音声が10〜15ドルの請求になります。ここでは、その月に文字起こしした分をまるごと定額でカバー — 無料プランに期限はありません。

無料

$0/ ずっと

まずはお試しに — 日常のちょっとした利用にも。

  • 毎日3回の文字起こし
  • 1ファイル30分 / 50MBまで
  • タイムスタンプと話者ラベル
  • TXT・PDF・DOCX・CSV・SRT・VTT書き出し
  • 90以上の言語
  • 標準処理キュー
一番人気

無制限

$10/ 月、年払い(120ドル)

仕事で文字起こしをする方のために。

  • 文字起こし回数無制限
  • すべてのファイルで話者識別
  • AIツール全部 — 要約・清書・翻訳
  • 優先処理
  • ファイルの長さ制限なし — 100MBまで

実際によく聞かれる質問。

精度、プライバシー、制限、そして「無料」の本当の意味について。疑い深い質問も含めて。

実際のところ、どれくらい正確?

クリーンな音声 — きちんとしたマイク、話者1〜2人、背景ノイズが少ない — なら、名前や専門用語でときどき誤る程度のほぼ完璧なテキストが期待できます。同時発話が多い、訛りが強い、部屋がうるさい場合は精度が下がります。一番確実なのは、ご自身の音声で試してみること。最初の文字起こしは無料です。

なぜGoogleでログインが必要?

ログインがあるからこそ、一回きりのお試しではなく、一人ひとりに本物の毎日の無料枠を提供できます。Googleでワンクリック — パスワードを考える必要も、メール認証の手間もなく、受け取るのはお名前・メールアドレス・アバターだけです。

無料プランには実際何が含まれる?

毎日3回の文字起こしが、ずっと — 各ファイル30分まで。7日間のトライアルでも、一回きりのクレジットでもありません。カウンターはUTC午前0時にリセットされます。もっと多く・長く必要なら、無制限プランが両方の上限を取り払います。

どの言語に対応している?

英語、スペイン語、ポルトガル語、フランス語、ドイツ語、日本語、韓国語、中国語を含む90以上の言語。言語は自動判定され、複数言語が混在する録音はおおむね主要な言語に解決されます。

動画ファイルも扱える?

はい。MP4、MOV、WEBM、MKVをアップロードすれば、音声トラックを直接文字起こしします — 事前に音声を抽出する必要はありません。

話者識別はどう機能する?

アップロード前に「話者を識別」にチェックを入れてください。AIが声を分離し、各セグメントにラベルを付けます(話者1、話者2、…)。インタビュー、会議、ポッドキャストのような発言の交代がはっきりした音声で最も信頼でき、同時に話す場面では精度が落ちます。

タイムスタンプは信頼できる?

音声モデルから直接出力され、通常は音声との誤差1秒以内です。エディタで行をクリックすれば、その瞬間の元の録音を聴いて自分で確認できます。字幕書き出しはセグメントの元のタイミングを保持するので、動画編集ソフトでも字幕がずれません。

音声のプライバシーは守られる?

ファイルはアカウント内でプライベートに保たれ、暗号化して保存され、共有されることも、AIモデルの学習に使われることもありません。文字起こしは自動化システムのみで実行され、人間があなたの音声を聴くことはありません。ファイルを削除すれば、ストレージから消えます。

何を書き出せる?

PDF・DOCX文書、プレーンテキスト(TXT)、スプレッドシート(CSV)、字幕ファイル(SRT・VTT) — セクションごとのタイムスタンプも任意で付けられます。複数の形式を選んで一括ダウンロードできます。

アップロードできるファイル形式は?

音声:MP3、WAV、M4A、AAC、FLAC、OGG、OPUS、WMA、AIFF。動画:MP4、MOV、WEBM、MKV、MPEG、AVI。レコーダーや編集ソフトが作ったファイルなら、ほぼ確実に動きます — もし動かない形式があれば、教えていただければ追加します。

人間の文字起こしよりずっと安いのはなぜ?

人間が作業しないからです。プロの文字起こしは音声1分あたり1〜2ドルかかり、数日待つ必要があります。音声モデルなら1時間あたり数セントで、約1分で完了します。わずかな精度の差と引き換えに100倍の価格差 — 公開する予定のものは、各行をクリックして音声と照合できます。

実際どれくらい文字起こしできる?

無料:毎日3ファイル — 1円も払わずに月90本まで。無制限:回数の上限なし。ルールはひとつ、アカウントは一人一つだけです。

誰が作っている?

こんにちは 👋 — Transcript.soは、VCマネーで膨らんだ大企業ではなく、小さな独立チームが作っています。サポートメールには自分たちで返信し、毎週改善をリリースし、コストを低く抑える設計だからこそ、速くて手頃なサービスを保てます。

次の録音を、夜通しのタイピング作業にする必要はありません。

最初の文字起こしまで約1分 — 無料、カード不要。

ファイルを文字起こし — 無料