90+ 种语言 · 说话人标签 · SRT / VTT · 约 1 分钟出结果

音频和视频 变成精准的文字

拖入播客、会议或课程录音 — 音频视频都行。我们自动识别语言、标注每句话是谁说的,交还给你可搜索、可点击回放的文本和字幕文件。

登录后转写你的第一个文件

免费账户每天可转写 3 次。无需信用卡,没有试用倒计时。

免费:每天 3 个文件,每个最长 30 分钟,UTC 零点重置 · 30 分钟的录音约 1 分钟完成 · 无需信用卡

支持格式MP3WAVM4AAACFLACOGGMP4MOVWEBMMKV

每天都免费。

每天免费转写 3 次 — 而且每个文件都享有完整工具箱,不是缩水的试用版。

说话人标签

勾选一下,每一句都会按声音标注说话人并附带时间码。

点击回放编辑器

点击任意句子即可收听对应片段 — 核对一句引语只需几秒。

一键生成字幕

导出 SRT 或 VTT,直接放进 YouTube、Premiere 或 Final Cut。

六种导出格式

TXT、DOCX、PDF、CSV、SRT、VTT — 可一次下载多种。

可搜索的档案库

直接搜索话题出现的那一分钟,而不是重听几个小时的录音。

视频直接上传

MP4、MOV、WEBM、MKV 原样上传 — 无需先提取音频。

适用人群播客主记者学生研究人员产品团队律师医生视频剪辑师课程创作者

由 Whisper 驱动。

OpenAI 的语音模型处理你的文件 — 这里说清楚它什么时候准、什么时候不准。

双引擎自动调度

大多数文件由 Whisper 处理;多人对话或长音频会切换到说话人分离引擎。由文件本身决定 — 你永远不用挑模型。

诚实的准确率

麦克风质量过得去就接近完美。人名、术语、抢话处容易出错 — 不承诺 100%。用你自己的音频免费测一测。

可核对的时间戳

模型原生的时间信息,通常误差在一秒以内 — 点击任意一句即可对照音频核实。

90+ 种语言自动识别

英语、西班牙语、日语、中文等等。混合语言的录音会归到主要语言。

默认私密

加密存储,绝不用于训练模型,没有任何人会收听 — 删除后即刻消失。

一口价,不跳表计费。

按分钟计费的服务,转一小时音频就要收 10–15 美元。在这里,每月一口价,当月的转写全部包含 — 而且免费套餐永不过期。

免费

$0/ 永久

适合先试试,也适合轻度的日常使用。

  • 每天 3 次转写,天天都有
  • 单个文件最长 30 分钟 / 50MB
  • 时间戳和说话人标签
  • TXT、PDF、DOCX、CSV、SRT、VTT 导出
  • 90+ 种语言
  • 标准处理队列
最受欢迎

无限量

$10/ 月,按年付费($120)

为工作中经常要做转写的人准备。

  • 转写次数无限制
  • 每个文件都可识别说话人
  • 全部 AI 工具 — 摘要、润色、翻译
  • 优先处理
  • 单文件时长无限制 — 最大 100MB

大家真正会问的问题。

关于准确率、隐私、限制,以及「免费」到底是什么意思 — 连最挑剔的问题也一并回答。

到底有多准?

音质干净的情况下 — 麦克风还行、一到两位说话人、背景噪音少 — 可以得到接近完美的文本,人名和术语偶尔出错。抢话严重、口音很重或环境嘈杂时准确率会下降。最好的测试是你自己的音频:最初几次转写是免费的。

为什么必须用 Google 登录?

有了登录,我们才能给每个人真正的每日免费额度,而不是一次性尝鲜。Google 一键登录 — 不用想密码,不用来回验证邮箱,我们只会收到你的姓名、邮箱和头像。

免费套餐究竟包含什么?

每天 3 次转写,永久有效 — 每个文件最长 30 分钟。不是 7 天试用,也不是一次性额度。计数器在 UTC 零点重置。如果需要更多或更长的文件,无限量套餐会同时取消这两个上限。

支持哪些语言?

超过 90 种,包括英语、西班牙语、葡萄牙语、法语、德语、日语、韩语和中文。语言自动识别 — 混合语言的录音一般会归到主要语言。

能处理视频文件吗?

能。上传 MP4、MOV、WEBM 或 MKV,我们直接转写其中的音轨 — 不需要先提取音频。

说话人识别是怎么工作的?

上传前勾选「识别说话人」。AI 会分离人声并给每段标注(说话人 1、说话人 2……)。在轮流发言清晰的场景 — 采访、会议、播客 — 最可靠,多人同时说话时效果会差一些。

时间戳可信吗?

时间戳直接来自语音模型,通常与音频误差在一秒以内。在编辑器里点击任意一句,就能听到那一刻的原始录音,自己核实。字幕导出保留每段的原始时间,所以字幕在你的视频剪辑软件里能对得上。

我的音频是私密的吗?

你的文件仅属于你的账户,加密存储,绝不分享,也绝不用于训练 AI 模型。转写只在自动化系统上运行 — 没有任何人会听你的音频。删除文件后,它就从我们的存储中消失。

可以导出什么?

PDF 和 DOCX 文档、纯文本(TXT)、表格(CSV)以及字幕文件(SRT、VTT)— 可选择带分段时间戳。你可以勾选多种格式,一次性下载。

具体支持上传哪些文件格式?

音频:MP3、WAV、M4A、AAC、FLAC、OGG、OPUS、WMA、AIFF。视频:MP4、MOV、WEBM、MKV、MPEG、AVI。只要是录音笔或剪辑软件生成的文件,几乎都能用 — 如果某种格式出了问题,告诉我们,我们会加上。

为什么比人工转写便宜这么多?

因为没有人工参与。专业转写员每分钟音频收费 1–2 美元,还要等上几天;语音模型每小时只花我们几美分,大约一分钟就能完成。你用一点点准确率的差距,换来一百倍的价格差 — 而且凡是要发表的内容,都可以逐句点击、对照音频核实。

我实际能转写多少?

免费:每天 3 个文件,天天如此 — 一个月最多 90 段录音,一分钱不花。无限量:转写次数没有上限;唯一的规则是每人一个账户。

这是谁做的?

你好 👋 — Transcript.so 由一个小型独立团队打造,不是烧风投钱的巨头。我们亲自回复支持邮件,每周上线改进,并且从成本结构上就设计得足够低,所以能把服务保持得又快又实惠。

下一段录音,不用再熬一晚上打字了。

你的第一份转写稿约一分钟就好 — 免费,无需信用卡。

转写一个文件 — 免费