MP3
直接上传
无需先转换为 WAV
从文件开始
在下方选择 MP3。处理前可以设置语言、说话人识别、关键词和文字稿风格。
MP3
无需先转换为 WAV
99
可手动选择或自动检测
5 GB
每次上传一个文件
4
TXT、Markdown、SRT 和 VTT
四步完成转写
同一个工作区会把文件从上传一路带到可编辑、可下载的文字稿。
选择一个不超过 5 GB 的 MP3 文件,无需转换为 WAV。
选择语言或自动检测,并按需开启说话人识别、添加关键词。
登录并确认预计额度,处理可在后台继续进行。
对照音频检查初稿、编辑文字,再导出 TXT、Markdown、SRT 或 VTT。
边听、边查、边改
初稿只是起点。边听原始音频边读文字,检查低置信度内容,最后得到真正可以使用的文字稿。


录音质量
更清晰的录音能为转写提供更可靠的语音信息。背景噪音、削波或失真、口音、多人重叠讲话和专业术语都可能影响初稿。
尽量使用最干净的录音,并让说话人和麦克风保持合适距离。
尽量轮流发言,文字内容和说话人切换会更容易辨认。
知道语言时可直接选择,不确定时可以保留自动检测。
把重要人名或专业词加入关键词,并在完成后的文字稿中再次核对。
把音频变成内容资产
MP3 文字稿让录音内容更容易搜索、编辑、引用、制作字幕和再次利用。
为节目笔记、文章、研究和单集归档生成可编辑的基础文本。
把录制的讨论变成可搜索笔记,并可重命名不同说话人。
把课堂、网络研讨会、培训和学习录音整理成文字参考。
把想法、观察和现场录音转换成便于整理和引用的文字。
MP3 转文字常见问题
了解上传、额度、校对、导出和源文件保留的实用细节。
可以。系统直接接受 MP3,无需先转换为 WAV。
开始使用时需要创建账户。新账户会获得 10 个注册额度,无需信用卡;1 个额度可转写 1 分钟音频。
单文件上传上限为 5 GB,每次可上传一个音频或视频文件。
服务支持 99 种语言。你可以选择音频语言,也可以使用自动语言检测。
转写设置中可以开启说话人识别。处理完成后,你还可以在校对文字稿时修改说话人名称。
结果会受到录音质量影响。清晰人声、较少背景噪音和较少多人重叠讲话都有帮助。你可以在校对工作区对照原始音频检查不确定的句子。
文字稿完成后可导出 TXT、Markdown、SRT 或 VTT。
从任务创建起,源媒体最多保留 7 天供你校对。请在期限结束前下载需要长期保存的文件。