跳到主要内容
VVimorph

音频转文字 · 视频转写

把一段录音,整理成真正能继续使用的文字

上传会议录音、访谈、课程或视频,获得带时间点的转写结果。校对后可直接翻译,同时保留时间轴和说话人,并导出文字或字幕文件。

Audio transcription workspace with waveform, timestamps, and speaker labels

访谈录音.wav

普通话 · 12 分钟 · 2 位说话人

00:00Speaker 1
00:34Speaker 2
01:12Speaker 1

同一份录音,按用途选择结果

TXT

纯文字

适合整理笔记、归档、搜索和继续改写。

TIMELINE

文字与时间点

保留每段内容出现的位置,回听时不用反复拖进度条。

SRT · VTT

字幕与翻译

校对原文后直接翻译,导出单语或双语 SRT,也可保留 VTT 原字幕。

从文件到可编辑文字

1

上传音频或视频

选择源语言;多人对话可打开说话人识别。

2

等待识别并校对

按时间段检查人名和术语;长文件处理后可从历史记录重新打开。

3

翻译或直接导出

需要跨语言使用时再选择目标语言,并下载原文、译文或双语字幕。

这些内容最适合先转写

会议与访谈

先保留完整原话,再整理纪要、结论和待办。

课程与播客

做成可搜索的文字稿,也方便后续拆成文章或摘要。

视频字幕

从已有音轨生成带时间点的字幕底稿,减少手动听写。

准确率不是一个固定数字

清晰的人声、较少的重叠讲话和正确的源语言设置,通常会得到更稳的结果。方言、背景音乐、远距离收音和生僻专有名词仍可能需要人工校对。正式发布前,建议回听人名、数字、品牌名和关键结论。

查看准确率指南

支持的输入与输出

输入
MP3、WAV、M4A、AAC、FLAC、MP4、MOV、WebM
源语言
自动检测,或手动指定音频中的主要语言
转写后翻译
支持中文、英语、日语、韩语、西班牙语、法语、德语和葡萄牙语
多人对话
可启用说话人识别,翻译时保留时间点和发言者
输出
在线编辑、原文或译文 TXT、SRT、双语 SRT,以及原文 VTT

常见问题

视频也能转成文字吗?

可以。上传含有音轨的视频后,系统会识别其中的语音,并可生成带时间点的文字或字幕文件。

多人会议能区分发言人吗?

可以启用说话人识别。结果会按不同发言者分段,但重叠说话或收音距离差异较大时仍需检查。

转写完成后可以直接翻译吗?

可以。建议先校对原文,再选择目标语言。译文会保留原有时间点和说话人信息。

翻译会覆盖原文吗?

不会。原始转写和译文分开保存,可以随时切换查看。

能导出双语字幕吗?

可以导出仅译文的 TXT 或 SRT,也可以导出原文与译文同时显示的双语 SRT。

上传后需要一直开着页面吗?

不需要。任务会在后台继续处理,之后可从转写历史中打开。

先解决一个具体问题

有一段录音要整理?

先上传原文件。校对转写结果后,再决定导出原文、翻译文本或双语字幕。

开始转写