所有工具
视频转文字
用 Whisper 将视频的语音转写为文字和字幕(SRT/VTT)—— 在浏览器中处理,不上传。
选择音频或视频文件
MP3、WAV、M4A、MP4、MOV、WebM —— 用 Whisper 在浏览器中转写
点击选择,或将文件拖到此处
如何 视频转文字
- 1
添加视频
放入带音轨的 MP4、MOV 或 WebM —— 在浏览器中读取,绝不上传。
- 2
选择模型和语言
Base 更准确,Tiny 更快。语言保持自动检测或自行设置。模型只下载一次(约 40–80 MB),之后会缓存。
- 3
转写并导出
点击“转写”;完成后将转写内容复制或下载为纯文本或 SRT、VTT 字幕。
Related PDF tools
视频转文字 — 常见问题
我的视频会被上传吗?+
不会。转写模型(OpenAI 的 Whisper)通过 WebAssembly 完全在你的浏览器中运行。视频绝不离开你的设备。
为什么有一次性下载?+
Whisper 的模型权重(Tiny 约 40 MB,Base 约 80 MB,已量化)会在你首次使用该尺寸时下载,之后浏览器会缓存它们 —— 此后可离线运行并瞬间启动。
它有多准?+
对于受支持语言的清晰语音,Base 表现稳健;Tiny 明显更粗糙但快得多。两者在浓重口音、说话重叠、背景音乐和低质量音频下都吃力 —— 请校对输出。
我能导出什么?+
纯文本,或带时间轴的 SRT、VTT 字幕。SRT/VTT 的时间来自模型的分段时间戳。
你们会把我的文件上传到服务器吗?+
不会——这里的每个工具都完全在你的设备上处理文件,不会向服务器上传任何内容。唯一的例外是 AI 工具,它们会把提取的文本(而非文件本身)发送给 Claude 来完成工作。
有文件大小限制吗?+
我们没有人为设置限制,但由于处理过程在你的浏览器中进行,非常大的文件(超过 500MB 或 1000 页)会受到你设备内存的限制,而非我们的限制。
Advertisement
Advertisement