所有工具

视频转文字

用 Whisper 将视频的语音转写为文字和字幕(SRT/VTT)—— 在浏览器中处理,不上传。

选择音频或视频文件

MP3、WAV、M4A、MP4、MOV、WebM —— 用 Whisper 在浏览器中转写

点击选择,或将文件拖到此处

如何 视频转文字

  1. 1

    添加视频

    放入带音轨的 MP4、MOV 或 WebM —— 在浏览器中读取,绝不上传。

  2. 2

    选择模型和语言

    Base 更准确,Tiny 更快。语言保持自动检测或自行设置。模型只下载一次(约 40–80 MB),之后会缓存。

  3. 3

    转写并导出

    点击“转写”;完成后将转写内容复制或下载为纯文本或 SRT、VTT 字幕。

Related PDF tools

视频转文字 — 常见问题

我的视频会被上传吗?+

不会。转写模型(OpenAI 的 Whisper)通过 WebAssembly 完全在你的浏览器中运行。视频绝不离开你的设备。

为什么有一次性下载?+

Whisper 的模型权重(Tiny 约 40 MB,Base 约 80 MB,已量化)会在你首次使用该尺寸时下载,之后浏览器会缓存它们 —— 此后可离线运行并瞬间启动。

它有多准?+

对于受支持语言的清晰语音,Base 表现稳健;Tiny 明显更粗糙但快得多。两者在浓重口音、说话重叠、背景音乐和低质量音频下都吃力 —— 请校对输出。

我能导出什么?+

纯文本,或带时间轴的 SRT、VTT 字幕。SRT/VTT 的时间来自模型的分段时间戳。

你们会把我的文件上传到服务器吗?+

不会——这里的每个工具都完全在你的设备上处理文件,不会向服务器上传任何内容。唯一的例外是 AI 工具,它们会把提取的文本(而非文件本身)发送给 Claude 来完成工作。

有文件大小限制吗?+

我们没有人为设置限制,但由于处理过程在你的浏览器中进行,非常大的文件(超过 500MB 或 1000 页)会受到你设备内存的限制,而非我们的限制。