모든 도구

동영상을 텍스트로

동영상의 음성을 Whisper로 텍스트와 자막(SRT/VTT)으로 변환합니다 — 브라우저에서 처리, 업로드 없음.

오디오 또는 동영상 파일 선택

MP3, WAV, M4A, MP4, MOV, WebM — Whisper로 브라우저에서 받아쓰기

클릭하여 선택하거나 파일을 여기에 놓으세요

사용 방법: 동영상을 텍스트로

  1. 1

    동영상 추가

    오디오 트랙이 있는 MP4, MOV 또는 WebM을 놓으세요 — 브라우저에서 읽히며 업로드되지 않습니다.

  2. 2

    모델과 언어 선택

    Base는 더 정확하고 Tiny는 더 빠릅니다. 언어를 자동 감지로 두거나 설정하세요. 모델은 한 번 다운로드된 후(약 40~80MB) 캐시됩니다.

  3. 3

    받아쓰고 내보내기

    '받아쓰기'를 클릭하세요. 완료되면 받아쓴 내용을 일반 텍스트 또는 SRT/VTT 자막으로 복사하거나 다운로드하세요.

Related PDF tools

동영상을 텍스트로 — 자주 묻는 질문

제 동영상이 업로드되나요?+

아니요. 받아쓰기 모델(OpenAI의 Whisper)은 WebAssembly를 통해 전부 브라우저에서 실행됩니다. 동영상은 기기를 벗어나지 않습니다.

왜 일회성 다운로드가 있나요?+

Whisper 모델 가중치(Tiny 약 40MB, Base 약 80MB, 양자화됨)는 해당 크기를 처음 사용할 때 다운로드되고, 이후 브라우저가 캐시합니다 — 그 뒤로는 오프라인에서 작동하고 즉시 시작됩니다.

얼마나 정확한가요?+

Base는 지원 언어의 또렷한 발화에 대해 견고하고, Tiny는 눈에 띄게 거칠지만 훨씬 빠릅니다. 둘 다 강한 억양, 겹치는 말소리, 배경 음악, 낮은 품질의 오디오에는 약하므로 출력을 교정하세요.

무엇을 내보낼 수 있나요?+

일반 텍스트, 또는 SRT나 VTT의 타이밍 자막. SRT/VTT 타이밍은 모델의 세그먼트 타임스탬프에서 나옵니다.

제 파일을 서버에 업로드하나요?+

아니요 — 여기 있는 모든 도구는 파일을 기기에서 완전히 처리하며, 서버에 업로드되는 것은 없습니다. 유일한 예외는 AI 도구로, 작업을 위해 추출한 텍스트(파일 자체가 아님)를 Claude로 보냅니다.

파일 크기 제한이 있나요?+

저희가 임의로 설정한 제한은 없지만, 처리가 브라우저에서 이루어지므로 매우 큰 파일(500MB 이상 또는 1,000페이지 이상)은 저희가 아니라 기기의 메모리에 의해 제한됩니다.