자동 자막
동영상이나 오디오 파일의 말소리를 자막과 대본으로 바꿉니다. 음성 인식은 Whisper로 기기에서 실행되며 아무것도 업로드하지 않습니다.
🔒 파일과 대본은 이 기기에 남습니다.
사용 방법
사용 방법
- 1
넣을 것 추가
MP4, MOV, M4V, WebM 외 8개 형식을(를) 여기에 놓거나 기기에서 고르세요.
- 2
시작
말하는 언어, 영어 번역, 자막 텍스트을(를) 정한 뒤 시작하세요. 모두 이 브라우저 안에서 처리됩니다 — 업로드도, 대기열도, 계정도 없습니다.
- 3
결과 가져가기
작업이 끝나면 바로 SRT · VTT · TXT · WebM을(를) 받습니다. 기기에 곧바로 저장하세요.
이 도구가 하는 일
- 무엇이 들어가나
- MP4, MOV, M4V, WebM 외 8개 형식을(를) 읽습니다. 한 번에 파일 하나.
- 무엇이 나오나
- SRT · VTT · TXT · WebM이(가) 나옵니다.
- 품질은 어떻게 되나
- 파일을 읽기만 하고 바꾸지 않습니다. 원본은 그대로 남습니다.
- 어디까지 되나
- 처음 실행할 때 작은 모델을 기기에 내려받습니다. 그 뒤로는 오프라인에서도 됩니다. 길거나 고해상도인 영상은 기기 메모리가 한계입니다. 휴대폰은 노트북보다 먼저 지칩니다 — 4K 30분은 버거울 수 있습니다. 어떤 영상 코덱이 되는지는 브라우저가 정합니다. Chrome과 Edge가 가장 많이 읽고 기기에 따라 H.265도 됩니다. Safari와 Firefox는 일부를 거부합니다. 여기서 안 열리면 대개 Chrome에서 열립니다.
- 자동 자막
- OpenAI의 Whisper tiny 모델을 브라우저에서 실행합니다. 99개 언어 자동 감지, 선택적 영어 번역, 편집 가능한 시간을 지원합니다. 모델은 한 번만 내려받으면(약 41MB) 오프라인에서 작동하며, 입힌 자막은 새 WebM 동영상으로 만들어집니다.
지원하는 형식
알아두면 좋은 것
자주 묻는 질문
자막은 얼마나 정확한가요?
Whisper tiny는 가장 작은 Whisper 모델입니다. 널리 쓰이는 언어의 또렷한 말소리는 잘 인식하지만, 음악이나 여러 사람이 동시에 말하는 경우, 강한 억양에서는 오류가 생깁니다. 다운로드 전에 각 줄을 고칠 수 있습니다.
처음 실행 전에 다운로드가 있는 이유는 무엇인가요?
음성 인식에는 약 41MB의 모델이 필요합니다. 모델은 usetool.app에서 직접 받고 고정된 체크섬으로 검증한 뒤 브라우저에 보관하므로, 이후에는 인터넷 없이도 작동합니다.
여기서 어떤 파일을 쓸 수 있나요?
MP4, MOV, M4V, WebM 외 8개 형식을(를) 읽습니다. 한 번에 파일 하나.
무엇을 받게 되나요?
SRT · VTT · TXT · WebM이(가) 나옵니다.
파일 품질이 떨어지나요?
파일을 읽기만 하고 바꾸지 않습니다. 원본은 그대로 남습니다.
안 되는 경우는 언제인가요?
처음 실행할 때 작은 모델을 기기에 내려받습니다. 그 뒤로는 오프라인에서도 됩니다. 길거나 고해상도인 영상은 기기 메모리가 한계입니다. 휴대폰은 노트북보다 먼저 지칩니다 — 4K 30분은 버거울 수 있습니다. 어떤 영상 코덱이 되는지는 브라우저가 정합니다. Chrome과 Edge가 가장 많이 읽고 기기에 따라 H.265도 됩니다. Safari와 Firefox는 일부를 거부합니다. 여기서 안 열리면 대개 Chrome에서 열립니다.
동영상 화질이 떨어지나요?
다시 인코딩해야 할 때만 그렇습니다. 자르기, 합치기, 소리 제거는 영상 데이터를 그대로 복사하므로 손실이 없습니다. 압축과 워터마크는 다시 만들기 때문에 시간도 더 걸립니다.
동영상은 얼마나 길어도 되나요?
정해진 한계는 없고 기기의 메모리가 기준입니다. 휴대폰은 몇 분 정도를 여유롭게 처리하고 컴퓨터는 훨씬 더 깁니다. 긴 동영상이 실패하면 먼저 나눈 뒤 각 부분을 처리하면 대개 해결됩니다.
설계부터 비공개
파일은 기기에 그대로 남습니다
파일과 대본은 이 기기에 남습니다.
다른 도구
바로 사용
