Автоматические субтитры

Превратите речь из видео или аудиофайла в субтитры и расшифровку. Распознавание речи работает локально на Whisper, ничего не загружается.

Перетащите сюда видео или аудиофайлMP4 · MOV · WebM · MP3 · WAV

🔒 Файл и расшифровка остаются на этом устройстве.

Как это работает

Как это работает

  1. 1

    Добавьте то, что на входе

    Перетащите сюда MP4, MOV, M4V, WebM и ещё 8 форматов или выберите файл на устройстве.

  2. 2

    Запустите

    Задайте язык речи, перевод на английский и текст субтитров и запустите. Всё происходит в этом браузере — без загрузки, без очереди, без аккаунта.

  3. 3

    Заберите результат

    SRT · VTT · TXT · WebM готов сразу по завершении. Сохраните прямо на устройство.

Что делает этот инструмент

Что на входе
Читает MP4, MOV, M4V, WebM и ещё 8 форматов. По одному файлу за раз.
Что на выходе
На выходе SRT · VTT · TXT · WebM.
Что будет с качеством
Ваш файл читается, а не изменяется. Оригинал остаётся прежним.
Где предел
При первом запуске на устройство загружается небольшая модель. Дальше работает без сети. Длинное видео или высокое разрешение ограничены памятью устройства. Телефоны сдаются раньше ноутбуков — полчаса в 4K может оказаться слишком много. Какие видеокодеки работают, решает браузер. Chrome и Edge читают больше всего, на многих машинах и H.265; Safari и Firefox часть отвергают. Что не открылось здесь, обычно открывается в Chrome.
Автоматические субтитры
Запускает модель Whisper tiny от OpenAI прямо в браузере: 99 языков с автоопределением, перевод на английский по желанию и редактируемые тайминги. Модель загружается один раз (около 41 МБ) и затем работает офлайн; вшитые субтитры создаются как новое видео WebM.

Поддерживаемые форматы

MP4MOVWebMMKVMP3M4AWAV → SRTVTTTXTWebM

Полезно знать

Частые вопросы

Насколько точны субтитры?

Whisper tiny — самая маленькая модель Whisper. Чёткая речь на распространённых языках распознаётся хорошо; музыка, одновременная речь нескольких людей или сильный акцент приводят к ошибкам. Каждую строку можно исправить перед скачиванием.

Зачем загрузка перед первым запуском?

Для распознавания речи нужна модель размером около 41 МБ. Она загружается с самого usetool.app, проверяется по фиксированной контрольной сумме и остаётся в браузере, поэтому следующие запуски работают без интернета.

Какие файлы здесь подойдут?

Читает MP4, MOV, M4V, WebM и ещё 8 форматов. По одному файлу за раз.

Что я получу?

На выходе SRT · VTT · TXT · WebM.

Теряет ли файл качество?

Ваш файл читается, а не изменяется. Оригинал остаётся прежним.

Когда это не сработает?

При первом запуске на устройство загружается небольшая модель. Дальше работает без сети. Длинное видео или высокое разрешение ограничены памятью устройства. Телефоны сдаются раньше ноутбуков — полчаса в 4K может оказаться слишком много. Какие видеокодеки работают, решает браузер. Chrome и Edge читают больше всего, на многих машинах и H.265; Safari и Firefox часть отвергают. Что не открылось здесь, обычно открывается в Chrome.

Теряет ли видео качество?

Только если его приходится пережимать. Нарезка, склейка и удаление звука копируют изображение без изменений — это без потерь. Сжатие и водяной знак пережимают, поэтому и занимают больше времени.

Какой длины может быть видео?

Жёсткого предела нет. Решает память устройства: телефон спокойно тянет несколько минут, компьютер — заметно больше. Если длинное видео не проходит, обычно помогает сначала разделить его и работать с частями.

Приватно по устройству

Ваши файлы остаются на вашем устройстве

Файл и расшифровка остаются на этом устройстве.

Другие инструменты

Готовые

Сценарии для этого типа файлов