Automatische Untertitel

Mach aus der Sprache in einem Video oder einer Audiodatei Untertitel und ein Transkript. Die Spracherkennung läuft lokal mit Whisper, nichts wird hochgeladen.

Video oder Audiodatei hierher ziehenMP4 · MOV · WebM · MP3 · WAV

🔒 Datei und Transkript bleiben auf diesem Gerät.

So funktioniert es

So funktioniert es

  1. 1

    Hineingeben

    Leg deine MP4, MOV, M4V, WebM und 8 weitere Formate hier ab oder wähle sie vom Gerät.

  2. 2

    Starten

    Stell gesprochene Sprache, Übersetzung ins Englische und Untertiteltext ein, dann starte. Alles läuft in diesem Browser — kein Upload, keine Warteschlange, kein Konto.

  3. 3

    Ergebnis mitnehmen

    SRT · VTT · TXT · WebM steht bereit, sobald der Lauf durch ist. Direkt auf dein Gerät speichern.

Was dieses Werkzeug tut

Was hineingeht
Liest MP4, MOV, M4V, WebM und 8 weitere Formate. Eine Datei auf einmal.
Was herauskommt
Heraus kommt SRT · VTT · TXT · WebM.
Was mit der Qualität passiert
Deine Datei wird gelesen, nicht verändert. Das Original bleibt genau so, wie es war.
Wo es aufhört
Beim ersten Lauf lädt ein kleines Modell auf dein Gerät. Danach geht es offline. Ein langes oder hochauflösendes Video begrenzt der Arbeitsspeicher deines Geräts. Telefone geben früher auf als Notebooks — eine halbe Stunde in 4K kann zu viel sein. Welche Videocodecs gehen, entscheidet dein Browser. Chrome und Edge lesen am meisten, auf vielen Geräten auch H.265; Safari und Firefox verweigern manches. Was hier nicht aufgeht, öffnet meist in Chrome.
Automatische Untertitel
Führt OpenAIs Whisper-tiny-Modell im Browser aus: 99 Sprachen mit automatischer Erkennung, auf Wunsch Übersetzung ins Englische und bearbeitbare Zeiten. Das Modell wird einmal geladen (rund 41 MB) und läuft danach offline; eingebrannte Untertitel entstehen als neues WebM-Video.

Unterstützte Formate

MP4MOVWebMMKVMP3M4AWAV → SRTVTTTXTWebM

Gut zu wissen

Häufige Fragen

Wie genau sind die Untertitel?

Whisper tiny ist das kleinste Whisper-Modell. Deutliche Sprache in verbreiteten Sprachen klappt gut; Musik, mehrere Sprecher gleichzeitig oder starke Akzente führen zu Fehlern. Jede Zeile lässt sich vor dem Herunterladen korrigieren.

Warum gibt es vor dem ersten Lauf einen Download?

Die Spracherkennung braucht ein Modell von rund 41 MB. Es kommt von usetool.app selbst, wird gegen eine feste Prüfsumme geprüft und bleibt danach im Browser, sodass spätere Läufe ohne Internet funktionieren.

Welche Dateien kann ich hier verwenden?

Liest MP4, MOV, M4V, WebM und 8 weitere Formate. Eine Datei auf einmal.

Was bekomme ich zurück?

Heraus kommt SRT · VTT · TXT · WebM.

Verliert die Datei an Qualität?

Deine Datei wird gelesen, nicht verändert. Das Original bleibt genau so, wie es war.

Wann geht es nicht?

Beim ersten Lauf lädt ein kleines Modell auf dein Gerät. Danach geht es offline. Ein langes oder hochauflösendes Video begrenzt der Arbeitsspeicher deines Geräts. Telefone geben früher auf als Notebooks — eine halbe Stunde in 4K kann zu viel sein. Welche Videocodecs gehen, entscheidet dein Browser. Chrome und Edge lesen am meisten, auf vielen Geräten auch H.265; Safari und Firefox verweigern manches. Was hier nicht aufgeht, öffnet meist in Chrome.

Verliert das Video an Qualität?

Nur wenn es neu berechnet werden muss. Schneiden, Zusammenfügen und Tonentfernen kopieren die Bilddaten unverändert und sind damit verlustfrei. Verkleinern und Wasserzeichen rechnen neu — deshalb dauern sie länger.

Wie lang darf ein Video sein?

Es gibt keine feste Grenze. Entscheidend ist der Arbeitsspeicher deines Geräts: ein Handy schafft ein paar Minuten bequem, ein Rechner deutlich mehr. Scheitert ein langes Video, hilft es meist, es erst zu teilen und die Teile zu bearbeiten.

Privat gebaut

Deine Dateien bleiben auf deinem Gerät

Datei und Transkript bleiben auf diesem Gerät.

Weitere Werkzeuge

Fertig eingerichtet

Abläufe für diese Dateiart