Sous-titres automatiques

Transformez la parole d’une vidéo ou d’un fichier audio en sous-titres et en transcription. La reconnaissance vocale tourne en local avec Whisper, rien n’est envoyé.

Déposez une vidéo ou un fichier audioMP4 · MOV · WebM · MP3 · WAV

🔒 Votre fichier et la transcription restent sur cet appareil.

Comment ça marche

Comment ça marche

  1. 1

    Ajoutez ce qui entre

    Déposez votre MP4, MOV, M4V, WebM et 8 autres formats ici, ou choisissez-le sur votre appareil.

  2. 2

    Lancez

    Réglez langue, traduction et texte, puis lancez. Tout se passe dans ce navigateur : sans envoi, sans file d'attente, sans compte.

  3. 3

    Récupérez le résultat

    SRT · VTT · TXT · WebM est prêt dès la fin du traitement. Enregistrez-le directement sur votre appareil.

Ce que fait cet outil

Ce qui entre
Lit MP4, MOV, M4V, WebM et 8 autres formats. Un fichier à la fois.
Ce qui sort
Vous obtenez SRT · VTT · TXT · WebM.
Ce qu'il advient de la qualité
Votre fichier est lu, pas modifié. L'original reste tel quel.
Où cela s'arrête
Le premier lancement télécharge un petit modèle sur votre appareil. Ensuite, cela fonctionne hors ligne. Une vidéo longue ou en haute résolution est limitée par la mémoire de votre appareil. Les téléphones abandonnent plus tôt que les portables : une demi-heure en 4K peut être de trop. Les codecs vidéo disponibles dépendent de votre navigateur. Chrome et Edge en lisent le plus, parfois le H.265 ; Safari et Firefox en refusent certains. Ce qui n'ouvre pas ici s'ouvre souvent dans Chrome.
Sous-titres automatiques
Exécute le modèle Whisper tiny d’OpenAI dans le navigateur : 99 langues avec détection automatique, traduction facultative en anglais et horaires modifiables. Le modèle est téléchargé une fois (environ 41 Mo) puis fonctionne hors ligne ; les sous-titres incrustés sont rendus dans une nouvelle vidéo WebM.

Formats pris en charge

MP4MOVWebMMKVMP3M4AWAV → SRTVTTTXTWebM

Bon à savoir

Questions fréquentes

Quelle est la précision des sous-titres ?

Whisper tiny est le plus petit modèle Whisper. Une parole claire dans une langue courante donne de bons résultats ; la musique, plusieurs voix simultanées ou un fort accent provoquent des erreurs. Chaque ligne peut être corrigée avant le téléchargement.

Pourquoi un téléchargement avant la première utilisation ?

La reconnaissance vocale a besoin d’un modèle d’environ 41 Mo. Il provient de usetool.app, est vérifié par une somme de contrôle fixe, puis reste dans le navigateur : les utilisations suivantes fonctionnent sans internet.

Quels fichiers puis-je utiliser ici ?

Lit MP4, MOV, M4V, WebM et 8 autres formats. Un fichier à la fois.

Qu'est-ce que je récupère ?

Vous obtenez SRT · VTT · TXT · WebM.

Le fichier perd-il en qualité ?

Votre fichier est lu, pas modifié. L'original reste tel quel.

Quand cela ne marche-t-il pas ?

Le premier lancement télécharge un petit modèle sur votre appareil. Ensuite, cela fonctionne hors ligne. Une vidéo longue ou en haute résolution est limitée par la mémoire de votre appareil. Les téléphones abandonnent plus tôt que les portables : une demi-heure en 4K peut être de trop. Les codecs vidéo disponibles dépendent de votre navigateur. Chrome et Edge en lisent le plus, parfois le H.265 ; Safari et Firefox en refusent certains. Ce qui n'ouvre pas ici s'ouvre souvent dans Chrome.

La vidéo perd-elle en qualité ?

Uniquement si elle doit être ré-encodée. Couper, assembler et supprimer le son copient les images telles quelles : c’est sans perte. Compresser et poser un filigrane ré-encodent, d’où la durée plus longue.

Quelle durée de vidéo est possible ?

Il n’y a pas de limite fixe. C’est la mémoire de votre appareil qui décide : un téléphone gère quelques minutes sans peine, un ordinateur bien davantage. Si une longue vidéo échoue, la diviser d’abord et traiter les parties fonctionne généralement.

Privé par conception

Vos fichiers restent sur votre appareil

Votre fichier et la transcription restent sur cet appareil.

Autres outils

Prêts à l'emploi

Flux pour ce type de fichier