Fonctionnement

Le texte est à vous. Le temps vient de la voix.

Ce sont deux questions différentes, et les confondre est ce qui produit des sous-titres approximatifs. Voici comment elles sont traitées séparément.

La chaîne, étape par étape.

La vidéo arrive

Depuis un projet Sakira Songs, depuis Clip Express, ou par simple import d’un fichier.

La voix est mesurée

L’audio est analysé mot par mot : à quelle seconde chaque mot commence, à quelle seconde il finit.

Vos paroles sont alignées dessus

Chaque mot de vos paroles trouve son ancre dans la voix et reçoit son temps ; les mots sans ancre sont répartis entre leurs voisins. Le texte n’est jamais remplacé par ce qui a été entendu.

Vous relisez et corrigez

La frise montre chaque ligne à sa place. Déplacez, coupez, fusionnez, retapez. Ce que vous corrigez est ce qui sera incrusté.

Les sous-titres sont incrustés

Police, couleur, contour, position, fond : le rendu produit un MP4 prêt à publier, et un fichier SRT si vous le préférez séparé.

Ce que ça évite.

Les noms massacrés

Un prénom, une marque, un lieu : une transcription les invente. Ici, ils sont écrits comme vous les avez écrits.

Les lignes qui traînent

Une ligne qui reste à l’écran vingt secondes parce que l’outil n’a « rien entendu » : le temps est mesuré sur la voix, pas déclaré par le fournisseur du morceau.

Les langues mêlées

Un refrain en français, un pont en anglais, un mot en khmer : le texte est le vôtre, la langue ne le trahit pas.