Guide

TXT, SRT, VTT, SBV, CSV, HTML ou PDF — quel format de transcription ?

Sept options d'export, c'est un menu, pas une décision. Chacune existe pour une tâche différente, et se tromper coûte un après-midi dans un logiciel de montage.

Les outils de transcription ont tendance à proposer une liste de formats d'export sans expliquer à quoi chacun sert. Voici la décision, dans un tableau puis en détail.

Vous voulez… Utilisez
La lire, la modifier, la coller TXT
Sous-titrer une vidéo dans Premiere ou Final Cut SRT
Sous-titrer une vidéo sur le web VTT
Téléverser des sous-titres sur YouTube SRT (ou SBV)
Trier, filtrer ou compter CSV
La publier sur une page HTML
L'envoyer à quelqu'un qui ne doit pas la modifier PDF

Les formats texte #

TXT #

Uniquement les mots, sans minutage. C'est le bon choix par défaut pour tout ce que vous allez lire ou à partir de quoi vous allez écrire — coller dans des notes, alimenter un document, chercher une expression.

Ce qu'il faut savoir : une fois le TXT exporté, les minutages ont disparu. S'il y a la moindre chance que vous ayez besoin de retrouver plus tard le moment dans l'audio, exportez aussi un format horodaté. Avoir les deux ne coûte rien.

PDF #

Un document figé. Utilisez-le quand la transcription est un livrable plutôt qu'un fichier de travail : envoyer un compte rendu à un client, verser une pièce à un dossier, l'annexer à un rapport où elle doit avoir la même apparence sur toutes les machines et ne pas être modifiée à la légère.

Ne vous en servez pas comme copie de travail. Récupérer proprement le texte d'un PDF est pénible.

HTML #

Une transcription sous forme de page web. C'est ce qu'il vous faut si la transcription doit être publiée — sur un blog, dans une base de connaissances, comme complément accessible à un épisode de podcast.

La raison sous-estimée de publier les transcriptions en HTML : les moteurs de recherche lisent du texte, pas de l'audio. Un podcast dont les transcriptions sont publiées se trouve d'une manière qu'un fichier audio ne permettra jamais, et c'est l'amélioration d'accessibilité la moins coûteuse dont dispose un podcast.

Les formats de sous-titres #

Ces trois-là font le même travail — du texte plus des minutages, pour un affichage par-dessus la vidéo — et diffèrent par la syntaxe plutôt que par les possibilités.

SRT #

L'universel. Tous les logiciels de montage, tous les lecteurs, toutes les plateformes l'acceptent. En cas de doute, c'est la réponse.

1
00:00:00,000 --> 00:00:07,000
Good afternoon everyone and welcome
to the second quarter earnings call.

Des blocs numérotés, un code temporel de début et de fin, le texte, une ligne vide. Notez la virgule avant les millisecondes.

VTT (WebVTT) #

Le standard du web, et ce qu'attend la vidéo HTML5. Structurellement presque identique au SRT, avec deux différences qui comptent : le fichier commence par une ligne WEBVTT, et les codes temporels utilisent un point avant les millisecondes plutôt qu'une virgule.

WEBVTT

00:00:00.000 --> 00:00:07.000
Good afternoon everyone and welcome
to the second quarter earnings call.

C'est le problème de sous-titrage le plus courant : un SRT renommé en .vtt, ou l'inverse. Le fichier paraît correct et échoue silencieusement au chargement. Si des sous-titres sont rejetés sans raison apparente, vérifiez ce caractère en premier.

Le VTT peut aussi porter de la mise en forme et du positionnement, ce que le SRT ne peut pas — rarement nécessaire, mais parfois la raison de le choisir.

SBV #

Le format propre à YouTube, datant de l'époque où il n'acceptait pas tout le reste. Encore plus simple : des codes temporels séparés par une virgule, pas de numéros de bloc.

0:00:00.000,0:00:07.000
Good afternoon everyone and welcome
to the second quarter earnings call.

Utile quand un flux de travail l'exige spécifiquement. YouTube accepte parfaitement le SRT aujourd'hui : c'est donc une option de compatibilité plutôt qu'un premier choix.

Le format d'analyse #

CSV #

Une ligne par segment, avec l'heure de début, l'heure de fin et le texte en colonnes. C'est le format auquel personne ne pense et celui qui ouvre le plus de possibilités.

Ouvrez-le dans Numbers, Excel ou un carnet Python et vous pouvez faire des choses impossibles dans un document texte :

  • Trier les segments par longueur pour trouver les passages ininterrompus les plus longs.
  • Filtrer chaque segment contenant un terme donné, avec son horodatage, pour constituer un index de citations.
  • Compter la fréquence d'apparition d'un sujet dans tout un dossier de transcriptions.
  • Réunir les transcriptions de plusieurs enregistrements en un seul jeu de données de recherche.

Si vous transcrivez pour analyser plutôt que pour lire — recherche utilisateur, analyse de contenu, revue de conformité — exportez du CSV en plus de votre TXT.

Deux règles pratiques #

Exportez plus d'un format. Ils ne coûtent rien à produire et répondent à des questions différentes. Un TXT plus un format horodaté couvre presque toutes les éventualités.

Vérifiez le fichier avant de construire dessus. Les transcriptions automatiques contiennent des erreurs, et c'est à ce stade qu'elles coûtent le moins cher à corriger. Parcourez-la pour les noms et les nombres avant d'importer 400 sous-titres dans un logiciel de montage et de commencer à les mettre en forme.

D'où vient tout cela #

Offline Transcription exporte les sept formats — TXT, SRT, SBV, VTT, CSV, HTML et PDF — sur Mac comme sur iPhone, à partir de la même transcription, sans téléverser l'enregistrement où que ce soit.

Si votre objectif porte spécifiquement sur les sous-titres, nous avons un pas à pas pour créer un SRT et le charger dans Final Cut, Premiere ou YouTube.

Obtenir Offline Transcription

Transcrivez vos fichiers audio et vidéo entièrement sur votre Mac. Rien n'est envoyé en ligne, aucun compte n'est requis et il n'y a pas de compteur à la minute.

macOS 13.0 or higher · iOS 16.4 or higher