Combien de temps prend Video to Text ?

Découvrez ce qui influence la vitesse de transcription dans Video to Text, notamment la taille du fichier, le temps d'import et des exemples de benchmarks réalistes.

Dkphhh

La durée d’un traitement Video to Text dépend à la fois du temps d’import et du temps de transcription. En pratique, la plupart des fichiers se terminent rapidement, et les notes produit actuelles utilisent un facteur temps réel (RTF) de 0,008x comme point de référence pour la vitesse de transcription.

Ce chiffre signifie que l’étape de transcription est bien plus rapide que la durée du média d’origine. Le délai total inclut quand même l’import du fichier, les conditions réseau et la complexité du fichier.

Si vous n’avez pas encore utilisé l’outil, commencez par Comment utiliser Video to Text. Si vous préparez encore votre fichier, consultez Formats multimédias pris en charge par Video to Text.

Exemples de délais actuels

Voici les exemples de benchmark déjà utilisés dans les documents du projet :

Type d’enregistrementDurée du médiaExemple de temps de traitement
Réunion1 h 3 min35 secondes
Podcast3 h 15 min133 secondes
Cours vidéo8 h 21 min300 secondes

Ces exemples aident à se faire une idée, mais votre propre résultat peut varier.

Qu’est-ce qui influence le temps d’attente total ?

1. Vitesse d’import

L’application doit importer le fichier source avant de pouvoir commencer la transcription. Une connexion lente ou instable peut ajouter un temps notable, surtout pour les fichiers vidéo volumineux.

2. Durée du fichier

Les enregistrements plus longs demandent généralement plus de temps à traiter. Cela dit, l’étape de transcription reste conçue pour aller bien plus vite que le temps réel.

3. Taille et format du fichier

Un fichier long dans un format audio compact peut s’importer plus vite qu’un fichier plus court dans un format beaucoup plus lourd. Les fichiers vidéo sont souvent plus gros que les fichiers audio seuls, donc l’étape d’import peut devenir le principal délai.

4. Clarté de l’audio

Le bruit de fond, les locuteurs qui se chevauchent et le contenu en plusieurs langues peuvent rendre le traitement moins prévisible qu’un enregistrement propre avec un seul locuteur.

À quoi s’attendre avec les fichiers longs ?

Si votre fichier média est proche de la limite de durée supérieure, attendez-vous à un délai global plus long. Le fichier doit d’abord être importé, et les imports volumineux peuvent prendre plus de temps que la transcription elle-même.

Les règles d’import actuelles sont :

  • taille du fichier jusqu’à 5 Go
  • durée du média inférieure à 10 heures

Si votre enregistrement est volumineux, une connexion Internet stable aide plus que tout.

Comment terminer plus vite en pratique

Vous ne pouvez pas changer le contenu parlé, mais vous pouvez réduire les délais évitables :

  • importez l’audio plutôt que la vidéo quand vous n’avez besoin que de la transcription
  • utilisez une connexion stable avant de lancer l’import
  • coupez les intros, outros ou passages vides inutiles avant l’export
  • choisissez la bonne option de langue au lieu de deviner

Une fois la transcription terminée

Quand la transcription est prête, Video to Text vous amène à la page d’export. Vous pouvez ensuite télécharger le résultat en :

  • csv
  • srt
  • vtt
  • txt

Si vous avez besoin de sous-titres tout de suite, commencez par srt ou vtt. Si vous prévoyez de relire la transcription dans un tableur, utilisez csv.

Documents associés

Étiquettes
video to textvitessetranscriptiondocumentation