Voix off & sous-titres : ajouter du son aux vidéos IA

Le mode présentateur fournit une voix TTS et une synchronisation labiale intégrées ; la vidéo classique à partir de texte nécessite d'ajouter voix off et sous-titres vous-même.

Une question fréquente au début : les vidéos générées par IA ont-elles une voix off automatique ? Dois-je ajouter les sous-titres moi-même ? La réponse dépend du mode de génération utilisé. Le mode présentateur génère la voix et la synchronisation labiale automatiquement dans le modèle. La vidéo classique à partir de texte ne produit en revanche que de l'image — ni voix off, ni sous-titres. Ce guide explique les deux cas et où ajouter les sous-titres.

Mode présentateur : une seule image de référence suffit pour une vidéo commentée

Le mode présentateur ne nécessite qu'une image de référence d'une personne numérique pour produire une vidéo où une personne parle. La voix off est générée automatiquement par la TTS intégrée et la synchronisation labiale est gérée dans le modèle — aucun enregistrement supplémentaire ni alignement manuel requis. À noter : les scènes multi-personnages et les bibliothèques de mouvements avancées sont disponibles sur des plateformes externes comme HeyGen, Synthesia ou D-ID, et ne font pas partie du mode présentateur ici.

Astuce : une image de présentateur plus la TTS intégrée suffisent — aucun outil vocal supplémentaire nécessaire.

Vidéo classique à partir de texte : pas de voix off par défaut

Si vous transformez simplement un prompt texte en vidéo et que personne ne parle à l'image, le résultat ne contient ni voix automatique ni sous-titres. Vous obtenez uniquement de l'image propre et gérez vous-même la voix off et les sous-titres dans votre outil de montage. Notez aussi les limites de génération : jusqu'à 15–20 secondes par clip, résolution 720p et limite de débit de 16 requêtes par minute.

Comment ajouter des sous-titres ?

Les clips classiques à partir de texte n'ont pas de sous-titres : ajoutez-les après export avec un éditeur comme CapCut, Premiere ou équivalent. Si vous voulez des sous-titres intégrés, passez au mode présentateur — les vidéos de ce mode incluent des sous-titres synchronisés avec la voix off.

Essayez dans la démo

La démo en ligne et Studio proposent tous deux un accès au mode présentateur, et /api-docs expose toute l'API. Générez dès maintenant une vidéo commentée à partir d'une seule image.

Essayer la démo

Voiceover & Subtitles References

The TTS voiceover, lip-sync, and subtitle-burning approaches on this page reference the following industry products and open-source tech.

  1. HeyGen — 数字人视频创作平台HeyGen · heygen.com (2025)

    Digital-human platforms like HeyGen mentioned here are described per their official product docs.

  2. ElevenLabs — AI 语音与 TTSElevenLabs · elevenlabs.io (2025)

    For DIY voiceovers, ElevenLabs is a mainstream AI TTS option; its voices and language support follow its official site.

  3. Whisper — 自动语音识别与字幕转录OpenAI · GitHub (openai/whisper) (2023)

    For auto subtitle transcription, OpenAI's open-source Whisper model is a reference implementation.

  4. CapCut — 视频剪辑与字幕工具ByteDance · capcut.com (2025)

    The subtitle-burning features of editors recommended here (Jianying/CapCut, etc.) follow their official docs.

Pourquoi vous pouvez faire confiance

Cet article a été écrit par des praticiens de première ligne. Lors de l'écriture, des sources de première main telles que des articles arXiv, des rapports techniques des fabricants et l'indice Stanford AI ont été vérifiées, et ne sont pas basées sur des conclusions subjectives.

S

SandGrid@lcy362

Auteur d'Agnes Video Generator · Développeur Full-Stack

Développeur indépendant et auteur de Agnes Video Generator, un outil de génération de vidéos IA open source. Le projet est basé sur le modèle vidéo entièrement gratuit d'Agnes AI et le protocole MIT est open source. Il a aidé plus de 1 000 créateurs à produire des vidéos IA à zéro coût. Nous nous intéressons depuis longtemps à l'ingénierie et à la vulgarisation des modèles de génération vidéo, et le contenu de cet article provient de pratiques de première ligne et de recherches de première main.

Voir sur GitHub

Dernière mise à jour2026-08-21

Prêt à commencer ?

«Que l’IA de classe mondiale appartienne à tout le monde.» – Bruce Yang. Complètement gratuit, pas de carte de crédit ni de carte graphique haute performance, créez votre première vidéo IA à zéro coût. Vous souhaitez utiliser les modèles vidéo gratuits d'Agnes AI? Commencez par ici.

Clonez le dépôt GitHub et lancez en 2 minutes