3.0.0 — Contrôle indépendant sous-titres & narrateur + style de sous-titres IA + présentateur numérique + génération d'images

Contrôle indépendant sous-titres & narrateur + style de sous-titres IA + présentateur numérique + génération d'images

MajeurePublié le 21 juin 2026Voir sur GitHub

Nouveautés

Fonctionnalités & améliorations

  • Contrôle indépendant des sous-titres et du narrateurSubtitleConfig devient l'égal de AudioConfig, chacun avec son propre interrupteur enabled ; quatre modes de combinaison (narrateur+sous-titres, narrateur seul, sous-titres seuls, silencieux) ; nouveau paramètre subtitle_enabled sur les endpoints créatif et manuscrit.
  • Style de sous-titres IA (mode LLM)style_mode "fixed" (style global) ou "llm" (position/couleur/taille de police de chaque sous-titre décidées par le LLM) ; style_hints accepte des consignes en langage naturel (« lignes clés en rouge, résumés en jaune ») ; generate_subtitle_styles() envoie tous les sous-titres au LLM en un seul appel et rend via le sidecar subtitle_styles.json.
  • Type de tâche Présentateur numérique — présentateur IA via t2i ou i2i (photo de référence téléversée) ; le manuscrit est découpé en paragraphes de 5 à 12 s, chacun générant un clip i2v unique avec gestes/expressions différents ; TTS unifié + superposition de sous-titres optimisée par LLM ; audio du modèle ou après concaténation ; POST /api/tasks/anchor.
  • Génération d'images simple — nouveau cinquième onglet ; SimpleImageTask léger ; prise en charge du prompt système ; GET /api/image/{id} pour récupérer les résultats.
  • Prise en charge du prompt système — prompt système facultatif pour les tâches vidéo et image simples, ajouté avant le prompt final.

Refactorisation & optimisations

  • Fractionnement des étapes du pipeline_step_audio_subtitle est remplacé par _step_audio + _step_subtitle indépendants dans les pipelines créatif et manuscrit.
  • Améliorations du rendu des sous-titres — affichage multiligne avec chevauchement de 0,3 s, chevauchement de transition de 0,8 s, minutage extend-end en deux passes, protection contre le débordement des marges de sécurité, positionnement vertical en zones par LLM pour la variété visuelle.

Corrections de bugs

  • subprocess.run reçoit désormais stdin=DEVNULL, évitant le blocage des processus en arrière-plan par SIGTTIN.
  • SilentTTSEngine.generate() renvoie Nonedict vide, corrigeant la génération SRT en mode sous-titres seuls.
  • La chronologie SRT repose sur la durée audio réelle plutôt que la durée vidéo estimée.
  • En cas d'échec de génération d'image, une erreur concrète est affichée (statut HTTP + corps + traceback).
  • Correction défensive de l'encodage UTF-8 dans le pipeline du présentateur numérique ; le TTS est généré en premier pour obtenir la durée audio réelle.

À propos d’Agnes Video Generator

Un générateur de vidéos IA entièrement gratuit et open source : transformez du texte en vidéos IA multi-scènes avec narration et sous-titres.

  • Gratuit et open source — sans paiement, sans GPU haut de gamme
  • Texte-vers-vidéo, image-vers-vidéo, présentateur numérique et génération d’images
  • Propulsé par les modèles Agnes AI gratuits, vidéos générées entièrement dans le cloud
  • Fonctionne via Web UI, Docker ou npm, prend en charge l’auto-hébergement

Pages connexes

Pourquoi vous pouvez faire confiance

Cet article a été écrit par des praticiens de première ligne. Lors de l'écriture, des sources de première main telles que des articles arXiv, des rapports techniques des fabricants et l'indice Stanford AI ont été vérifiées, et ne sont pas basées sur des conclusions subjectives.

S

SandGrid@lcy362

Auteur d'Agnes Video Generator · Développeur Full-Stack

Développeur indépendant et auteur de Agnes Video Generator, un outil de génération de vidéos IA open source. Le projet est basé sur le modèle vidéo entièrement gratuit d'Agnes AI et le protocole MIT est open source. Il a aidé plus de 1 000 créateurs à produire des vidéos IA à zéro coût. Nous nous intéressons depuis longtemps à l'ingénierie et à la vulgarisation des modèles de génération vidéo, et le contenu de cet article provient de pratiques de première ligne et de recherches de première main.

Voir sur GitHub

Dernière mise à jour2026-08-21

Prêt à commencer ?

«Que l’IA de classe mondiale appartienne à tout le monde.» – Bruce Yang. Complètement gratuit, pas de carte de crédit ni de carte graphique haute performance, créez votre première vidéo IA à zéro coût. Vous souhaitez utiliser les modèles vidéo gratuits d'Agnes AI? Commencez par ici.

Clonez le dépôt GitHub et lancez en 2 minutes