3.0.0 — Contrôle indépendant sous-titres & narrateur + style de sous-titres IA + présentateur numérique + génération d'images
Contrôle indépendant sous-titres & narrateur + style de sous-titres IA + présentateur numérique + génération d'images
Nouveautés
Fonctionnalités & améliorations
- Contrôle indépendant des sous-titres et du narrateur —
SubtitleConfigdevient l'égal deAudioConfig, chacun avec son propre interrupteurenabled; quatre modes de combinaison (narrateur+sous-titres, narrateur seul, sous-titres seuls, silencieux) ; nouveau paramètresubtitle_enabledsur les endpoints créatif et manuscrit. - Style de sous-titres IA (mode LLM) —
style_mode"fixed"(style global) ou"llm"(position/couleur/taille de police de chaque sous-titre décidées par le LLM) ;style_hintsaccepte des consignes en langage naturel (« lignes clés en rouge, résumés en jaune ») ;generate_subtitle_styles()envoie tous les sous-titres au LLM en un seul appel et rend via le sidecarsubtitle_styles.json. - Type de tâche Présentateur numérique — présentateur IA via t2i ou i2i (photo de référence téléversée) ; le manuscrit est découpé en paragraphes de 5 à 12 s, chacun générant un clip i2v unique avec gestes/expressions différents ; TTS unifié + superposition de sous-titres optimisée par LLM ; audio du modèle ou après concaténation ;
POST /api/tasks/anchor. - Génération d'images simple — nouveau cinquième onglet ;
SimpleImageTaskléger ; prise en charge du prompt système ;GET /api/image/{id}pour récupérer les résultats. - Prise en charge du prompt système — prompt système facultatif pour les tâches vidéo et image simples, ajouté avant le prompt final.
Refactorisation & optimisations
- Fractionnement des étapes du pipeline —
_step_audio_subtitleest remplacé par_step_audio+_step_subtitleindépendants dans les pipelines créatif et manuscrit. - Améliorations du rendu des sous-titres — affichage multiligne avec chevauchement de 0,3 s, chevauchement de transition de 0,8 s, minutage
extend-enden deux passes, protection contre le débordement des marges de sécurité, positionnement vertical en zones par LLM pour la variété visuelle.
Corrections de bugs
subprocess.runreçoit désormaisstdin=DEVNULL, évitant le blocage des processus en arrière-plan par SIGTTIN.SilentTTSEngine.generate()renvoieNone→dictvide, corrigeant la génération SRT en mode sous-titres seuls.- La chronologie SRT repose sur la durée audio réelle plutôt que la durée vidéo estimée.
- En cas d'échec de génération d'image, une erreur concrète est affichée (statut HTTP + corps + traceback).
- Correction défensive de l'encodage UTF-8 dans le pipeline du présentateur numérique ; le TTS est généré en premier pour obtenir la durée audio réelle.
À propos d’Agnes Video Generator
Un générateur de vidéos IA entièrement gratuit et open source : transformez du texte en vidéos IA multi-scènes avec narration et sous-titres.
- Gratuit et open source — sans paiement, sans GPU haut de gamme
- Texte-vers-vidéo, image-vers-vidéo, présentateur numérique et génération d’images
- Propulsé par les modèles Agnes AI gratuits, vidéos générées entièrement dans le cloud
- Fonctionne via Web UI, Docker ou npm, prend en charge l’auto-hébergement
Pages connexes
Notes de version
Historique des versions d’Agnes Video Generator : nouvelles fonctionnalités, améliorations et corrections par version.
Essayer la démo en ligne | Agnes Video
Entrez un prompt et générez instantanément des vidéos et images IA
API Texte vers Vidéo — génération vidéo IA gratuite | Agnes Video
Appel programmatique du modèle vidéo gratuit Agnes AI: texte en vidéo, image en vidéo, génération de narration, etc. Couverture complète de l'API REST, y compris les paramètres de demande, l'authentification du porteur, le sondage de l'état de la tâche et les exemples de code complets (Python/cURL/HTTP). Convivial aux développeurs, à zéro coût, il n'y a pas besoin d'une carte graphique haute performance pour y accéder.
Pourquoi vous pouvez faire confiance
Cet article a été écrit par des praticiens de première ligne. Lors de l'écriture, des sources de première main telles que des articles arXiv, des rapports techniques des fabricants et l'indice Stanford AI ont été vérifiées, et ne sont pas basées sur des conclusions subjectives.
SandGrid@lcy362
Auteur d'Agnes Video Generator · Développeur Full-Stack
Développeur indépendant et auteur de Agnes Video Generator, un outil de génération de vidéos IA open source. Le projet est basé sur le modèle vidéo entièrement gratuit d'Agnes AI et le protocole MIT est open source. Il a aidé plus de 1 000 créateurs à produire des vidéos IA à zéro coût. Nous nous intéressons depuis longtemps à l'ingénierie et à la vulgarisation des modèles de génération vidéo, et le contenu de cet article provient de pratiques de première ligne et de recherches de première main.
Voir sur GitHubDernière mise à jour:2026-08-21
Prêt à commencer ?
«Que l’IA de classe mondiale appartienne à tout le monde.» – Bruce Yang. Complètement gratuit, pas de carte de crédit ni de carte graphique haute performance, créez votre première vidéo IA à zéro coût. Vous souhaitez utiliser les modèles vidéo gratuits d'Agnes AI? Commencez par ici.
Clonez le dépôt GitHub et lancez en 2 minutes