3.0.0 — Controllo indipendente di sottotitoli e narratore + stile sottotitoli AI + presentatore digitale + generazione di immagini

Controllo indipendente di sottotitoli e narratore + stile sottotitoli AI + presentatore digitale + generazione di immagini

PrincipaleRilasciata il 21 giugno 2026Vedi su GitHub

Novità

Funzionalità e miglioramenti

  • Controllo indipendente di sottotitoli e narratoreSubtitleConfig viene elevato allo stesso livello di AudioConfig, ciascuno con il proprio interruttore enabled; quattro modalità di combinazione (narratore+sottotitoli, solo narratore, solo sottotitoli, silenzioso); nuovo parametro subtitle_enabled negli endpoint creativo e manoscritto.
  • Stile sottotitoli AI (modalità LLM)style_mode "fixed" (stile globale) o "llm" (posizione/colore/dimensione carattere di ogni sottotitolo decisi dal LLM); style_hints accetta indicazioni in linguaggio naturale («righe chiave in rosso, riepiloghi in giallo»); generate_subtitle_styles() invia tutti i sottotitoli al LLM in una sola chiamata e renderizza tramite il sidecar subtitle_styles.json.
  • Tipo di attività Presentatore digitale — presentatore IA tramite t2i o i2i (foto di riferimento caricata dall'utente); il manoscritto è diviso in paragrafi di 5–12 s, ognuno genera un clip i2v unico con gesti/espressioni diversi; TTS unificato + sovrapposizione sottotitoli ottimizzata dal LLM; audio dal modello o dopo la concatenazione; POST /api/tasks/anchor.
  • Generazione immagini semplice — nuova quinta scheda; SimpleImageTask leggero; supporto del system prompt; GET /api/image/{id} per recuperare i risultati.
  • Supporto del system prompt — system prompt opzionale per attività video e immagini semplici, anteposto al prompt finale.

Refactoring e ottimizzazioni

  • Suddivisione delle fasi della pipeline_step_audio_subtitle viene sostituito da _step_audio + _step_subtitle indipendenti nelle pipeline creativa e manoscritto.
  • Miglioramenti al rendering dei sottotitoli — visualizzazione su più righe con sovrapposizione di 0,3 s, sovrapposizione di transizione di 0,8 s, temporizzazione extend-end a due passate, protezione dallo sforamento dei margini di sicurezza, posizionamento verticale a zone tramite LLM per varietà visiva.

Correzioni di bug

  • subprocess.run ora aggiunge stdin=DEVNULL, evitando che i processi in background si blocchino per SIGTTIN.
  • SilentTTSEngine.generate() restituisce Nonedict vuoto, correggendo la generazione SRT in modalità solo sottotitoli.
  • La timeline SRT si basa sulla durata audio effettiva anziché sulla durata video stimata.
  • Quando la generazione dell'immagine fallisce, viene mostrato l'errore concreto (stato HTTP + body + traceback).
  • Correzione difensiva della codifica UTF-8 nella pipeline del presentatore digitale; il TTS viene generato per primo per ottenere la durata audio effettiva.

Informazioni su Agnes Video Generator

Un generatore di video IA completamente gratuito e open source: trasforma il testo in video IA multi-scena con narrazione e sottotitoli.

  • Gratuito e open source — senza pagamenti, senza GPU di fascia alta
  • Testo-verso-video, immagine-verso-video, presentatore digitale e generazione di immagini
  • Alimentato dai modelli Agnes AI gratuiti, video generati interamente nel cloud
  • Funziona tramite Web UI, Docker o npm, supporta self-hosting

Pagine correlate

Perché puoi fidarti

Questo articolo è stato scritto da professionisti in prima linea. Durante la scrittura, ha controllato fonti di prima mano come documenti arXiv, rapporti tecnici dei produttori e Stanford AI Index. Non si basa su conclusioni basate su impressioni soggettive.

S

SandGrid@lcy362

Autore di Agnes Video Generator · Sviluppatore Full-Stack

Sviluppatore indipendente e autore di Agnes Video Generator, uno strumento di generazione di Video AI open source. Il progetto si basa sul modello video completamente gratuito di Agnes AI, con il protocollo MIT open source e ha aiutato oltre 1.000 creatori a produrre video AI a costi zero. Da tempo presto attenzione all'ingegneria e alla divulgazione dei modelli di generazione video e il contenuto dell'articolo deriva dalla pratica in prima linea e dalla ricerca di prima mano.

Vedi su GitHub

Ultimo aggiornamento2026-08-21

Pronto per iniziare?

“Lascia che l’IA di livello mondiale appartiene a tutti.” – Bruce Yang. Completamente gratuito, nessuna carta di credito o scheda grafica ad alte prestazioni, crea il tuo primo video AI a costi zero. Vuoi usare il modello video gratuito di Agnes AI? Inizia da qui.

Clona il repository GitHub e avvia in 2 minuti