3.0.0 — Controllo indipendente di sottotitoli e narratore + stile sottotitoli AI + presentatore digitale + generazione di immagini
Controllo indipendente di sottotitoli e narratore + stile sottotitoli AI + presentatore digitale + generazione di immagini
Novità
Funzionalità e miglioramenti
- Controllo indipendente di sottotitoli e narratore —
SubtitleConfigviene elevato allo stesso livello diAudioConfig, ciascuno con il proprio interruttoreenabled; quattro modalità di combinazione (narratore+sottotitoli, solo narratore, solo sottotitoli, silenzioso); nuovo parametrosubtitle_enablednegli endpoint creativo e manoscritto. - Stile sottotitoli AI (modalità LLM) —
style_mode"fixed"(stile globale) o"llm"(posizione/colore/dimensione carattere di ogni sottotitolo decisi dal LLM);style_hintsaccetta indicazioni in linguaggio naturale («righe chiave in rosso, riepiloghi in giallo»);generate_subtitle_styles()invia tutti i sottotitoli al LLM in una sola chiamata e renderizza tramite il sidecarsubtitle_styles.json. - Tipo di attività Presentatore digitale — presentatore IA tramite t2i o i2i (foto di riferimento caricata dall'utente); il manoscritto è diviso in paragrafi di 5–12 s, ognuno genera un clip i2v unico con gesti/espressioni diversi; TTS unificato + sovrapposizione sottotitoli ottimizzata dal LLM; audio dal modello o dopo la concatenazione;
POST /api/tasks/anchor. - Generazione immagini semplice — nuova quinta scheda;
SimpleImageTaskleggero; supporto del system prompt;GET /api/image/{id}per recuperare i risultati. - Supporto del system prompt — system prompt opzionale per attività video e immagini semplici, anteposto al prompt finale.
Refactoring e ottimizzazioni
- Suddivisione delle fasi della pipeline —
_step_audio_subtitleviene sostituito da_step_audio+_step_subtitleindipendenti nelle pipeline creativa e manoscritto. - Miglioramenti al rendering dei sottotitoli — visualizzazione su più righe con sovrapposizione di 0,3 s, sovrapposizione di transizione di 0,8 s, temporizzazione
extend-enda due passate, protezione dallo sforamento dei margini di sicurezza, posizionamento verticale a zone tramite LLM per varietà visiva.
Correzioni di bug
subprocess.runora aggiungestdin=DEVNULL, evitando che i processi in background si blocchino per SIGTTIN.SilentTTSEngine.generate()restituisceNone→dictvuoto, correggendo la generazione SRT in modalità solo sottotitoli.- La timeline SRT si basa sulla durata audio effettiva anziché sulla durata video stimata.
- Quando la generazione dell'immagine fallisce, viene mostrato l'errore concreto (stato HTTP + body + traceback).
- Correzione difensiva della codifica UTF-8 nella pipeline del presentatore digitale; il TTS viene generato per primo per ottenere la durata audio effettiva.
Informazioni su Agnes Video Generator
Un generatore di video IA completamente gratuito e open source: trasforma il testo in video IA multi-scena con narrazione e sottotitoli.
- Gratuito e open source — senza pagamenti, senza GPU di fascia alta
- Testo-verso-video, immagine-verso-video, presentatore digitale e generazione di immagini
- Alimentato dai modelli Agnes AI gratuiti, video generati interamente nel cloud
- Funziona tramite Web UI, Docker o npm, supporta self-hosting
Pagine correlate
Note di versione
Cronologia delle versioni di Agnes Video Generator: nuove funzionalità, miglioramenti e correzioni di bug per versione.
Prova demo online | Agnes Video
Inserisci un prompt e genera video e immagini IA istantaneamente
API Testo in Video — API generazione video IA gratuita | Agnes Video
Chiama programmatica del modello video gratuito Agnes AI: testo in video, immagine in video, generazione di narrazione, ecc. Copertura completa dell'API REST, inclusi parametri di richiesta, autenticazione del portatore, sondaggio sullo stato dell'attività ed esempi di codice completi (Python/cURL/HTTP). Adatto agli sviluppatori, a costo zero e non richiede una scheda grafica ad alte prestazioni per accedere.
Perché puoi fidarti
Questo articolo è stato scritto da professionisti in prima linea. Durante la scrittura, ha controllato fonti di prima mano come documenti arXiv, rapporti tecnici dei produttori e Stanford AI Index. Non si basa su conclusioni basate su impressioni soggettive.
SandGrid@lcy362
Autore di Agnes Video Generator · Sviluppatore Full-Stack
Sviluppatore indipendente e autore di Agnes Video Generator, uno strumento di generazione di Video AI open source. Il progetto si basa sul modello video completamente gratuito di Agnes AI, con il protocollo MIT open source e ha aiutato oltre 1.000 creatori a produrre video AI a costi zero. Da tempo presto attenzione all'ingegneria e alla divulgazione dei modelli di generazione video e il contenuto dell'articolo deriva dalla pratica in prima linea e dalla ricerca di prima mano.
Vedi su GitHubUltimo aggiornamento:2026-08-21
Pronto per iniziare?
“Lascia che l’IA di livello mondiale appartiene a tutti.” – Bruce Yang. Completamente gratuito, nessuna carta di credito o scheda grafica ad alte prestazioni, crea il tuo primo video AI a costi zero. Vuoi usare il modello video gratuito di Agnes AI? Inizia da qui.
Clona il repository GitHub e avvia in 2 minuti