6.3.0 — Note di versione
Cronologia delle versioni di Agnes Video Generator: nuove funzionalità, miglioramenti e correzioni di bug per versione.
Novità
Funzionalità e miglioramenti
- Roadmap di ottimizzazione v6 completata al 100% (29/29 voci) — tutti i lotti della roadmap v6 sono ora consegnati:
- Prestazioni (lotto 2): la catena di composizione finale è ora basata su ffmpeg — la concatenazione di scene con parametri identici usa
-c copy, l'allineamento/volume/riempimento di silenzio dell'audio si fondono in un'unica passata di filtri, e i sottotitoli vengono resi tramite il percorso ASS con stili per voce (AGNES_SUBTITLE_ASS, con fallback automatico al percorso moviepy). I video di poesie compongono tutte le scene in una sola passata invece di ricodificare scena per scena. Un pool di thread di codifica dedicato isola il lavoro pesante ffmpeg/moviepy dalle richieste API, e il rate limiter a token bucket ha ottenuto un percorso asincrono nativo, così che l'arresto di un'attività durante le attese del rate limit è immediato. - Affidabilità e ingegneria (lotto 1): lo stato delle attività segue il principio del single-writer con blocco per attività, il resume supporta i cue TTS a livello di parola persistiti (nessuna risintesi al ripristino), il polling video è adattivo e le attese multi-scena girano in concorrenza, l'elenco delle attività è indicizzato con paginazione
limit/offset/status, artefatti/log di errori obsoleti sono gestiti, e il frontend smette di fare polling nelle schede in background con backoff esponenziale e un banner di perdita di connessione. - Frontend e i18n: le traduzioni sono suddivise in chunk a caricamento differito per lingua — il bundle JS della prima schermata scende da ~721 kB a ~305 kB (gzip 226 kB → 97 kB, -58%). I flussi di invio/conferma/toast dei moduli sono stati unificati in composables condivisi, con aggiunta di layout mobile, modali con focus-trap, supporto a
prefers-reduced-motione bozze dei moduli. - Osservabilità e operazioni (lotto 3): nuovi endpoint
GET /api/healtheGET /api/metrics, logging opzionale su file rotanti (AGNES_LOG_FILE) e unHEALTHCHECKDocker. Le impostazioni di runtime ora convergono tramitepydantic-settingstipizzato (con supporto.env), così che i limiti di concorrenza si scalano dinamicamente con il numero di chiavi API. - Correzioni immediate di difetti (lotto 0): l'arresto ora annulla istantaneamente senza backoff di retry, il blocco dell'event loop (ricodifica del watermark, download sincroni) è stato spostato fuori dal loop, l'eliminazione tra più chiavi funziona correttamente, un vettore XSS
v-htmlnel frontend è stato chiuso, e la generazione di immagini ha ricevuto una protezione contro l'invio duplicato. - Supporto completo a 22 lingue incluso l'arabo — la UI aveva già 22 lingue; questa release completa il catalogo delle voci per tutte. La UI araba è pienamente supportata (PR #32), e 8 lingue della UI (turco, vietnamita, thailandese, tagalog, hindi, persiano, bengalese, urdu) hanno ora raggruppamenti di voci edge_tts con visualizzazione dei nomi delle voci native, regex di rilevamento della scrittura (thailandese/devanagari/bengalese) e fallback dei font dei sottotitoli per scrittura (nuovi font Noto inclusi; persiano/urdu riutilizzano la pipeline araba di reshape+bidi).
- Divulgazione trasparente delle analisi e controlli sulla privacy — il pannello delle impostazioni mostra ora una scheda privacy chiara e ripiegabile che elenca esattamente quali statistiche di utilizzo vengono riportate (e cosa non viene mai caricato: prompt, manoscritti, poesie, chiavi API e immagini di riferimento sono resi anonimi prima della segnalazione). Le analisi possono essere disattivate interamente dal pannello.
- Traceback degli errori completi nel report di feedback — i fallimenti della pipeline ora persistono l'intero
tracebacknello stato dell'attività; l'endpoint diagnostico e il report di feedback in-app lo includono, così che puoi incollare i dettagli completi dell'errore (ad es. un errore a livello di ambiente[WinError 2]) nelle issue GitHub senza consultare la console del server.
Refactoring e ottimizzazioni
- Catena di composizione ffmpeg-first — il percorso di assemblaggio finale per i video creativi/manoscritto/anchor/poesia è stato ridisegnato da 3-4 ricodifiche complete a copy-concat + una singola passata di filtri (con fallback graduale al precedente percorso moviepy). È il più grande guadagno di prestazioni della linea v6, riducendo il tempo di assemblaggio finale di circa 3-10 volte sulle uscite tipiche.
- Rate limiting asincrono con pool di thread di codifica dedicato — il token bucket offre ora un percorso di acquisizione asincrono nativo (consapevole dell'arresto), e la codifica pesante gira su un executor dedicato così che i lavori di codifica lunghi non affamano più il percorso delle richieste.
Correzioni di bug
- Comportamento di arresto corretto — annullare un'attività non innesca più backoff di retry (fino a ~2 minuti) e non elimina più un
video_idripristinabile. - Configurazione multi-chiave corretta — gli ID delle chiavi sono ora ricavati per hash dalla chiave reale, quindi eliminare una chiave tra più chiavi configurate rimuove esattamente quella chiave.
- Congelamenti dell'event loop corretti — la ricodifica del watermark e i download sincroni non bloccano più l'intero servizio; è stato corretto un bug di rilascio del semaforo che poteva compromettere permanentemente il limite di concorrenza con configurazioni di rate limit basse.
- Problemi del frontend corretti — un vettore di XSS archiviato tramite
v-htmlnon filtrato è stato chiuso, l'invio duplicato della generazione di immagini senza protezione è prevenuto, e gli errori di fetch ora mostrano messaggi leggibili del backend invece di fallimenti silenziosi. - Non sono necessarie modifiche alla configurazione. Le attività esistenti restano ripristinabili; il formato dei file di stato delle attività è invariato.
Informazioni su Agnes Video Generator
Un generatore di video IA completamente gratuito e open source: trasforma il testo in video IA multi-scena con narrazione e sottotitoli.
- Gratuito e open source — senza pagamenti, senza GPU di fascia alta
- Testo-verso-video, immagine-verso-video, presentatore digitale e generazione di immagini
- Alimentato dai modelli Agnes AI gratuiti, video generati interamente nel cloud
- Funziona tramite Web UI, Docker o npm, supporta self-hosting
Pagine correlate
Note di versione
Cronologia delle versioni di Agnes Video Generator: nuove funzionalità, miglioramenti e correzioni di bug per versione.
Prova demo online | Agnes Video
Inserisci un prompt e genera video e immagini IA istantaneamente
API Testo in Video — API generazione video IA gratuita | Agnes Video
Chiama programmatica del modello video gratuito Agnes AI: testo in video, immagine in video, generazione di narrazione, ecc. Copertura completa dell'API REST, inclusi parametri di richiesta, autenticazione del portatore, sondaggio sullo stato dell'attività ed esempi di codice completi (Python/cURL/HTTP). Adatto agli sviluppatori, a costo zero e non richiede una scheda grafica ad alte prestazioni per accedere.
Perché puoi fidarti
Questo articolo è stato scritto da professionisti in prima linea. Durante la scrittura, ha controllato fonti di prima mano come documenti arXiv, rapporti tecnici dei produttori e Stanford AI Index. Non si basa su conclusioni basate su impressioni soggettive.
SandGrid@lcy362
Autore di Agnes Video Generator · Sviluppatore Full-Stack
Sviluppatore indipendente e autore di Agnes Video Generator, uno strumento di generazione di Video AI open source. Il progetto si basa sul modello video completamente gratuito di Agnes AI, con il protocollo MIT open source e ha aiutato oltre 1.000 creatori a produrre video AI a costi zero. Da tempo presto attenzione all'ingegneria e alla divulgazione dei modelli di generazione video e il contenuto dell'articolo deriva dalla pratica in prima linea e dalla ricerca di prima mano.
Vedi su GitHubUltimo aggiornamento:2026-08-21
Pronto per iniziare?
“Lascia che l’IA di livello mondiale appartiene a tutti.” – Bruce Yang. Completamente gratuito, nessuna carta di credito o scheda grafica ad alte prestazioni, crea il tuo primo video AI a costi zero. Vuoi usare il modello video gratuito di Agnes AI? Inizia da qui.
Clona il repository GitHub e avvia in 2 minuti