6.3.0 — Note di versione

Cronologia delle versioni di Agnes Video Generator: nuove funzionalità, miglioramenti e correzioni di bug per versione.

MinoreRilasciata il 30 agosto 2026Vedi su GitHub

Novità

Funzionalità e miglioramenti

  • Roadmap di ottimizzazione v6 completata al 100% (29/29 voci) — tutti i lotti della roadmap v6 sono ora consegnati:
  • Prestazioni (lotto 2): la catena di composizione finale è ora basata su ffmpeg — la concatenazione di scene con parametri identici usa -c copy, l'allineamento/volume/riempimento di silenzio dell'audio si fondono in un'unica passata di filtri, e i sottotitoli vengono resi tramite il percorso ASS con stili per voce (AGNES_SUBTITLE_ASS, con fallback automatico al percorso moviepy). I video di poesie compongono tutte le scene in una sola passata invece di ricodificare scena per scena. Un pool di thread di codifica dedicato isola il lavoro pesante ffmpeg/moviepy dalle richieste API, e il rate limiter a token bucket ha ottenuto un percorso asincrono nativo, così che l'arresto di un'attività durante le attese del rate limit è immediato.
  • Affidabilità e ingegneria (lotto 1): lo stato delle attività segue il principio del single-writer con blocco per attività, il resume supporta i cue TTS a livello di parola persistiti (nessuna risintesi al ripristino), il polling video è adattivo e le attese multi-scena girano in concorrenza, l'elenco delle attività è indicizzato con paginazione limit/offset/status, artefatti/log di errori obsoleti sono gestiti, e il frontend smette di fare polling nelle schede in background con backoff esponenziale e un banner di perdita di connessione.
  • Frontend e i18n: le traduzioni sono suddivise in chunk a caricamento differito per lingua — il bundle JS della prima schermata scende da ~721 kB a ~305 kB (gzip 226 kB → 97 kB, -58%). I flussi di invio/conferma/toast dei moduli sono stati unificati in composables condivisi, con aggiunta di layout mobile, modali con focus-trap, supporto a prefers-reduced-motion e bozze dei moduli.
  • Osservabilità e operazioni (lotto 3): nuovi endpoint GET /api/health e GET /api/metrics, logging opzionale su file rotanti (AGNES_LOG_FILE) e un HEALTHCHECK Docker. Le impostazioni di runtime ora convergono tramite pydantic-settings tipizzato (con supporto .env), così che i limiti di concorrenza si scalano dinamicamente con il numero di chiavi API.
  • Correzioni immediate di difetti (lotto 0): l'arresto ora annulla istantaneamente senza backoff di retry, il blocco dell'event loop (ricodifica del watermark, download sincroni) è stato spostato fuori dal loop, l'eliminazione tra più chiavi funziona correttamente, un vettore XSS v-html nel frontend è stato chiuso, e la generazione di immagini ha ricevuto una protezione contro l'invio duplicato.
  • Supporto completo a 22 lingue incluso l'arabo — la UI aveva già 22 lingue; questa release completa il catalogo delle voci per tutte. La UI araba è pienamente supportata (PR #32), e 8 lingue della UI (turco, vietnamita, thailandese, tagalog, hindi, persiano, bengalese, urdu) hanno ora raggruppamenti di voci edge_tts con visualizzazione dei nomi delle voci native, regex di rilevamento della scrittura (thailandese/devanagari/bengalese) e fallback dei font dei sottotitoli per scrittura (nuovi font Noto inclusi; persiano/urdu riutilizzano la pipeline araba di reshape+bidi).
  • Divulgazione trasparente delle analisi e controlli sulla privacy — il pannello delle impostazioni mostra ora una scheda privacy chiara e ripiegabile che elenca esattamente quali statistiche di utilizzo vengono riportate (e cosa non viene mai caricato: prompt, manoscritti, poesie, chiavi API e immagini di riferimento sono resi anonimi prima della segnalazione). Le analisi possono essere disattivate interamente dal pannello.
  • Traceback degli errori completi nel report di feedback — i fallimenti della pipeline ora persistono l'intero traceback nello stato dell'attività; l'endpoint diagnostico e il report di feedback in-app lo includono, così che puoi incollare i dettagli completi dell'errore (ad es. un errore a livello di ambiente [WinError 2]) nelle issue GitHub senza consultare la console del server.

Refactoring e ottimizzazioni

  • Catena di composizione ffmpeg-first — il percorso di assemblaggio finale per i video creativi/manoscritto/anchor/poesia è stato ridisegnato da 3-4 ricodifiche complete a copy-concat + una singola passata di filtri (con fallback graduale al precedente percorso moviepy). È il più grande guadagno di prestazioni della linea v6, riducendo il tempo di assemblaggio finale di circa 3-10 volte sulle uscite tipiche.
  • Rate limiting asincrono con pool di thread di codifica dedicato — il token bucket offre ora un percorso di acquisizione asincrono nativo (consapevole dell'arresto), e la codifica pesante gira su un executor dedicato così che i lavori di codifica lunghi non affamano più il percorso delle richieste.

Correzioni di bug

  • Comportamento di arresto corretto — annullare un'attività non innesca più backoff di retry (fino a ~2 minuti) e non elimina più un video_id ripristinabile.
  • Configurazione multi-chiave corretta — gli ID delle chiavi sono ora ricavati per hash dalla chiave reale, quindi eliminare una chiave tra più chiavi configurate rimuove esattamente quella chiave.
  • Congelamenti dell'event loop corretti — la ricodifica del watermark e i download sincroni non bloccano più l'intero servizio; è stato corretto un bug di rilascio del semaforo che poteva compromettere permanentemente il limite di concorrenza con configurazioni di rate limit basse.
  • Problemi del frontend corretti — un vettore di XSS archiviato tramite v-html non filtrato è stato chiuso, l'invio duplicato della generazione di immagini senza protezione è prevenuto, e gli errori di fetch ora mostrano messaggi leggibili del backend invece di fallimenti silenziosi.
  • Non sono necessarie modifiche alla configurazione. Le attività esistenti restano ripristinabili; il formato dei file di stato delle attività è invariato.

Informazioni su Agnes Video Generator

Un generatore di video IA completamente gratuito e open source: trasforma il testo in video IA multi-scena con narrazione e sottotitoli.

  • Gratuito e open source — senza pagamenti, senza GPU di fascia alta
  • Testo-verso-video, immagine-verso-video, presentatore digitale e generazione di immagini
  • Alimentato dai modelli Agnes AI gratuiti, video generati interamente nel cloud
  • Funziona tramite Web UI, Docker o npm, supporta self-hosting

Pagine correlate

Perché puoi fidarti

Questo articolo è stato scritto da professionisti in prima linea. Durante la scrittura, ha controllato fonti di prima mano come documenti arXiv, rapporti tecnici dei produttori e Stanford AI Index. Non si basa su conclusioni basate su impressioni soggettive.

S

SandGrid@lcy362

Autore di Agnes Video Generator · Sviluppatore Full-Stack

Sviluppatore indipendente e autore di Agnes Video Generator, uno strumento di generazione di Video AI open source. Il progetto si basa sul modello video completamente gratuito di Agnes AI, con il protocollo MIT open source e ha aiutato oltre 1.000 creatori a produrre video AI a costi zero. Da tempo presto attenzione all'ingegneria e alla divulgazione dei modelli di generazione video e il contenuto dell'articolo deriva dalla pratica in prima linea e dalla ricerca di prima mano.

Vedi su GitHub

Ultimo aggiornamento2026-08-21

Pronto per iniziare?

“Lascia che l’IA di livello mondiale appartiene a tutti.” – Bruce Yang. Completamente gratuito, nessuna carta di credito o scheda grafica ad alte prestazioni, crea il tuo primo video AI a costi zero. Vuoi usare il modello video gratuito di Agnes AI? Inizia da qui.

Clona il repository GitHub e avvia in 2 minuti