6.3.0 — Notas de versão

Histórico de versões do Agnes Video Generator: novos recursos, melhorias e correções de bugs por versão.

MenorPublicado em 30 de agosto de 2026Ver no GitHub

Novidades

Recursos e melhorias

  • Roteiro de otimização v6 concluído por completo (29/29 itens) — todos os lotes do roteiro v6 foram entregues:
  • Desempenho (lote 2): a cadeia de composição final agora é baseada em ffmpeg — a concatenação de cenas com parâmetros idênticos usa -c copy, o alinhamento/volume/preenchimento de silêncio do áudio são mesclados em uma única passagem de filtros, e as legendas são renderizadas pelo caminho ASS com estilos por entrada (AGNES_SUBTITLE_ASS, com fallback automático para o caminho moviepy). Vídeos de poesia compõem todas as cenas em uma única passagem em vez de recodificar cena por cena. Um pool de threads de codificação dedicado isola o trabalho pesado de ffmpeg/moviepy das requisições de API, e o limitador de taxa de balde de tokens ganhou um caminho assíncrono nativo, de modo que parar uma tarefa durante esperas de limite de taxa é instantâneo.
  • Confiabilidade e engenharia (lote 1): o estado das tarefas segue o princípio de escritor único com bloqueio por tarefa; a retomada suporta pistas TTS em nível de palavra persistidas (sem ressíntese ao retomar); o polling de vídeo é adaptativo e as esperas multi-cena rodam em concorrência; a listagem de tarefas é indexada com paginação limit/offset/status; artefatos/logs de erro obsoletos são geridos; e o frontend para de fazer polling em abas em segundo plano com backoff exponencial e um banner de perda de conexão.
  • Frontend e i18n: as traduções são divididas em chunks carregados sob demanda por idioma — o bundle JS da primeira tela cai de ~721 kB para ~305 kB (gzip 226 kB → 97 kB, -58%). Os fluxos de envio/confirmação/toast dos formulários foram unificados em composables compartilhados, com adição de layout mobile, modais com focus-trap, suporte a prefers-reduced-motion e rascunhos de formulário.
  • Observabilidade e operações (lote 3): novos endpoints GET /api/health e GET /api/metrics, registro opcional em arquivos rotativos (AGNES_LOG_FILE) e um HEALTHCHECK do Docker. As configurações de tempo de execução agora convergem por meio de pydantic-settings tipado (com suporte a .env), de modo que os limites de concorrência escalam dinamicamente com a quantidade de chaves de API.
  • Correções imediatas de defeitos (lote 0): parar agora cancela instantaneamente sem backoff de novas tentativas; o bloqueio do event loop (recodificação de marca d'água, downloads síncronos) foi retirado do loop; a exclusão entre várias chaves funciona corretamente; um vetor de XSS v-html no frontend foi fechado; e a geração de imagens recebeu proteção contra envio duplicado.
  • Suporte completo a 22 idiomas, incluindo o árabe — a interface já tinha 22 idiomas; esta versão completa o catálogo de vozes para todos. A interface em árabe é totalmente suportada (PR #32), e 8 idiomas da interface (turco, vietnamita, tailandês, tagalo, híndi, persa, bengali, urdu) agora têm agrupamentos de vozes edge_tts com exibição dos nomes das vozes nativas, regexes de detecção de escrita (tailandês/devanágari/bengali) e fallback de fonte de legenda por escrita (novas fontes Noto incluídas; persa/urdu reutilizam o pipeline árabe de reshape+bidi).
  • Divulgação transparente de análises e controles de privacidade — o painel de configurações agora exibe um cartão de privacidade claro e recolhível que lista exatamente quais estatísticas de uso são relatadas (e o que nunca é enviado: prompts, manuscritos, poemas, chaves de API e imagens de referência são anonimizados antes do relato). As análises podem ser desativadas inteiramente pelo painel.
  • Tracebacks de erro completos no relatório de feedback — falhas do pipeline agora persistem o traceback completo no estado da tarefa; o endpoint de diagnóstico e o relatório de feedback no app o incluem, para que você possa colar detalhes completos do erro (p. ex. um erro de ambiente [WinError 2]) em issues do GitHub sem precisar consultar o console do servidor.

Refatoração e otimizações

  • Cadeia de composição com ffmpeg em primeiro lugar — o caminho de montagem final dos vídeos criativos/manuscrito/apresentador/poesia foi redesenhado de 3-4 recodificações completas para copy-concat + uma única passagem de filtros (com fallback elegante para o caminho moviepy anterior). Esta é a maior conquista de desempenho da linha v6, reduzindo o tempo de montagem final em cerca de 3 a 10 vezes em saídas típicas.
  • Limitação de taxa assíncrona com pool de threads de codificação dedicado — o balde de tokens agora oferece um caminho de aquisição assíncrono nativo (ciente de parada), e a codificação pesada roda em um executor dedicado, de modo que trabalhos longos de codificação não mais esvaziam o caminho de requisições.

Correções de bugs

  • Comportamento de parada corrigido — cancelar uma tarefa não dispara mais backoff de novas tentativas (até ~2 minutos) e não exclui mais um video_id retomável.
  • Configuração multi-chave corrigida — os IDs de chave agora são derivados por hash da chave real, de modo que excluir uma chave dentre várias configuradas remove exatamente aquela chave.
  • Congelamentos do event loop corrigidos — a recodificação de marca d'água e os downloads síncronos não bloqueiam mais todo o serviço; um bug de liberação de semáforo que podia quebrar permanentemente o limite de concorrência em configurações de taxa baixa foi corrigido.
  • Problemas do frontend corrigidos — um vetor de XSS armazenado via v-html sem escape foi fechado, o envio duplicado de geração de imagens sem proteção é evitado, e erros de fetch agora mostram mensagens legíveis do backend em vez de falhas silenciosas.
  • Nenhuma alteração de configuração é necessária. As tarefas existentes permanecem retomáveis; o formato dos arquivos de estado das tarefas não muda.

Sobre o Agnes Video Generator

Um gerador de vídeo com IA totalmente gratuito e de código aberto: transforme texto em vídeos IA de várias cenas com narração e legendas.

  • Gratuito e de código aberto — sem pagamento, sem GPU de alto desempenho
  • Texto-para-vídeo, imagem-para-vídeo, apresentador digital e geração de imagens
  • Alimentado por modelos gratuitos do Agnes AI, vídeos gerados inteiramente na nuvem
  • Funciona via Web UI, Docker ou npm, suporta auto-hospedagem

Páginas relacionadas

Por que você pode confiar

Este artigo foi escrito por profissionais da linha de frente. Ao escrevê-lo, fontes de primeira mão, como artigos arXiv, relatórios técnicos de fabricantes e Stanford AI Index, foram verificadas e não baseadas em conclusões subjetivas.

S

SandGrid@lcy362

Autor do Agnes Video Generator · Desenvolvedor Full-Stack

Desenvolvedor independente e autor da ferramenta de geração de vídeo de IA de código aberto Agnes Video Generator. O projeto é baseado no modelo de vídeo totalmente gratuito da Agnes AI, com protocolo MIT de código aberto e ajudou mais de 1.000 criadores a produzir vídeos de IA a custo zero. Há muito tempo estou preocupado com a engenharia e popularização de modelos de geração de vídeo, e o conteúdo do artigo vem da prática de primeira linha e da pesquisa em primeira mão.

Ver no GitHub

Última atualização2026-08-21

Pronto para começar?

“Deixe a IA de classe mundial pertencer a todos.” – Bruce Yang. Completamente grátis, sem cartão de crédito ou placa gráfica de alto desempenho, faça seu primeiro vídeo de IA a zero custo. Quer usar o modelo de vídeo gratuito da Agnes AI? Basta começar daqui.

Clone o repositório do GitHub e inicie em 2 minutos