6.3.0 — Notas de versão
Histórico de versões do Agnes Video Generator: novos recursos, melhorias e correções de bugs por versão.
Novidades
Recursos e melhorias
- Roteiro de otimização v6 concluído por completo (29/29 itens) — todos os lotes do roteiro v6 foram entregues:
- Desempenho (lote 2): a cadeia de composição final agora é baseada em ffmpeg — a concatenação de cenas com parâmetros idênticos usa
-c copy, o alinhamento/volume/preenchimento de silêncio do áudio são mesclados em uma única passagem de filtros, e as legendas são renderizadas pelo caminho ASS com estilos por entrada (AGNES_SUBTITLE_ASS, com fallback automático para o caminho moviepy). Vídeos de poesia compõem todas as cenas em uma única passagem em vez de recodificar cena por cena. Um pool de threads de codificação dedicado isola o trabalho pesado de ffmpeg/moviepy das requisições de API, e o limitador de taxa de balde de tokens ganhou um caminho assíncrono nativo, de modo que parar uma tarefa durante esperas de limite de taxa é instantâneo. - Confiabilidade e engenharia (lote 1): o estado das tarefas segue o princípio de escritor único com bloqueio por tarefa; a retomada suporta pistas TTS em nível de palavra persistidas (sem ressíntese ao retomar); o polling de vídeo é adaptativo e as esperas multi-cena rodam em concorrência; a listagem de tarefas é indexada com paginação
limit/offset/status; artefatos/logs de erro obsoletos são geridos; e o frontend para de fazer polling em abas em segundo plano com backoff exponencial e um banner de perda de conexão. - Frontend e i18n: as traduções são divididas em chunks carregados sob demanda por idioma — o bundle JS da primeira tela cai de ~721 kB para ~305 kB (gzip 226 kB → 97 kB, -58%). Os fluxos de envio/confirmação/toast dos formulários foram unificados em composables compartilhados, com adição de layout mobile, modais com focus-trap, suporte a
prefers-reduced-motione rascunhos de formulário. - Observabilidade e operações (lote 3): novos endpoints
GET /api/healtheGET /api/metrics, registro opcional em arquivos rotativos (AGNES_LOG_FILE) e umHEALTHCHECKdo Docker. As configurações de tempo de execução agora convergem por meio depydantic-settingstipado (com suporte a.env), de modo que os limites de concorrência escalam dinamicamente com a quantidade de chaves de API. - Correções imediatas de defeitos (lote 0): parar agora cancela instantaneamente sem backoff de novas tentativas; o bloqueio do event loop (recodificação de marca d'água, downloads síncronos) foi retirado do loop; a exclusão entre várias chaves funciona corretamente; um vetor de XSS
v-htmlno frontend foi fechado; e a geração de imagens recebeu proteção contra envio duplicado. - Suporte completo a 22 idiomas, incluindo o árabe — a interface já tinha 22 idiomas; esta versão completa o catálogo de vozes para todos. A interface em árabe é totalmente suportada (PR #32), e 8 idiomas da interface (turco, vietnamita, tailandês, tagalo, híndi, persa, bengali, urdu) agora têm agrupamentos de vozes edge_tts com exibição dos nomes das vozes nativas, regexes de detecção de escrita (tailandês/devanágari/bengali) e fallback de fonte de legenda por escrita (novas fontes Noto incluídas; persa/urdu reutilizam o pipeline árabe de reshape+bidi).
- Divulgação transparente de análises e controles de privacidade — o painel de configurações agora exibe um cartão de privacidade claro e recolhível que lista exatamente quais estatísticas de uso são relatadas (e o que nunca é enviado: prompts, manuscritos, poemas, chaves de API e imagens de referência são anonimizados antes do relato). As análises podem ser desativadas inteiramente pelo painel.
- Tracebacks de erro completos no relatório de feedback — falhas do pipeline agora persistem o
tracebackcompleto no estado da tarefa; o endpoint de diagnóstico e o relatório de feedback no app o incluem, para que você possa colar detalhes completos do erro (p. ex. um erro de ambiente[WinError 2]) em issues do GitHub sem precisar consultar o console do servidor.
Refatoração e otimizações
- Cadeia de composição com ffmpeg em primeiro lugar — o caminho de montagem final dos vídeos criativos/manuscrito/apresentador/poesia foi redesenhado de 3-4 recodificações completas para copy-concat + uma única passagem de filtros (com fallback elegante para o caminho moviepy anterior). Esta é a maior conquista de desempenho da linha v6, reduzindo o tempo de montagem final em cerca de 3 a 10 vezes em saídas típicas.
- Limitação de taxa assíncrona com pool de threads de codificação dedicado — o balde de tokens agora oferece um caminho de aquisição assíncrono nativo (ciente de parada), e a codificação pesada roda em um executor dedicado, de modo que trabalhos longos de codificação não mais esvaziam o caminho de requisições.
Correções de bugs
- Comportamento de parada corrigido — cancelar uma tarefa não dispara mais backoff de novas tentativas (até ~2 minutos) e não exclui mais um
video_idretomável. - Configuração multi-chave corrigida — os IDs de chave agora são derivados por hash da chave real, de modo que excluir uma chave dentre várias configuradas remove exatamente aquela chave.
- Congelamentos do event loop corrigidos — a recodificação de marca d'água e os downloads síncronos não bloqueiam mais todo o serviço; um bug de liberação de semáforo que podia quebrar permanentemente o limite de concorrência em configurações de taxa baixa foi corrigido.
- Problemas do frontend corrigidos — um vetor de XSS armazenado via
v-htmlsem escape foi fechado, o envio duplicado de geração de imagens sem proteção é evitado, e erros de fetch agora mostram mensagens legíveis do backend em vez de falhas silenciosas. - Nenhuma alteração de configuração é necessária. As tarefas existentes permanecem retomáveis; o formato dos arquivos de estado das tarefas não muda.
Sobre o Agnes Video Generator
Um gerador de vídeo com IA totalmente gratuito e de código aberto: transforme texto em vídeos IA de várias cenas com narração e legendas.
- Gratuito e de código aberto — sem pagamento, sem GPU de alto desempenho
- Texto-para-vídeo, imagem-para-vídeo, apresentador digital e geração de imagens
- Alimentado por modelos gratuitos do Agnes AI, vídeos gerados inteiramente na nuvem
- Funciona via Web UI, Docker ou npm, suporta auto-hospedagem
Páginas relacionadas
Notas de versão
Histórico de versões do Agnes Video Generator: novos recursos, melhorias e correções de bugs por versão.
Experimentar demo online | Agnes Video
Insira um prompt e gere vídeos e imagens IA instantaneamente
API Texto para Vídeo — API de geração de vídeo IA grátis | Agnes Video
Chamada programática do modelo de vídeo gratuito Agnes AI: texto em vídeo, imagem em vídeo, geração de narração, etc. Cobertura completa da API REST, incluindo parâmetros de solicitação, autenticação do portador, sondagem de status de tarefa e exemplos de código completos (Python/cURL/HTTP). Amigável para desenvolvedores, custo zero e não requer uma placa gráfica de alto desempenho para acessar.
Por que você pode confiar
Este artigo foi escrito por profissionais da linha de frente. Ao escrevê-lo, fontes de primeira mão, como artigos arXiv, relatórios técnicos de fabricantes e Stanford AI Index, foram verificadas e não baseadas em conclusões subjetivas.
SandGrid@lcy362
Autor do Agnes Video Generator · Desenvolvedor Full-Stack
Desenvolvedor independente e autor da ferramenta de geração de vídeo de IA de código aberto Agnes Video Generator. O projeto é baseado no modelo de vídeo totalmente gratuito da Agnes AI, com protocolo MIT de código aberto e ajudou mais de 1.000 criadores a produzir vídeos de IA a custo zero. Há muito tempo estou preocupado com a engenharia e popularização de modelos de geração de vídeo, e o conteúdo do artigo vem da prática de primeira linha e da pesquisa em primeira mão.
Ver no GitHubÚltima atualização:2026-08-21
Pronto para começar?
“Deixe a IA de classe mundial pertencer a todos.” – Bruce Yang. Completamente grátis, sem cartão de crédito ou placa gráfica de alto desempenho, faça seu primeiro vídeo de IA a zero custo. Quer usar o modelo de vídeo gratuito da Agnes AI? Basta começar daqui.
Clone o repositório do GitHub e inicie em 2 minutos