2.0 — Arquitetura de três pipelines + interface web multilíngue

Arquitetura de três pipelines + interface web multilíngue

PrincipalPublicado em 16 de junho de 2026Ver no GitHub

Novidades

Recursos e melhorias

  • Três tipos de tarefas com bases compartilhadas — Vídeo simples (um prompt → um vídeo via API Agnes Video, t2v/i2v/ti2vid/keyframes), Vídeo criativo (roteirista de IA → storyboards → vídeos por cena → narração edge_tts → legendas finas → concatenação), Vídeo de manuscrito (divisão de textos longos → prompts de cena IA → vídeos por segmento → TTS unificado + legendas → concatenação).
  • Interface web multilíngue — frontend de página única com três abas (Simples/Criativo/Manuscrito) com i18n para 中文 / English / Русский / 日本語 / 한국어 / Bahasa Melayu / Bahasa Indonesia.
  • Progresso em tempo real — WebSocket envia o progresso do pipeline; pausa, retomada e interrupção de tarefas.
  • Sistema de legendas fino — agrupamento SRT palavra por palavra a partir de timestamps do edge_tts, quebra de linha múltipla CJK, renderização method="caption" com personalização de contorno/fundo/posição.

Refatoração e otimizações

  • Arquitetura em quatro camadascore/api (wrappers Agnes Chat/Image/Video com retry + polling), core/audio (edge_tts + SRT + overlay moviepy), core/compositor (concatenação/redimensionamento/extração de frames), core/pipelines (três implementações de pipelines).
  • Modelos de dados Pydantic v2 — subclasses de tarefas tipadas com serialização de estado persistente e carregamento de tarefas compatível com versões anteriores.
  • Geração de manuscrito em duas fases — divisão A/B da geração de vídeo para paralelismo e conclusão mais rápida.

Correções de bugs

  • Compatibilidade com MoviePy 2.x para bg_color/position de legendas; volume TTS ampliado automaticamente.
  • Fallback de fontes CJK para tarefas antigas; fontes incluídas para renderização confiável.
  • Limite de frames de vídeo alinhado ao limite da API Agnes (409 em 720p) com retry automático para falhas transitórias.
  • TTS + SRT contínuo único para o pipeline de manuscrito, eliminando a deriva de preenchimento por segmento.
  • Lembrete de compatibilidade/mudança de configuração: o início com um clique start.sh do v1.0 já inclui criação de venv e instalação de dependências; após o upgrade, a primeira execução prepara o ambiente automaticamente.

Sobre o Agnes Video Generator

Um gerador de vídeo com IA totalmente gratuito e de código aberto: transforme texto em vídeos IA de várias cenas com narração e legendas.

  • Gratuito e de código aberto — sem pagamento, sem GPU de alto desempenho
  • Texto-para-vídeo, imagem-para-vídeo, apresentador digital e geração de imagens
  • Alimentado por modelos gratuitos do Agnes AI, vídeos gerados inteiramente na nuvem
  • Funciona via Web UI, Docker ou npm, suporta auto-hospedagem

Páginas relacionadas

Por que você pode confiar

Este artigo foi escrito por profissionais da linha de frente. Ao escrevê-lo, fontes de primeira mão, como artigos arXiv, relatórios técnicos de fabricantes e Stanford AI Index, foram verificadas e não baseadas em conclusões subjetivas.

S

SandGrid@lcy362

Autor do Agnes Video Generator · Desenvolvedor Full-Stack

Desenvolvedor independente e autor da ferramenta de geração de vídeo de IA de código aberto Agnes Video Generator. O projeto é baseado no modelo de vídeo totalmente gratuito da Agnes AI, com protocolo MIT de código aberto e ajudou mais de 1.000 criadores a produzir vídeos de IA a custo zero. Há muito tempo estou preocupado com a engenharia e popularização de modelos de geração de vídeo, e o conteúdo do artigo vem da prática de primeira linha e da pesquisa em primeira mão.

Ver no GitHub

Última atualização2026-08-21

Pronto para começar?

“Deixe a IA de classe mundial pertencer a todos.” – Bruce Yang. Completamente grátis, sem cartão de crédito ou placa gráfica de alto desempenho, faça seu primeiro vídeo de IA a zero custo. Quer usar o modelo de vídeo gratuito da Agnes AI? Basta começar daqui.

Clone o repositório do GitHub e inicie em 2 minutos