3.0.0 — Controle independente de legendas e narrador + estilo de legendas com IA + apresentador digital + geração de imagens

Controle independente de legendas e narrador + estilo de legendas com IA + apresentador digital + geração de imagens

PrincipalPublicado em 21 de junho de 2026Ver no GitHub

Novidades

Recursos e melhorias

  • Controle independente de legendas e narradorSubtitleConfig é elevado ao mesmo nível de AudioConfig, cada um com seu próprio interruptor enabled; quatro modos de combinação (narrador+legendas, só narrador, só legendas, silencioso); novo parâmetro subtitle_enabled nos endpoints criativo e de manuscrito.
  • Estilo de legendas com IA (modo LLM)style_mode "fixed" (estilo global) ou "llm" (posição/cor/tamanho da fonte de cada legenda decididos pelo LLM); style_hints aceita orientações em linguagem natural («linhas-chave em vermelho, resumos em amarelo»); generate_subtitle_styles() envia todas as legendas ao LLM em uma chamada e renderiza via sidecar subtitle_styles.json.
  • Tipo de tarefa Apresentador digital — apresentador de IA via t2i ou i2i (foto de referência enviada pelo usuário); o manuscrito é dividido em parágrafos de 5 a 12 s, cada um gerando um clipe i2v único com gestos/expressões diferentes; TTS unificado + sobreposição de legendas otimizada por LLM; áudio do modelo ou após concatenação; POST /api/tasks/anchor.
  • Geração de imagens simples — nova quinta aba; SimpleImageTask leve; suporte a system prompt; GET /api/image/{id} para recuperar resultados.
  • Suporte a system prompt — system prompt opcional para tarefas simples de vídeo e imagem, anteposto ao prompt final.

Refatoração e otimizações

  • Divisão de etapas do pipeline_step_audio_subtitle é substituído por _step_audio + _step_subtitle independentes nos pipelines criativo e de manuscrito.
  • Melhorias na renderização de legendas — exibição multilinha com sobreposição de 0,3 s, sobreposição de transição de 0,8 s, temporização extend-end em duas passadas, proteção contra estouro das margens seguras, posicionamento vertical em zonas pelo LLM para variedade visual.

Correções de bugs

  • subprocess.run agora adiciona stdin=DEVNULL, evitando que processos em segundo plano travem por SIGTTIN.
  • SilentTTSEngine.generate() retorna Nonedict vazio, corrigindo a geração de SRT no modo apenas legendas.
  • A linha do tempo SRT é baseada na duração real do áudio, não na duração estimada do vídeo.
  • Quando a geração de imagens falha, é exibido o erro concreto (status HTTP + body + traceback).
  • Correção defensiva de codificação UTF-8 no pipeline do apresentador digital; o TTS é gerado primeiro para obter a duração real do áudio.

Sobre o Agnes Video Generator

Um gerador de vídeo com IA totalmente gratuito e de código aberto: transforme texto em vídeos IA de várias cenas com narração e legendas.

  • Gratuito e de código aberto — sem pagamento, sem GPU de alto desempenho
  • Texto-para-vídeo, imagem-para-vídeo, apresentador digital e geração de imagens
  • Alimentado por modelos gratuitos do Agnes AI, vídeos gerados inteiramente na nuvem
  • Funciona via Web UI, Docker ou npm, suporta auto-hospedagem

Páginas relacionadas

Por que você pode confiar

Este artigo foi escrito por profissionais da linha de frente. Ao escrevê-lo, fontes de primeira mão, como artigos arXiv, relatórios técnicos de fabricantes e Stanford AI Index, foram verificadas e não baseadas em conclusões subjetivas.

S

SandGrid@lcy362

Autor do Agnes Video Generator · Desenvolvedor Full-Stack

Desenvolvedor independente e autor da ferramenta de geração de vídeo de IA de código aberto Agnes Video Generator. O projeto é baseado no modelo de vídeo totalmente gratuito da Agnes AI, com protocolo MIT de código aberto e ajudou mais de 1.000 criadores a produzir vídeos de IA a custo zero. Há muito tempo estou preocupado com a engenharia e popularização de modelos de geração de vídeo, e o conteúdo do artigo vem da prática de primeira linha e da pesquisa em primeira mão.

Ver no GitHub

Última atualização2026-08-21

Pronto para começar?

“Deixe a IA de classe mundial pertencer a todos.” – Bruce Yang. Completamente grátis, sem cartão de crédito ou placa gráfica de alto desempenho, faça seu primeiro vídeo de IA a zero custo. Quer usar o modelo de vídeo gratuito da Agnes AI? Basta começar daqui.

Clone o repositório do GitHub e inicie em 2 minutos