3.0.0 — Malayang kontrol ng subtitle at narrator + AI subtitle styling + digital anchor + image generation

Malayang kontrol ng subtitle at narrator + AI subtitle styling + digital anchor + image generation

MajorInilabas noong Hunyo 21, 2026Tingnan sa GitHub

Ano ang Bago

Mga Tampok at Pagpapabuti

  • Malayang kontrol ng subtitle at narrator — ang SubtitleConfig ay itinaas bilang kapantay ng AudioConfig, bawat isa ay may sariling enabled na switch; apat na mode ng kombinasyon (narrator+subtitle, narrator lang, subtitle lang, tahimik); bagong parameter na subtitle_enabled sa creative at manuscript endpoints
  • AI-powered subtitle styling (LLM mode)style_mode "fixed" (global style) o "llm" (posisyon/kulay/laki ng font ng bawat subtitle na pinagpapasyahan ng LLM); tinatanggap ng style_hints ang natural-language na gabay ("mga pangunahing linya sa pula, buod sa dilaw"); ang generate_subtitle_styles() ay nagpapadala ng lahat ng subtitle sa LLM sa isang tawag at nagre-render sa pamamagitan ng sidecar subtitle_styles.json
  • Uri ng task na Digital Anchor — AI presenter sa pamamagitan ng t2i o i2i (user-uploaded reference photo); hinahati ang manuskrito sa 5–12 segundong talata, bawat isa ay bumubuo ng natatanging i2v clip na may iba't ibang galaw/ekspresyon; pinag-isang TTS + LLM-optimized subtitle overlay; audio mula sa modelo o pagkatapos ng concatenation; POST /api/tasks/anchor
  • Simpleng pagbuo ng imahe — bagong ikalimang tab; magaan na SimpleImageTask; suporta sa system prompt; GET /api/image/{id} para makuha ang mga resulta
  • Suporta sa system prompt — opsyonal na system prompt para sa simpleng video at image tasks, idinadagdag sa unahan ng huling prompt

Refactoring at Pag-optimize

  • Paghahati ng hakbang sa pipeline — ang _step_audio_subtitle ay pinalitan ng independiyenteng _step_audio + _step_subtitle sa creative at manuscript pipelines
  • Pagpapabuti sa pag-render ng subtitle — multi-line display na may 0.3s overlap, 0.8s transition overlap, two-pass extend-end timing, safe-margin overflow protection, LLM vertical-zone positioning para sa visual variety

Pag-aayos ng Bug

  • Ang subprocess.run ay nagdaragdag na ngayon ng stdin=DEVNULL, na pumipigil sa pag-hang ng background process sa SIGTTIN
  • Ang SilentTTSEngine.generate() ay nagbabalik ng None → walang laman na dict, inaayos ang SRT generation sa subtitle-only mode
  • Ang SRT timeline ay batay sa aktwal na tagal ng audio, hindi sa tinatayang tagal ng video
  • Kapag nabigo ang pagbuo ng imahe, naglalabas ng partikular na error (HTTP status + body + traceback)
  • Defensive UTF-8 encoding fix sa digital anchor pipeline; ang TTS ay nabubuo muna para makuha ang aktwal na tagal ng audio

Tungkol sa Agnes Video Generator

Isang ganap na libre, open-source AI video generator: gawing multi-scene AI video na may narrasyon at subtitle ang teksto.

  • Libre at open source — walang bayad, walang high-end GPU na kailangan
  • Teksto-sa-video, larawan-sa-video, digital anchor at pagbuo ng imahe
  • Pinapatakbo ng libreng Agnes AI models, video na ganap na nabubuo sa cloud
  • Tumatakbo sa Web UI, Docker o npm, sumusuporta sa self-hosting

Mga Kaugnay na Pahina

Bakit mapagkakatiwalaan ito

Ang artikulong ito ay isinulat ng mga front-line na practitioner. Kapag isinulat, ang mga unang mapagkukunan tulad ng mga arXiv paper, mga teknikal na ulat ng tagagawa at Stanford AI Index ay na-cross-check, at hindi batay sa mga konklusyon mula sa mga subjective na impresyon.

S

SandGrid@lcy362

Author ng Agnes Video Generator · Full-stack Developer

Independent developer at may-akda ng open source AI Video generation tool na Agnes Video Generator. Ang proyekto ay batay sa ganap na libreng modelo ng video ng Agnes AI at open source ng MIT protocol. Nakatulong ito sa 1,000 creator na gumawa ng mga AI na video sa walang gastos. Matagal na akong binibigyang pansin ang engineering at pagpapasikat ng mga modelo ng pagbuo ng video, at ang nilalaman ng artikulo ay nagmula sa front-line practice at first-hand research.

Tingnan sa GitHub

Huling na-update2026-08-21

Handa Ka Nang Magsimulang Gumawa?

“Hayaan ang world-class na AI na pag-aari ng lahat.” — Bruce Yang. Ganap na libre, walang credit card o high-performance graphics card, gawin ang iyong unang AI video sa zero cost. Gustong gumamit ng libreng modelo ng video mula sa Agnes AI? Magsimula ka lang dito.

I-clone ang GitHub repo at i-launch sa loob ng 2 minuto