2.0 — Three-Pipeline Architecture + Multilingual Web UI

Three-Pipeline Architecture + Multilingual Web UI

MajorInilabas noong Hunyo 16, 2026Tingnan sa GitHub

Ano ang Bago

Mga Tampok at Pagpapabuti

  • Tatlong uri ng task na may pinagsasaluhang pundasyon — Simpleng Video (isang prompt → isang video sa pamamagitan ng Agnes Video API, t2v/i2v/ti2vid/keyframes), Creative Video (AI scriptwriter → storyboard → video bawat eksena → narrasyon ng edge_tts → pinong subtitle → concatenation), Manuscript Video (paghahati ng mahabang teksto → AI scene prompts → video bawat segment → pinag-isang TTS + subtitle → concatenation).
  • Multilingual web UI — three-tab single-page frontend (Simple/Creative/Manuscript) na may i18n para sa 中文 / English / Русский / 日本語 / 한국어 / Bahasa Melayu / Bahasa Indonesia.
  • Real-time na progreso — WebSocket push ng pipeline progress; pause, resume at stop ng tasks.
  • Pinong subtitle system — word-level SRT grouping mula sa edge_tts timestamps, CJK multi-line wrapping, method="caption" rendering na may stroke/background/position customization.

Refactoring at Pag-optimize

  • Apat-na-layer na arkitekturacore/api (Agnes Chat/Image/Video wrappers na may retry + polling), core/audio (edge_tts + SRT + moviepy overlay), core/compositor (concatenation/scaling/frame extraction), core/pipelines (tatlong pipeline implementations).
  • Pydantic v2 data models — typed task subclasses na may persistent state serialization at backward-compatible task loading.
  • Two-phase manuscript generation — A/B split ng video generation para sa parallelism at mas mabilis na pagkumpleto.

Pag-aayos ng Bug

  • MoviePy 2.x compatibility para sa subtitle bg_color/position; awtomatikong pinalakas ang volume ng TTS.
  • CJK font fallback para sa lumang tasks; may kasamang fonts para sa maaasahang rendering.
  • Video frame cap sa Agnes API limit (409 sa 720p) na may auto-retry para sa pansamantalang failures.
  • Isang tuluy-tuloy na TTS + SRT para sa manuscript pipeline, inaalis ang per-segment padding drift.
  • Paalala sa compatibility/configuration change: ang one-click start start.sh ng v1.0 ay may kasama nang venv creation at dependency installation; pagkatapos ng upgrade, awtomatikong ihahanda ng unang run ang kapaligiran.

Tungkol sa Agnes Video Generator

Isang ganap na libre, open-source AI video generator: gawing multi-scene AI video na may narrasyon at subtitle ang teksto.

  • Libre at open source — walang bayad, walang high-end GPU na kailangan
  • Teksto-sa-video, larawan-sa-video, digital anchor at pagbuo ng imahe
  • Pinapatakbo ng libreng Agnes AI models, video na ganap na nabubuo sa cloud
  • Tumatakbo sa Web UI, Docker o npm, sumusuporta sa self-hosting

Mga Kaugnay na Pahina

Bakit mapagkakatiwalaan ito

Ang artikulong ito ay isinulat ng mga front-line na practitioner. Kapag isinulat, ang mga unang mapagkukunan tulad ng mga arXiv paper, mga teknikal na ulat ng tagagawa at Stanford AI Index ay na-cross-check, at hindi batay sa mga konklusyon mula sa mga subjective na impresyon.

S

SandGrid@lcy362

Author ng Agnes Video Generator · Full-stack Developer

Independent developer at may-akda ng open source AI Video generation tool na Agnes Video Generator. Ang proyekto ay batay sa ganap na libreng modelo ng video ng Agnes AI at open source ng MIT protocol. Nakatulong ito sa 1,000 creator na gumawa ng mga AI na video sa walang gastos. Matagal na akong binibigyang pansin ang engineering at pagpapasikat ng mga modelo ng pagbuo ng video, at ang nilalaman ng artikulo ay nagmula sa front-line practice at first-hand research.

Tingnan sa GitHub

Huling na-update2026-08-21

Handa Ka Nang Magsimulang Gumawa?

“Hayaan ang world-class na AI na pag-aari ng lahat.” — Bruce Yang. Ganap na libre, walang credit card o high-performance graphics card, gawin ang iyong unang AI video sa zero cost. Gustong gumamit ng libreng modelo ng video mula sa Agnes AI? Magsimula ka lang dito.

I-clone ang GitHub repo at i-launch sa loob ng 2 minuto