2.0 — Seni Bina Tiga Saluran Paip + UI Web Pelbagai Bahasa

Seni Bina Tiga Saluran Paip + UI Web Pelbagai Bahasa

UtamaDikeluarkan pada 16 Jun 2026Lihat di GitHub

Apa Baharu

Ciri & Penambahbaikan

  • Tiga jenis tugas dengan asas kongsi — Video Mudah (satu prompt → satu video melalui Agnes Video API, t2v/i2v/ti2vid/keyframes), Video Kreatif (penulis skrip AI → storyboard → video setiap babak → narasi edge_tts → sari kata halus → cantuman), Video Manuskrip (pemisahan teks panjang → prompt babak AI → video setiap segmen → TTS bersatu + sari kata → cantuman).
  • UI Web Pelbagai Bahasa — frontend satu halaman tiga tab (Mudah/Kreatif/Manuskrip) dengan i18n untuk 中文 / English / Русский / 日本語 / 한국어 / Bahasa Melayu / Bahasa Indonesia.
  • Kemajuan masa nyata — WebSocket menolak kemajuan saluran paip; jeda, sambung dan henti tugas.
  • Sistem sari kata halus — pengumpulan SRT per kata daripada cap masa edge_tts, pembungkusan pelbagai baris CJK, render method="caption" dengan penyesuaian strok/latar/kedudukan.

Refaktor & Pengoptimuman

  • Seni bina empat lapisancore/api (pembungkus Agnes Chat/Image/Video dengan retry + polling), core/audio (edge_tts + SRT + overlay moviepy), core/compositor (cantuman/pengecilan/pengekstrakan bingkai), core/pipelines (tiga pelaksanaan saluran paip).
  • Model data Pydantic v2 — subkelas tugas bertaip dengan serialisasi keadaan berterusan dan pemuatan tugas serasi ke belakang.
  • Penjanaan manuskrip dua fasa — pemisahan A/B penjanaan video untuk keselarian dan penyiapan lebih pantas.

Pembetulan Pepijat

  • Keserasian MoviePy 2.x untuk bg_color/position sari kata; kelantangan TTS dinaikkan automatik.
  • Sandaran fon CJK untuk tugas lama; fon dibundel untuk render yang boleh dipercayai.
  • Had bingkai video selaras dengan had Agnes API (409 pada 720p) dengan auto-retry untuk kegagalan sementara.
  • TTS + SRT berterusan tunggal untuk saluran paip manuskrip, menghapuskan hanyutan padding per segmen.
  • Peringatan keserasian/perubahan konfigurasi: pelancaran satu klik start.sh v1.0 sudah disertakan penciptaan venv dan pemasangan kebergantungan; selepas naik taraf, larian pertama akan menyediakan persekitaran secara automatik.

Tentang Agnes Video Generator

Penjana video AI percuma sepenuhnya dan sumber terbuka: ubah teks menjadi video AI pelbagai babak dengan narasi dan sari kata.

  • Percuma dan sumber terbuka — tiada bayaran, tiada GPU berprestasi tinggi diperlukan
  • Teks-ke-video, imej-ke-video, penyampai digital dan penjanaan imej
  • Dikuasakan model Agnes AI percuma, video dijana sepenuhnya di awan
  • Berjalan melalui Web UI, Docker atau npm, menyokong hosting sendiri

Halaman Berkaitan

Mengapa anda boleh percaya

Artikel ini ditulis oleh pengamal barisan hadapan. Semasa menulis, sumber-sumber utama seperti kertas arXiv, laporan teknikal vendor dan Stanford AI Index disemak silang, bukan kesimpulan berdasarkan tanggapan subjektif.

S

SandGrid@lcy362

Pengarang Agnes Video Generator · Pembangun Full-Stack

Pembangun bebas, pengarang alat penjanaan video AI sumber terbuka Agnes Video Generator. Projek ini berasaskan model video percuma sepenuhnya Agnes AI, lesen sumber terbuka MIT, telah membantu lebih 1,000 pencipta menghasilkan video AI tanpa kos. Lama memberi perhatian kepada kejuruteraan dan pempopularan model penjanaan video, kandungan artikel semuanya daripada amalan barisan hadapan dan penyelidikan sumber utama.

Lihat di GitHub

Kemas kini terakhir2026-08-21

Bersedia untuk Mula Mencipta?

「Jadikan AI bertaraf dunia milik setiap orang。」 — Bruce Yang. Percuma sepenuhnya, tiada kad kredit, tak perlu GPU berprestasi tinggi. Video AI pertama anda bermula pada kos sifar. Nak guna model video percuma Agnes AI? Mulakan dari sini.

Klon repositori GitHub dan lancarkan dalam 2 minit