3.0.0 — Kawalan Bebas Sari Kata & Narator + Penggayaan Sari Kata AI + Penyampai Digital + Penjanaan Imej

Kawalan Bebas Sari Kata & Narator + Penggayaan Sari Kata AI + Penyampai Digital + Penjanaan Imej

UtamaDikeluarkan pada 21 Jun 2026Lihat di GitHub

Apa Baharu

Ciri & Penambahbaikan

  • Kawalan bebas sari kata & naratorSubtitleConfig dinaikkan setara dengan AudioConfig, masing-masing dengan suis enabled sendiri; empat mod gabungan (narator+sari kata, narator sahaja, sari kata sahaja, senyap); parameter subtitle_enabled baharu pada endpoint kreatif dan manuskrip.
  • Penggayaan sari kata AI (mod LLM)style_mode "fixed" (gaya global) atau "llm" (kedudukan/warna/saiz fon setiap sari kata diputuskan oleh LLM); style_hints menerima panduan bahasa semula jadi ("baris utama merah, ringkasan kuning"); generate_subtitle_styles() menghantar semua sari kata kepada LLM dalam satu panggilan dan merender melalui sidecar subtitle_styles.json.
  • Jenis tugas Penyampai Digital — penyampai AI melalui t2i atau i2i (foto rujukan yang dimuat naik pengguna); manuskrip dibahagi kepada perenggan 5–12 saat, setiap satu menjana klip i2v unik dengan gerak isyarat/ekspresi berbeza; TTS bersatu + lapisan sari kata yang dioptimumkan LLM; audio daripada model atau selepas cantuman; POST /api/tasks/anchor.
  • Penjanaan imej ringkas — tab kelima baharu; SimpleImageTask ringan; sokongan prompt sistem; GET /api/image/{id} untuk mendapatkan hasil.
  • Sokongan prompt sistem — prompt sistem pilihan untuk tugas video dan imej ringkas, ditambah di hadapan prompt akhir.

Refaktor & Pengoptimuman

  • Pembahagian langkah saluran paip_step_audio_subtitle digantikan oleh _step_audio + _step_subtitle bebas dalam saluran paip kreatif dan manuskrip.
  • Penambahbaikan render sari kata — paparan pelbagai baris dengan pertindihan 0.3s, pertindihan peralihan 0.8s, pemasaan extend-end dua pas, perlindungan limpahan margin selamat, kedudukan zon menegak LLM untuk variasi visual.

Pembetulan Pepijat

  • subprocess.run kini menambah stdin=DEVNULL, menghalang proses latar daripada tergantung pada SIGTTIN.
  • SilentTTSEngine.generate() pulangkan Nonedict kosong, membaiki penjanaan SRT mod sari kata sahaja.
  • Garis masa SRT berdasarkan tempoh audio sebenar, bukan anggaran tempoh video.
  • Output ralat khusus apabila penjanaan imej gagal (HTTP status + body + traceback).
  • Pembaikan pengekodan UTF-8 defensif dalam saluran paip penyampai digital; TTS dijana dahulu untuk mendapatkan tempoh audio sebenar.

Tentang Agnes Video Generator

Penjana video AI percuma sepenuhnya dan sumber terbuka: ubah teks menjadi video AI pelbagai babak dengan narasi dan sari kata.

  • Percuma dan sumber terbuka — tiada bayaran, tiada GPU berprestasi tinggi diperlukan
  • Teks-ke-video, imej-ke-video, penyampai digital dan penjanaan imej
  • Dikuasakan model Agnes AI percuma, video dijana sepenuhnya di awan
  • Berjalan melalui Web UI, Docker atau npm, menyokong hosting sendiri

Halaman Berkaitan

Mengapa anda boleh percaya

Artikel ini ditulis oleh pengamal barisan hadapan. Semasa menulis, sumber-sumber utama seperti kertas arXiv, laporan teknikal vendor dan Stanford AI Index disemak silang, bukan kesimpulan berdasarkan tanggapan subjektif.

S

SandGrid@lcy362

Pengarang Agnes Video Generator · Pembangun Full-Stack

Pembangun bebas, pengarang alat penjanaan video AI sumber terbuka Agnes Video Generator. Projek ini berasaskan model video percuma sepenuhnya Agnes AI, lesen sumber terbuka MIT, telah membantu lebih 1,000 pencipta menghasilkan video AI tanpa kos. Lama memberi perhatian kepada kejuruteraan dan pempopularan model penjanaan video, kandungan artikel semuanya daripada amalan barisan hadapan dan penyelidikan sumber utama.

Lihat di GitHub

Kemas kini terakhir2026-08-21

Bersedia untuk Mula Mencipta?

「Jadikan AI bertaraf dunia milik setiap orang。」 — Bruce Yang. Percuma sepenuhnya, tiada kad kredit, tak perlu GPU berprestasi tinggi. Video AI pertama anda bermula pada kos sifar. Nak guna model video percuma Agnes AI? Mulakan dari sini.

Klon repositori GitHub dan lancarkan dalam 2 minit