3.0.0 — Kontrol Independen Subtitle & Narator + Gaya Subtitle AI + Pembawa Acara Digital + Generasi Gambar

Kontrol Independen Subtitle & Narator + Gaya Subtitle AI + Pembawa Acara Digital + Generasi Gambar

MayorDirilis pada 21 Juni 2026Lihat di GitHub

Apa yang Baru

Fitur & Peningkatan

  • Kontrol independen subtitle & naratorSubtitleConfig dinaikkan setara dengan AudioConfig, masing-masing dengan saklar enabled sendiri; empat mode kombinasi (narator+subtitle, narator saja, subtitle saja, senyap); parameter subtitle_enabled baru di endpoint kreatif dan naskah.
  • Gaya subtitle AI (mode LLM)style_mode "fixed" (gaya global) atau "llm" (posisi/warna/ukuran font tiap subtitle diputuskan LLM); style_hints menerima panduan bahasa alami ("baris kunci merah, ringkasan kuning"); generate_subtitle_styles() mengirim semua subtitle ke LLM dalam satu panggilan dan merender lewat sidecar subtitle_styles.json.
  • Jenis tugas Pembawa Acara Digital — presenter AI via t2i atau i2i (foto referensi unggahan pengguna); naskah dibagi menjadi paragraf 5–12 detik, masing-masing menghasilkan klip i2v unik dengan gestur/ekspresi berbeda; TTS terpadu + overlay subtitle yang dioptimalkan LLM; audio dari model atau setelah penggabungan; POST /api/tasks/anchor.
  • Generasi gambar sederhana — tab kelima baru; SimpleImageTask ringan; dukungan system prompt; GET /api/image/{id} untuk mengambil hasil.
  • Dukungan system prompt — system prompt opsional untuk tugas video dan gambar sederhana, ditambahkan di depan prompt akhir.

Refactor & Optimasi

  • Pemisahan langkah pipeline_step_audio_subtitle diganti dengan _step_audio + _step_subtitle independen di pipeline kreatif dan naskah.
  • Perbaikan rendering subtitle — tampilan multi-baris dengan overlap 0,3 detik, overlap transisi 0,8 detik, timing extend-end dua lintasan, perlindungan overflow margin aman, posisi zona vertikal LLM untuk variasi visual.

Perbaikan Bug

  • subprocess.run kini menambah stdin=DEVNULL, mencegah proses latar menggantung karena SIGTTIN.
  • SilentTTSEngine.generate() mengembalikan Nonedict kosong, memperbaiki pembuatan SRT mode subtitle saja.
  • Garis waktu SRT berdasarkan durasi audio aktual, bukan estimasi durasi video.
  • Output error spesifik saat generasi gambar gagal (HTTP status + body + traceback).
  • Perbaikan encoding UTF-8 defensif di pipeline pembawa acara digital; TTS dihasilkan lebih dulu untuk durasi audio aktual.

Tentang Agnes Video Generator

Generator video AI sepenuhnya gratis dan sumber terbuka: ubah teks menjadi video AI multi-adegan dengan narasi dan subtitle.

  • Gratis dan sumber terbuka — tanpa biaya, tanpa GPU kelas atas
  • Teks-ke-video, gambar-ke-video, pembawa acara digital, dan generasi gambar
  • Didukung model Agnes AI gratis, video sepenuhnya diproses di cloud
  • Berjalan melalui Web UI, Docker, atau npm, mendukung self-hosting

Halaman Terkait

Mengapa anda bisa percaya

Artikel ini ditulis praktisi lini depan. Saat menulis, sumber-sumber utama seperti paper arXiv, laporan teknis vendor dan Stanford AI Index disilang-cek, bukan kesimpulan berdasarkan kesan subjektif.

S

SandGrid@lcy362

Penulis Agnes Video Generator · Pengembang Full-Stack

Developer independen, penulis tools video generation AI open source Agnes Video Generator. Proyek ini berbasis model video gratis sepenuhnya Agnes AI, lisensi open source MIT, sudah membantu 1.000+ kreator menghasilkan video AI tanpa biaya. Lama fokus pada rekayasa dan demokratisasi model video generation, konten artikel semua berasal dari praktik lini depan dan riset sumber utama.

Lihat di GitHub

Terakhir diperbarui2026-08-21

Siap Memulai Membuat?

「Jadikan AI kelas dunia milik setiap orang。」 — Bruce Yang. Gratis sepenuhnya, tanpa kartu kredit, tidak butuh GPU kelas atas. Video AI pertamamu mulai dari biaya nol. Mau pakai model video gratis Agnes AI? Mulai dari sini.

Kloning repositori GitHub dan jalankan dalam 2 menit