Narasi & Sarikata: Menambah Suara pada Video AI

Mod penceramah menyediakan suara TTS dan penyegerakan bibir secara terbina dalam; teks-ke-video biasa memerlukan anda menambah narasi dan sarikata sendiri.

Soalan yang kerap timbul apabila baru bermula: adakah video yang dihasilkan AI datang dengan suara latar? Adakah saya perlu menambah sarikata sendiri? Jawapannya bergantung pada mod penjanaan yang anda gunakan. Mod penceramah menjana suara dan penyegerakan bibir secara automatik dalam model. Manakala teks-ke-video biasa hanya menghasilkan visual — tiada narasi, tiada sarikata. Panduan ini menerangkan kedua-dua kes dan di mana untuk menambah sarikata.

Mod penceramah: satu imej rujukan sudah cukup untuk video bersuara

Mod penceramah hanya memerlukan satu imej rujukan digital human untuk menghasilkan video seorang bercakap. Narasi dijana secara automatik oleh TTS terbina dalam, dan penyegerakan bibir dikendalikan di dalam model — tidak perlu merakam suara tambahan atau menyelaraskan secara manual. Perlu diingat: senario berbilang watak dan perpustakaan gerakan lanjutan tersedia di platform luaran seperti HeyGen, Synthesia atau D-ID, dan bukan sebahagian daripada mod penceramah di sini.

Petua: satu imej penceramah ditambah TTS terbina dalam sudah memadai — tiada alat suara tambahan diperlukan.

Teks-ke-video biasa: tiada narasi secara lalai

Jika anda hanya menukar prompt teks kepada video dan tiada sesiapa bercakap dalam bingkai, hasilnya tidak akan mengandungi suara auto atau sarikata. Anda mendapat visual bersih sahaja, dan perlu mengendalikan narasi serta sarikata sendiri dalam alat suntingan. Perhatikan juga had penjanaan: sehingga 15–20 saat setiap klip, resolusi 720p, dan had kadar 16 permintaan seminit.

Bagaimana untuk menambah sarikata?

Klip teks-ke-video biasa tiada sarikata: tambahkan sarikata selepas eksport menggunakan editor seperti CapCut, Premiere atau seumpamanya. Jika mahukan sarikata terbina dalam, tukar kepada mod penceramah — video daripada mod ini disertakan sarikata yang segerak dengan narasi.

Cubalah dalam demo

Demo dan Studio dalam talian kedua-duanya menyediakan pintu masuk mod penceramah, dan /api-docs mendedahkan API penuh. Jana video bersuara daripada satu imej sekarang.

Cuba Demo

Voiceover & Subtitles References

The TTS voiceover, lip-sync, and subtitle-burning approaches on this page reference the following industry products and open-source tech.

  1. HeyGen — 数字人视频创作平台HeyGen · heygen.com (2025)

    Digital-human platforms like HeyGen mentioned here are described per their official product docs.

  2. ElevenLabs — AI 语音与 TTSElevenLabs · elevenlabs.io (2025)

    For DIY voiceovers, ElevenLabs is a mainstream AI TTS option; its voices and language support follow its official site.

  3. Whisper — 自动语音识别与字幕转录OpenAI · GitHub (openai/whisper) (2023)

    For auto subtitle transcription, OpenAI's open-source Whisper model is a reference implementation.

  4. CapCut — 视频剪辑与字幕工具ByteDance · capcut.com (2025)

    The subtitle-burning features of editors recommended here (Jianying/CapCut, etc.) follow their official docs.

Mengapa anda boleh percaya

Artikel ini ditulis oleh pengamal barisan hadapan. Semasa menulis, sumber-sumber utama seperti kertas arXiv, laporan teknikal vendor dan Stanford AI Index disemak silang, bukan kesimpulan berdasarkan tanggapan subjektif.

S

SandGrid@lcy362

Pengarang Agnes Video Generator · Pembangun Full-Stack

Pembangun bebas, pengarang alat penjanaan video AI sumber terbuka Agnes Video Generator. Projek ini berasaskan model video percuma sepenuhnya Agnes AI, lesen sumber terbuka MIT, telah membantu lebih 1,000 pencipta menghasilkan video AI tanpa kos. Lama memberi perhatian kepada kejuruteraan dan pempopularan model penjanaan video, kandungan artikel semuanya daripada amalan barisan hadapan dan penyelidikan sumber utama.

Lihat di GitHub

Kemas kini terakhir2026-08-21

Bersedia untuk Mula Mencipta?

「Jadikan AI bertaraf dunia milik setiap orang。」 — Bruce Yang. Percuma sepenuhnya, tiada kad kredit, tak perlu GPU berprestasi tinggi. Video AI pertama anda bermula pada kos sifar. Nak guna model video percuma Agnes AI? Mulakan dari sini.

Klon repositori GitHub dan lancarkan dalam 2 minit