3.0.0 — ควบคุมคำบรรยายและผู้บรรยายอิสระ + ปรับแต่งคำบรรยายด้วย AI + ผู้ประกาศดิจิทัล + การสร้างภาพ

ควบคุมคำบรรยายและผู้บรรยายอิสระ + ปรับแต่งคำบรรยายด้วย AI + ผู้ประกาศดิจิทัล + การสร้างภาพ

หลักเผยแพร่เมื่อ 21 มิถุนายน 2569ดูบน GitHub

มีอะไรใหม่

ฟีเจอร์และการปรับปรุง

  • ควบคุมคำบรรยายและผู้บรรยายอิสระSubtitleConfig ถูกยกระดับเทียบเท่า AudioConfig แต่ละตัวมีสวิตช์ enabled ของตัวเอง; สี่โหมดรวม (ผู้บรรยาย+คำบรรยาย, เฉพาะผู้บรรยาย, เฉพาะคำบรรยาย, เงียบ); พารามิเตอร์ subtitle_enabled ใหม่บน endpoint แบบสร้างสรรค์และต้นฉบับ
  • ปรับแต่งคำบรรยายด้วย AI (โหมด LLM)style_mode "fixed" (สไตล์รวม) หรือ "llm" (ตำแหน่ง/สี/ขนาดฟอนต์ของแต่ละคำบรรยายกำหนดโดย LLM); style_hints รับคำแนะนำภาษาธรรมชาติ ("บรรทัดสำคัญสีแดง บทสรุปสีเหลือง"); generate_subtitle_styles() ส่งคำบรรยายทั้งหมดให้ LLM ในการเรียกครั้งเดียวและเรนเดอร์ผ่าน sidecar subtitle_styles.json
  • ประเภทงานผู้ประกาศดิจิทัล — ผู้ประกาศ AI ผ่าน t2i หรือ i2i (รูปอ้างอิงที่ผู้ใช้อัปโหลด); ต้นฉบับแบ่งเป็นย่อหน้า 5–12 วินาที แต่ละย่อหน้าสร้างคลิป i2v เฉพาะตัวด้วยท่าทาง/การแสดงออกต่างกัน; TTS แบบรวม + เลเยอร์คำบรรยายที่ปรับด้วย LLM; เสียงจากโมเดลหรือหลังการต่อ; POST /api/tasks/anchor
  • การสร้างภาพแบบง่าย — แท็บที่ห้าใหม่; SimpleImageTask น้ำหนักเบา; รองรับระบบพรอมป์ต; GET /api/image/{id} เพื่อรับผลลัพธ์
  • รองรับระบบพรอมป์ต — ระบบพรอมป์ตเสริมสำหรับงานวิดีโอและภาพแบบง่าย เติมหน้าพรอมป์ตสุดท้าย

การปรับโครงสร้างและการเพิ่มประสิทธิภาพ

  • แยกขั้นตอนไปป์ไลน์_step_audio_subtitle ถูกแทนที่ด้วย _step_audio + _step_subtitle อิสระในไปป์ไลน์แบบสร้างสรรค์และต้นฉบับ
  • ปรับปรุงการเรนเดอร์คำบรรยาย — แสดงหลายบรรทัดทับกัน 0.3 วินาที, ทับเปลี่ยน 0.8 วินาที, ไทม์มิ่ง extend-end สองรอบ, ป้องกันล้นระยะขอบปลอดภัย, จัดตำแหน่งโซนแนวตั้งด้วย LLM เพื่อความหลากหลายทางภาพ

การแก้ไขบั๊ก

  • subprocess.run เพิ่ม stdin=DEVNULL ป้องกันโปรเซสเบื้องหลังค้างจาก SIGTTIN
  • SilentTTSEngine.generate() คืน Nonedict ว่าง แก้การสร้าง SRT โหมดเฉพาะคำบรรยาย
  • ไทม์ไลน์ SRT อิงตามระยะเวลาเสียงจริง ไม่ใช่ระยะเวลาวิดีโอโดยประมาณ
  • เมื่อสร้างภาพล้มเหลว แสดงข้อผิดพลาดเฉพาะ (HTTP status + body + traceback)
  • แก้การเข้ารหัส UTF-8 แบบป้องกันในไปป์ไลน์ผู้ประกาศดิจิทัล; สร้าง TTS ก่อนเพื่อให้ได้ระยะเวลาเสียงจริง

เกี่ยวกับ Agnes Video Generator

เครื่องมือสร้างวิดีโอ AI ฟรีและโอเพนซอร์สโดยสมบูรณ์: เปลี่ยนข้อความเป็นวิดีโอ AI หลายฉากพร้อมเสียงบรรยายและคำบรรยาย

  • ฟรีและโอเพนซอร์ส — ไม่มีค่าใช้จ่าย ไม่ต้องใช้ GPU ระดับสูง
  • ข้อความเป็นวิดีโอ รูปภาพเป็นวิดีโอ ผู้ประกาศดิจิทัล และสร้างภาพ
  • ขับเคลื่อนด้วยโมเดล Agnes AI ฟรี วิดีโอถูกสร้างบนคลาวด์ทั้งหมด
  • ใช้งานผ่าน Web UI, Docker หรือ npm รองรับ self-hosting

หน้าที่เกี่ยวข้อง

บันทึกการเผยแพร่

ประวัติเวอร์ชันของ Agnes Video Generator: ฟีเจอร์ใหม่ การปรับปรุง และการแก้ไขบั๊กในแต่ละรุ่น

ลองใช้ Demo ออนไลน์ | Agnes Video

พิมพ์ Prompt แล้วสร้างวิดีโอและภาพ AI ได้ทันที

API ข้อความเป็นวิดีโอ — API สร้างวิดีโอ AI ฟรี ไม่ต้องใช้ GPU | Agnes Video

การเรียกใช้โปรแกรมโมเดลวิดีโอฟรีของ Agnes AI: ข้อความเป็นวิดีโอ รูปภาพเป็นวิดีโอ การสร้างคำบรรยาย ฯลฯ ครอบคลุม REST API เต็มรูปแบบ รวมถึงพารามิเตอร์คำขอ การรับรองความถูกต้องของผู้ถือ การสำรวจสถานะงาน และตัวอย่างโค้ดที่สมบูรณ์ (Python/cURL/HTTP) เป็นมิตรกับนักพัฒนา ต้นทุนเป็นศูนย์ และไม่จำเป็นต้องมีกราฟิกการ์ดประสิทธิภาพสูงในการเข้าถึง

ทำไมคุณจึงเชื่อถือเนื้อหานี้ได้

บทความนี้เขียนโดยผู้ปฏิบัติงานแนวหน้า เมื่อเขียน เขาได้ตรวจสอบแหล่งข้อมูลโดยตรง เช่น เอกสาร arXiv รายงานทางเทคนิคของผู้ผลิต และดัชนี AI ของ Stanford และไม่ได้สรุปจากความประทับใจเชิงอัตนัย

S

SandGrid@lcy362

ผู้เขียน Agnes Video Generator · นักพัฒนา Full-stack

นักพัฒนาอิสระและผู้เขียนเครื่องมือสร้างวิดีโอ AI โอเพ่นซอร์ส Agnes Video Generator โครงการนี้ใช้โมเดลวิดีโอฟรีโดยสมบูรณ์ของ Agnes AI ซึ่งเป็นโอเพ่นซอร์สภายใต้โปรโตคอล MIT และได้ช่วยให้ผู้สร้าง 1,000 คนผลิตวิดีโอ AI โดยไม่มีค่าใช้จ่าย ฉันให้ความสนใจกับวิศวกรรมและการเผยแพร่โมเดลการสร้างวิดีโอมาเป็นเวลานาน และเนื้อหาของบทความมาจากการปฏิบัติแนวหน้าและการวิจัยโดยตรง

ดูบน GitHub

อัปเดตล่าสุด2026-08-21

พร้อมเริ่มสร้างหรือยัง?

"ปล่อยให้ AI ระดับโลกเป็นของทุกคน" — บรูซ หยาง ฟรีโดยสมบูรณ์ ไม่ต้องใช้บัตรเครดิตหรือกราฟิกการ์ดประสิทธิภาพสูง สร้างวิดีโอ AI ตัวแรกของคุณโดยไม่มีค่าใช้จ่าย ต้องการใช้โมเดลวิดีโอฟรีจาก Agnes AI หรือไม่ เริ่มต้นที่นี่

Clone โปรเจกต์จาก GitHub และเปิดใช้งานภายใน 2 นาที