3.0.0 — ควบคุมคำบรรยายและผู้บรรยายอิสระ + ปรับแต่งคำบรรยายด้วย AI + ผู้ประกาศดิจิทัล + การสร้างภาพ
ควบคุมคำบรรยายและผู้บรรยายอิสระ + ปรับแต่งคำบรรยายด้วย AI + ผู้ประกาศดิจิทัล + การสร้างภาพ
มีอะไรใหม่
ฟีเจอร์และการปรับปรุง
- ควบคุมคำบรรยายและผู้บรรยายอิสระ —
SubtitleConfigถูกยกระดับเทียบเท่าAudioConfigแต่ละตัวมีสวิตช์enabledของตัวเอง; สี่โหมดรวม (ผู้บรรยาย+คำบรรยาย, เฉพาะผู้บรรยาย, เฉพาะคำบรรยาย, เงียบ); พารามิเตอร์subtitle_enabledใหม่บน endpoint แบบสร้างสรรค์และต้นฉบับ - ปรับแต่งคำบรรยายด้วย AI (โหมด LLM) —
style_mode"fixed"(สไตล์รวม) หรือ"llm"(ตำแหน่ง/สี/ขนาดฟอนต์ของแต่ละคำบรรยายกำหนดโดย LLM);style_hintsรับคำแนะนำภาษาธรรมชาติ ("บรรทัดสำคัญสีแดง บทสรุปสีเหลือง");generate_subtitle_styles()ส่งคำบรรยายทั้งหมดให้ LLM ในการเรียกครั้งเดียวและเรนเดอร์ผ่าน sidecarsubtitle_styles.json - ประเภทงานผู้ประกาศดิจิทัล — ผู้ประกาศ AI ผ่าน t2i หรือ i2i (รูปอ้างอิงที่ผู้ใช้อัปโหลด); ต้นฉบับแบ่งเป็นย่อหน้า 5–12 วินาที แต่ละย่อหน้าสร้างคลิป i2v เฉพาะตัวด้วยท่าทาง/การแสดงออกต่างกัน; TTS แบบรวม + เลเยอร์คำบรรยายที่ปรับด้วย LLM; เสียงจากโมเดลหรือหลังการต่อ;
POST /api/tasks/anchor - การสร้างภาพแบบง่าย — แท็บที่ห้าใหม่;
SimpleImageTaskน้ำหนักเบา; รองรับระบบพรอมป์ต;GET /api/image/{id}เพื่อรับผลลัพธ์ - รองรับระบบพรอมป์ต — ระบบพรอมป์ตเสริมสำหรับงานวิดีโอและภาพแบบง่าย เติมหน้าพรอมป์ตสุดท้าย
การปรับโครงสร้างและการเพิ่มประสิทธิภาพ
- แยกขั้นตอนไปป์ไลน์ —
_step_audio_subtitleถูกแทนที่ด้วย_step_audio+_step_subtitleอิสระในไปป์ไลน์แบบสร้างสรรค์และต้นฉบับ - ปรับปรุงการเรนเดอร์คำบรรยาย — แสดงหลายบรรทัดทับกัน 0.3 วินาที, ทับเปลี่ยน 0.8 วินาที, ไทม์มิ่ง
extend-endสองรอบ, ป้องกันล้นระยะขอบปลอดภัย, จัดตำแหน่งโซนแนวตั้งด้วย LLM เพื่อความหลากหลายทางภาพ
การแก้ไขบั๊ก
subprocess.runเพิ่มstdin=DEVNULLป้องกันโปรเซสเบื้องหลังค้างจาก SIGTTINSilentTTSEngine.generate()คืนNone→dictว่าง แก้การสร้าง SRT โหมดเฉพาะคำบรรยาย- ไทม์ไลน์ SRT อิงตามระยะเวลาเสียงจริง ไม่ใช่ระยะเวลาวิดีโอโดยประมาณ
- เมื่อสร้างภาพล้มเหลว แสดงข้อผิดพลาดเฉพาะ (HTTP status + body + traceback)
- แก้การเข้ารหัส UTF-8 แบบป้องกันในไปป์ไลน์ผู้ประกาศดิจิทัล; สร้าง TTS ก่อนเพื่อให้ได้ระยะเวลาเสียงจริง
เกี่ยวกับ Agnes Video Generator
เครื่องมือสร้างวิดีโอ AI ฟรีและโอเพนซอร์สโดยสมบูรณ์: เปลี่ยนข้อความเป็นวิดีโอ AI หลายฉากพร้อมเสียงบรรยายและคำบรรยาย
- ฟรีและโอเพนซอร์ส — ไม่มีค่าใช้จ่าย ไม่ต้องใช้ GPU ระดับสูง
- ข้อความเป็นวิดีโอ รูปภาพเป็นวิดีโอ ผู้ประกาศดิจิทัล และสร้างภาพ
- ขับเคลื่อนด้วยโมเดล Agnes AI ฟรี วิดีโอถูกสร้างบนคลาวด์ทั้งหมด
- ใช้งานผ่าน Web UI, Docker หรือ npm รองรับ self-hosting
หน้าที่เกี่ยวข้อง
บันทึกการเผยแพร่
ประวัติเวอร์ชันของ Agnes Video Generator: ฟีเจอร์ใหม่ การปรับปรุง และการแก้ไขบั๊กในแต่ละรุ่น
ลองใช้ Demo ออนไลน์ | Agnes Video
พิมพ์ Prompt แล้วสร้างวิดีโอและภาพ AI ได้ทันที
API ข้อความเป็นวิดีโอ — API สร้างวิดีโอ AI ฟรี ไม่ต้องใช้ GPU | Agnes Video
การเรียกใช้โปรแกรมโมเดลวิดีโอฟรีของ Agnes AI: ข้อความเป็นวิดีโอ รูปภาพเป็นวิดีโอ การสร้างคำบรรยาย ฯลฯ ครอบคลุม REST API เต็มรูปแบบ รวมถึงพารามิเตอร์คำขอ การรับรองความถูกต้องของผู้ถือ การสำรวจสถานะงาน และตัวอย่างโค้ดที่สมบูรณ์ (Python/cURL/HTTP) เป็นมิตรกับนักพัฒนา ต้นทุนเป็นศูนย์ และไม่จำเป็นต้องมีกราฟิกการ์ดประสิทธิภาพสูงในการเข้าถึง
ทำไมคุณจึงเชื่อถือเนื้อหานี้ได้
บทความนี้เขียนโดยผู้ปฏิบัติงานแนวหน้า เมื่อเขียน เขาได้ตรวจสอบแหล่งข้อมูลโดยตรง เช่น เอกสาร arXiv รายงานทางเทคนิคของผู้ผลิต และดัชนี AI ของ Stanford และไม่ได้สรุปจากความประทับใจเชิงอัตนัย
SandGrid@lcy362
ผู้เขียน Agnes Video Generator · นักพัฒนา Full-stack
นักพัฒนาอิสระและผู้เขียนเครื่องมือสร้างวิดีโอ AI โอเพ่นซอร์ส Agnes Video Generator โครงการนี้ใช้โมเดลวิดีโอฟรีโดยสมบูรณ์ของ Agnes AI ซึ่งเป็นโอเพ่นซอร์สภายใต้โปรโตคอล MIT และได้ช่วยให้ผู้สร้าง 1,000 คนผลิตวิดีโอ AI โดยไม่มีค่าใช้จ่าย ฉันให้ความสนใจกับวิศวกรรมและการเผยแพร่โมเดลการสร้างวิดีโอมาเป็นเวลานาน และเนื้อหาของบทความมาจากการปฏิบัติแนวหน้าและการวิจัยโดยตรง
ดูบน GitHubอัปเดตล่าสุด:2026-08-21
พร้อมเริ่มสร้างหรือยัง?
"ปล่อยให้ AI ระดับโลกเป็นของทุกคน" — บรูซ หยาง ฟรีโดยสมบูรณ์ ไม่ต้องใช้บัตรเครดิตหรือกราฟิกการ์ดประสิทธิภาพสูง สร้างวิดีโอ AI ตัวแรกของคุณโดยไม่มีค่าใช้จ่าย ต้องการใช้โมเดลวิดีโอฟรีจาก Agnes AI หรือไม่ เริ่มต้นที่นี่
Clone โปรเจกต์จาก GitHub และเปิดใช้งานภายใน 2 นาที