6.3.0 — บันทึกการเผยแพร่
ประวัติเวอร์ชันของ Agnes Video Generator: ฟีเจอร์ใหม่ การปรับปรุง และการแก้ไขบั๊กในแต่ละรุ่น
มีอะไรใหม่
ฟีเจอร์และการปรับปรุง
- แผนงานปรับปรุง v6 เสร็จสมบูรณ์ทั้งหมด (29/29 รายการ) — ทุกชุดของแผนงาน v6 ถูกส่งมอบครบแล้ว:
- ประสิทธิภาพ (ชุดที่ 2): ห่วงโซ่การประกอบขั้นสุดท้ายใช้ ffmpeg เป็นฐาน — การต่อฉากที่มีพารามิเตอร์เหมือนกันใช้
-c copy, การจัดแนว/ระดับเสียง/ยัดความเงียบของเสียงรวมเป็นการกรองรอบเดียว และซับไตเติลแสดงผลผ่านเส้นทาง ASS พร้อมสไตล์รายบรรทัด (AGNES_SUBTITLE_ASSโดยมี fallback อัตโนมัติไปยังเส้นทาง moviepy) วิดีโอบทกวีประกอบทุกฉากในรอบเดียวแทนการเข้ารหัสใหม่ทีละฉาก มีพูลเธรดเข้ารหัสเฉพาะกิจแยกงาน ffmpeg/moviepy หนักออกจากคำขอ API และตัวจำกัดอัตราแบบ token-bucket มีเส้นทาง async ดั้งเดิม ทำให้การหยุดงานระหว่างรอโควตาอัตราทำได้ทันที - ความน่าเชื่อถือและวิศวกรรม (ชุดที่ 1): สถานะงานยึดหลักผู้เขียนเดียวพร้อมล็อกรายงาน; การกลับมาทำต่อรองรับคิว TTS ระดับคำที่บันทึกไว้ (ไม่ต้องสังเคราะห์ซ้ำตอนกลับมา); การสำรวจวิดีโอปรับตัวได้และการรอหลายฉากทำงานพร้อมกัน; รายการงานมีดัชนีพร้อมแบ่งหน้าแบบ
limit/offset/status; อาร์ติแฟกต์/ล็อกข้อผิดพลาดที่ล้าสมัยถูกจัดการ; และฝั่งหน้าเว็บหยุดสำรวจในแท็บพื้นหลังด้วย backoff แบบเลขชี้กำลังและแบนเนอร์แจ้งการขาดการเชื่อมต่อ - ฝั่งหน้าเว็บและ i18n: คำแปลถูกแยกเป็นชิ้นโหลดเลยตามภาษา — บันเดิล JS หน้าแรกลดจาก ~721 kB เหลือ ~305 kB (gzip 226 kB → 97 kB, -58%) โฟลว์ส่ง/ยืนยัน/ทอสต์ของฟอร์มถูกรวมเป็น composable ใช้ร่วมกัน พร้อมเพิ่มเลย์เอาต์มือถือ, โมดัลกักโฟกัส, รองรับ
prefers-reduced-motionและฉบับร่างของฟอร์ม - การสังเกตการณ์และปฏิบัติการ (ชุดที่ 3): endpoint ใหม่
GET /api/healthและGET /api/metrics, การบันทึกลงไฟล์แบบหมุนเวียนตามเลือก (AGNES_LOG_FILE) และ DockerHEALTHCHECKการตั้งค่าขณะรันถูกรวมเข้าที่เดียวผ่านpydantic-settingsแบบมีประเภท (รองรับ.env) ทำให้ลิมิตการทำงานพร้อมกันขยายตามจำนวนคีย์ API แบบไดนามิก - แก้ข้อบกพร่องด่วน (ชุดที่ 0): การหยุดยกเลิกได้ทันทีโดยไม่มี backoff ของการลองใหม่; การอุดกั้น event loop (เข้ารหัสลายน้ำใหม่, ดาวน์โหลดแบบซิงก์) ถูกย้ายออกนอกลูป; การลบแบบหลายคีย์ทำงานถูกต้อง; ปิดช่องโหว่ XSS จาก
v-htmlฝั่งหน้าเว็บ; และการสร้างภาพมีเกริดกันส่งซ้ำ - รองรับครบ 22 ภาษารวมถึงอาหรับ — UI มี 22 ภาษาอยู่แล้ว รุ่นนี้เติมแคตตาล็อกเสียงให้ครบทุกภาษา UI ภาษาอาหรับรองรับเต็มรูปแบบ (PR #32) และ 8 ภาษา UI (ตุรกี เวียดนาม ไทย ตากาล็อก ฮินดี เปอร์เซีย เบงกาลี อูรดู) มีการจัดกลุ่มเสียง edge_tts พร้อมแสดงชื่อเสียงภาษาแม่, regex ตรวจจับอักษร (ไทย/เทวนาครี/เบงกาลี) และฟอนต์ซับไตเติลสำรองตามอักษร (ฟอนต์ Noto ที่แถมมาใหม่; เปอร์เซีย/อูรดูใช้ไปป์ไลน์ reshape+bidi ของอาหรับซ้ำ)
- การเปิดเผยข้อมูลสถิติอย่างโปร่งใสและการควบคุมความเป็นส่วนตัว — แผงตั้งค่าแสดงการ์ดความเป็นส่วนตัวที่ชัดเจนพับได้ ระบุแน่ชัดว่ามีการรายงานสถิติการใช้งานใดบ้าง (และสิ่งที่ไม่เคยอัปโหลด: พรอมต์ ต้นฉบับ บทกวี คีย์ API และภาพอ้างอิงถูกทำให้ไม่ระบุตัวตนก่อนรายงาน) ปิดสถิติได้ทั้งหมดจากแผง
- มี traceback ข้อผิดพลาดครบถ้วนในรายงานฟีดแบ็ก — ความล้มเหลวของไปป์ไลน์บันทึก
tracebackเต็มลงในสถานะงาน; endpoint วินิจฉัยและรายงานฟีดแบ็กในแอปรวมมันไว้ ทำให้วางรายละเอียดข้อผิดพลาดเต็ม (เช่น ระดับสภาพแวดล้อม[WinError 2]) ลงใน issue ของ GitHub ได้โดยไม่ต้องเปิดคอนโซลเซิร์ฟเวอร์
การปรับโครงสร้างและการเพิ่มประสิทธิภาพ
- ห่วงโซ่ประกอบที่ใช้ ffmpeg เป็นหลัก — เส้นทางประกอบขั้นสุดท้ายของวิดีโอสร้างสรรค์/ต้นฉบับ/ผู้ประกาศ/บทกวีถูกออกแบบใหม่จากการเข้ารหัสใหม่เต็มรูปแบบ 3-4 ครั้ง เป็น copy-concat + การกรองรอบเดียว (มี fallback นุ่มนวลไปยังเส้นทาง moviepy เดิม) นี่คือกำไรด้านประสิทธิภาพที่ใหญ่ที่สุดของสาย v6 ตัดเวลาประกอบขั้นสุดท้ายลงราว 3-10 เท่าในผลลัพธ์ทั่วไป
- การจำกัดอัตราแบบอะซิงโครนัสพร้อมพูลเธรดเข้ารหัสเฉพาะกิจ — token bucket มีเส้นทาง acquire แบบ async ดั้งเดิม (รู้ตัวว่าถูกหยุด) และงานเข้ารหัสหนักทำงานบน executor เฉพาะ งานเข้ารหัสยาวจึงไม่ทำให้เส้นทางคำขออดอาหารอีกต่อไป
การแก้ไขบั๊ก
- แก้พฤติกรรมการหยุด — การยกเลิกงานไม่กระตุ้น backoff ของการลองใหม่อีก (นานสุด ~2 นาที) และไม่ลบ
video_idที่กลับมาทำต่อได้อีก - แก้การตั้งค่าหลายคีย์ — ID คีย์ถูกแฮชจากคีย์จริง การลบคีย์หนึ่งจากหลายคีย์ที่ตั้งไว้จะลบคีย์นั้นเป๊ะ
- แก้การค้างของ event loop — การเข้ารหัสลายน้ำใหม่และการดาวน์โหลดแบบซิงก์ไม่อุดกั้นทั้งบริการอีกต่อไป; แก้บั๊กการปล่อยเซมาฟอร์ที่อาจทำลายลิมิตการทำงานพร้อมกันอย่างถาวรในการตั้งค่าโควตาต่ำ
- แก้ปัญหาฝั่งหน้าเว็บ — ปิดช่อง stored-XSS ผ่าน
v-htmlที่ไม่ได้ escape, ป้องกันการส่งสร้างภาพซ้ำโดยไม่มีเกริด และข้อผิดพลาด fetch แสดงข้อความจากแบ็กเอนด์ที่อ่านได้แทนความล้มเหลวเงียบ ๆ - ไม่จำเป็นต้องเปลี่ยนการตั้งค่าใด ๆ งานที่มีอยู่กลับมาทำต่อได้ตามเดิม; รูปแบบไฟล์สถานะงานไม่เปลี่ยน
เกี่ยวกับ Agnes Video Generator
เครื่องมือสร้างวิดีโอ AI ฟรีและโอเพนซอร์สโดยสมบูรณ์: เปลี่ยนข้อความเป็นวิดีโอ AI หลายฉากพร้อมเสียงบรรยายและคำบรรยาย
- ฟรีและโอเพนซอร์ส — ไม่มีค่าใช้จ่าย ไม่ต้องใช้ GPU ระดับสูง
- ข้อความเป็นวิดีโอ รูปภาพเป็นวิดีโอ ผู้ประกาศดิจิทัล และสร้างภาพ
- ขับเคลื่อนด้วยโมเดล Agnes AI ฟรี วิดีโอถูกสร้างบนคลาวด์ทั้งหมด
- ใช้งานผ่าน Web UI, Docker หรือ npm รองรับ self-hosting
หน้าที่เกี่ยวข้อง
บันทึกการเผยแพร่
ประวัติเวอร์ชันของ Agnes Video Generator: ฟีเจอร์ใหม่ การปรับปรุง และการแก้ไขบั๊กในแต่ละรุ่น
ลองใช้ Demo ออนไลน์ | Agnes Video
พิมพ์ Prompt แล้วสร้างวิดีโอและภาพ AI ได้ทันที
API ข้อความเป็นวิดีโอ — API สร้างวิดีโอ AI ฟรี ไม่ต้องใช้ GPU | Agnes Video
การเรียกใช้โปรแกรมโมเดลวิดีโอฟรีของ Agnes AI: ข้อความเป็นวิดีโอ รูปภาพเป็นวิดีโอ การสร้างคำบรรยาย ฯลฯ ครอบคลุม REST API เต็มรูปแบบ รวมถึงพารามิเตอร์คำขอ การรับรองความถูกต้องของผู้ถือ การสำรวจสถานะงาน และตัวอย่างโค้ดที่สมบูรณ์ (Python/cURL/HTTP) เป็นมิตรกับนักพัฒนา ต้นทุนเป็นศูนย์ และไม่จำเป็นต้องมีกราฟิกการ์ดประสิทธิภาพสูงในการเข้าถึง
ทำไมคุณจึงเชื่อถือเนื้อหานี้ได้
บทความนี้เขียนโดยผู้ปฏิบัติงานแนวหน้า เมื่อเขียน เขาได้ตรวจสอบแหล่งข้อมูลโดยตรง เช่น เอกสาร arXiv รายงานทางเทคนิคของผู้ผลิต และดัชนี AI ของ Stanford และไม่ได้สรุปจากความประทับใจเชิงอัตนัย
SandGrid@lcy362
ผู้เขียน Agnes Video Generator · นักพัฒนา Full-stack
นักพัฒนาอิสระและผู้เขียนเครื่องมือสร้างวิดีโอ AI โอเพ่นซอร์ส Agnes Video Generator โครงการนี้ใช้โมเดลวิดีโอฟรีโดยสมบูรณ์ของ Agnes AI ซึ่งเป็นโอเพ่นซอร์สภายใต้โปรโตคอล MIT และได้ช่วยให้ผู้สร้าง 1,000 คนผลิตวิดีโอ AI โดยไม่มีค่าใช้จ่าย ฉันให้ความสนใจกับวิศวกรรมและการเผยแพร่โมเดลการสร้างวิดีโอมาเป็นเวลานาน และเนื้อหาของบทความมาจากการปฏิบัติแนวหน้าและการวิจัยโดยตรง
ดูบน GitHubอัปเดตล่าสุด:2026-08-21
พร้อมเริ่มสร้างหรือยัง?
"ปล่อยให้ AI ระดับโลกเป็นของทุกคน" — บรูซ หยาง ฟรีโดยสมบูรณ์ ไม่ต้องใช้บัตรเครดิตหรือกราฟิกการ์ดประสิทธิภาพสูง สร้างวิดีโอ AI ตัวแรกของคุณโดยไม่มีค่าใช้จ่าย ต้องการใช้โมเดลวิดีโอฟรีจาก Agnes AI หรือไม่ เริ่มต้นที่นี่
Clone โปรเจกต์จาก GitHub และเปิดใช้งานภายใน 2 นาที