6.3.0 — บันทึกการเผยแพร่

ประวัติเวอร์ชันของ Agnes Video Generator: ฟีเจอร์ใหม่ การปรับปรุง และการแก้ไขบั๊กในแต่ละรุ่น

รองเผยแพร่เมื่อ 30 สิงหาคม 2569ดูบน GitHub

มีอะไรใหม่

ฟีเจอร์และการปรับปรุง

  • แผนงานปรับปรุง v6 เสร็จสมบูรณ์ทั้งหมด (29/29 รายการ) — ทุกชุดของแผนงาน v6 ถูกส่งมอบครบแล้ว:
  • ประสิทธิภาพ (ชุดที่ 2): ห่วงโซ่การประกอบขั้นสุดท้ายใช้ ffmpeg เป็นฐาน — การต่อฉากที่มีพารามิเตอร์เหมือนกันใช้ -c copy, การจัดแนว/ระดับเสียง/ยัดความเงียบของเสียงรวมเป็นการกรองรอบเดียว และซับไตเติลแสดงผลผ่านเส้นทาง ASS พร้อมสไตล์รายบรรทัด (AGNES_SUBTITLE_ASS โดยมี fallback อัตโนมัติไปยังเส้นทาง moviepy) วิดีโอบทกวีประกอบทุกฉากในรอบเดียวแทนการเข้ารหัสใหม่ทีละฉาก มีพูลเธรดเข้ารหัสเฉพาะกิจแยกงาน ffmpeg/moviepy หนักออกจากคำขอ API และตัวจำกัดอัตราแบบ token-bucket มีเส้นทาง async ดั้งเดิม ทำให้การหยุดงานระหว่างรอโควตาอัตราทำได้ทันที
  • ความน่าเชื่อถือและวิศวกรรม (ชุดที่ 1): สถานะงานยึดหลักผู้เขียนเดียวพร้อมล็อกรายงาน; การกลับมาทำต่อรองรับคิว TTS ระดับคำที่บันทึกไว้ (ไม่ต้องสังเคราะห์ซ้ำตอนกลับมา); การสำรวจวิดีโอปรับตัวได้และการรอหลายฉากทำงานพร้อมกัน; รายการงานมีดัชนีพร้อมแบ่งหน้าแบบ limit/offset/status; อาร์ติแฟกต์/ล็อกข้อผิดพลาดที่ล้าสมัยถูกจัดการ; และฝั่งหน้าเว็บหยุดสำรวจในแท็บพื้นหลังด้วย backoff แบบเลขชี้กำลังและแบนเนอร์แจ้งการขาดการเชื่อมต่อ
  • ฝั่งหน้าเว็บและ i18n: คำแปลถูกแยกเป็นชิ้นโหลดเลยตามภาษา — บันเดิล JS หน้าแรกลดจาก ~721 kB เหลือ ~305 kB (gzip 226 kB → 97 kB, -58%) โฟลว์ส่ง/ยืนยัน/ทอสต์ของฟอร์มถูกรวมเป็น composable ใช้ร่วมกัน พร้อมเพิ่มเลย์เอาต์มือถือ, โมดัลกักโฟกัส, รองรับ prefers-reduced-motion และฉบับร่างของฟอร์ม
  • การสังเกตการณ์และปฏิบัติการ (ชุดที่ 3): endpoint ใหม่ GET /api/health และ GET /api/metrics, การบันทึกลงไฟล์แบบหมุนเวียนตามเลือก (AGNES_LOG_FILE) และ Docker HEALTHCHECK การตั้งค่าขณะรันถูกรวมเข้าที่เดียวผ่าน pydantic-settings แบบมีประเภท (รองรับ .env) ทำให้ลิมิตการทำงานพร้อมกันขยายตามจำนวนคีย์ API แบบไดนามิก
  • แก้ข้อบกพร่องด่วน (ชุดที่ 0): การหยุดยกเลิกได้ทันทีโดยไม่มี backoff ของการลองใหม่; การอุดกั้น event loop (เข้ารหัสลายน้ำใหม่, ดาวน์โหลดแบบซิงก์) ถูกย้ายออกนอกลูป; การลบแบบหลายคีย์ทำงานถูกต้อง; ปิดช่องโหว่ XSS จาก v-html ฝั่งหน้าเว็บ; และการสร้างภาพมีเกริดกันส่งซ้ำ
  • รองรับครบ 22 ภาษารวมถึงอาหรับ — UI มี 22 ภาษาอยู่แล้ว รุ่นนี้เติมแคตตาล็อกเสียงให้ครบทุกภาษา UI ภาษาอาหรับรองรับเต็มรูปแบบ (PR #32) และ 8 ภาษา UI (ตุรกี เวียดนาม ไทย ตากาล็อก ฮินดี เปอร์เซีย เบงกาลี อูรดู) มีการจัดกลุ่มเสียง edge_tts พร้อมแสดงชื่อเสียงภาษาแม่, regex ตรวจจับอักษร (ไทย/เทวนาครี/เบงกาลี) และฟอนต์ซับไตเติลสำรองตามอักษร (ฟอนต์ Noto ที่แถมมาใหม่; เปอร์เซีย/อูรดูใช้ไปป์ไลน์ reshape+bidi ของอาหรับซ้ำ)
  • การเปิดเผยข้อมูลสถิติอย่างโปร่งใสและการควบคุมความเป็นส่วนตัว — แผงตั้งค่าแสดงการ์ดความเป็นส่วนตัวที่ชัดเจนพับได้ ระบุแน่ชัดว่ามีการรายงานสถิติการใช้งานใดบ้าง (และสิ่งที่ไม่เคยอัปโหลด: พรอมต์ ต้นฉบับ บทกวี คีย์ API และภาพอ้างอิงถูกทำให้ไม่ระบุตัวตนก่อนรายงาน) ปิดสถิติได้ทั้งหมดจากแผง
  • มี traceback ข้อผิดพลาดครบถ้วนในรายงานฟีดแบ็ก — ความล้มเหลวของไปป์ไลน์บันทึก traceback เต็มลงในสถานะงาน; endpoint วินิจฉัยและรายงานฟีดแบ็กในแอปรวมมันไว้ ทำให้วางรายละเอียดข้อผิดพลาดเต็ม (เช่น ระดับสภาพแวดล้อม [WinError 2]) ลงใน issue ของ GitHub ได้โดยไม่ต้องเปิดคอนโซลเซิร์ฟเวอร์

การปรับโครงสร้างและการเพิ่มประสิทธิภาพ

  • ห่วงโซ่ประกอบที่ใช้ ffmpeg เป็นหลัก — เส้นทางประกอบขั้นสุดท้ายของวิดีโอสร้างสรรค์/ต้นฉบับ/ผู้ประกาศ/บทกวีถูกออกแบบใหม่จากการเข้ารหัสใหม่เต็มรูปแบบ 3-4 ครั้ง เป็น copy-concat + การกรองรอบเดียว (มี fallback นุ่มนวลไปยังเส้นทาง moviepy เดิม) นี่คือกำไรด้านประสิทธิภาพที่ใหญ่ที่สุดของสาย v6 ตัดเวลาประกอบขั้นสุดท้ายลงราว 3-10 เท่าในผลลัพธ์ทั่วไป
  • การจำกัดอัตราแบบอะซิงโครนัสพร้อมพูลเธรดเข้ารหัสเฉพาะกิจ — token bucket มีเส้นทาง acquire แบบ async ดั้งเดิม (รู้ตัวว่าถูกหยุด) และงานเข้ารหัสหนักทำงานบน executor เฉพาะ งานเข้ารหัสยาวจึงไม่ทำให้เส้นทางคำขออดอาหารอีกต่อไป

การแก้ไขบั๊ก

  • แก้พฤติกรรมการหยุด — การยกเลิกงานไม่กระตุ้น backoff ของการลองใหม่อีก (นานสุด ~2 นาที) และไม่ลบ video_id ที่กลับมาทำต่อได้อีก
  • แก้การตั้งค่าหลายคีย์ — ID คีย์ถูกแฮชจากคีย์จริง การลบคีย์หนึ่งจากหลายคีย์ที่ตั้งไว้จะลบคีย์นั้นเป๊ะ
  • แก้การค้างของ event loop — การเข้ารหัสลายน้ำใหม่และการดาวน์โหลดแบบซิงก์ไม่อุดกั้นทั้งบริการอีกต่อไป; แก้บั๊กการปล่อยเซมาฟอร์ที่อาจทำลายลิมิตการทำงานพร้อมกันอย่างถาวรในการตั้งค่าโควตาต่ำ
  • แก้ปัญหาฝั่งหน้าเว็บ — ปิดช่อง stored-XSS ผ่าน v-html ที่ไม่ได้ escape, ป้องกันการส่งสร้างภาพซ้ำโดยไม่มีเกริด และข้อผิดพลาด fetch แสดงข้อความจากแบ็กเอนด์ที่อ่านได้แทนความล้มเหลวเงียบ ๆ
  • ไม่จำเป็นต้องเปลี่ยนการตั้งค่าใด ๆ งานที่มีอยู่กลับมาทำต่อได้ตามเดิม; รูปแบบไฟล์สถานะงานไม่เปลี่ยน

เกี่ยวกับ Agnes Video Generator

เครื่องมือสร้างวิดีโอ AI ฟรีและโอเพนซอร์สโดยสมบูรณ์: เปลี่ยนข้อความเป็นวิดีโอ AI หลายฉากพร้อมเสียงบรรยายและคำบรรยาย

  • ฟรีและโอเพนซอร์ส — ไม่มีค่าใช้จ่าย ไม่ต้องใช้ GPU ระดับสูง
  • ข้อความเป็นวิดีโอ รูปภาพเป็นวิดีโอ ผู้ประกาศดิจิทัล และสร้างภาพ
  • ขับเคลื่อนด้วยโมเดล Agnes AI ฟรี วิดีโอถูกสร้างบนคลาวด์ทั้งหมด
  • ใช้งานผ่าน Web UI, Docker หรือ npm รองรับ self-hosting

หน้าที่เกี่ยวข้อง

บันทึกการเผยแพร่

ประวัติเวอร์ชันของ Agnes Video Generator: ฟีเจอร์ใหม่ การปรับปรุง และการแก้ไขบั๊กในแต่ละรุ่น

ลองใช้ Demo ออนไลน์ | Agnes Video

พิมพ์ Prompt แล้วสร้างวิดีโอและภาพ AI ได้ทันที

API ข้อความเป็นวิดีโอ — API สร้างวิดีโอ AI ฟรี ไม่ต้องใช้ GPU | Agnes Video

การเรียกใช้โปรแกรมโมเดลวิดีโอฟรีของ Agnes AI: ข้อความเป็นวิดีโอ รูปภาพเป็นวิดีโอ การสร้างคำบรรยาย ฯลฯ ครอบคลุม REST API เต็มรูปแบบ รวมถึงพารามิเตอร์คำขอ การรับรองความถูกต้องของผู้ถือ การสำรวจสถานะงาน และตัวอย่างโค้ดที่สมบูรณ์ (Python/cURL/HTTP) เป็นมิตรกับนักพัฒนา ต้นทุนเป็นศูนย์ และไม่จำเป็นต้องมีกราฟิกการ์ดประสิทธิภาพสูงในการเข้าถึง

ทำไมคุณจึงเชื่อถือเนื้อหานี้ได้

บทความนี้เขียนโดยผู้ปฏิบัติงานแนวหน้า เมื่อเขียน เขาได้ตรวจสอบแหล่งข้อมูลโดยตรง เช่น เอกสาร arXiv รายงานทางเทคนิคของผู้ผลิต และดัชนี AI ของ Stanford และไม่ได้สรุปจากความประทับใจเชิงอัตนัย

S

SandGrid@lcy362

ผู้เขียน Agnes Video Generator · นักพัฒนา Full-stack

นักพัฒนาอิสระและผู้เขียนเครื่องมือสร้างวิดีโอ AI โอเพ่นซอร์ส Agnes Video Generator โครงการนี้ใช้โมเดลวิดีโอฟรีโดยสมบูรณ์ของ Agnes AI ซึ่งเป็นโอเพ่นซอร์สภายใต้โปรโตคอล MIT และได้ช่วยให้ผู้สร้าง 1,000 คนผลิตวิดีโอ AI โดยไม่มีค่าใช้จ่าย ฉันให้ความสนใจกับวิศวกรรมและการเผยแพร่โมเดลการสร้างวิดีโอมาเป็นเวลานาน และเนื้อหาของบทความมาจากการปฏิบัติแนวหน้าและการวิจัยโดยตรง

ดูบน GitHub

อัปเดตล่าสุด2026-08-21

พร้อมเริ่มสร้างหรือยัง?

"ปล่อยให้ AI ระดับโลกเป็นของทุกคน" — บรูซ หยาง ฟรีโดยสมบูรณ์ ไม่ต้องใช้บัตรเครดิตหรือกราฟิกการ์ดประสิทธิภาพสูง สร้างวิดีโอ AI ตัวแรกของคุณโดยไม่มีค่าใช้จ่าย ต้องการใช้โมเดลวิดีโอฟรีจาก Agnes AI หรือไม่ เริ่มต้นที่นี่

Clone โปรเจกต์จาก GitHub และเปิดใช้งานภายใน 2 นาที