3.0.0 — Kiểm soát độc lập phụ đề & người dẫn + tạo kiểu phụ đề bằng AI + người dẫn kỹ thuật số + tạo hình ảnh
Kiểm soát độc lập phụ đề & người dẫn + tạo kiểu phụ đề bằng AI + người dẫn kỹ thuật số + tạo hình ảnh
Có gì mới
Tính năng & cải tiến
- Kiểm soát độc lập phụ đề và người dẫn —
SubtitleConfigđược nâng lên ngang hàng vớiAudioConfig, mỗi cái có công tắcenabledriêng; bốn chế độ kết hợp (người dẫn+phụ đề, chỉ người dẫn, chỉ phụ đề, im lặng); tham sốsubtitle_enabledmới trên endpoint sáng tạo và bản thảo. - Tạo kiểu phụ đề bằng AI (chế độ LLM) —
style_mode"fixed"(kiểu toàn cục) hoặc"llm"(vị trí/màu/cỡ chữ từng phụ đề do LLM quyết);style_hintschấp nhận hướng dẫn ngôn ngữ tự nhiên ("dòng chính màu đỏ, tóm tắt màu vàng");generate_subtitle_styles()gửi toàn bộ phụ đề cho LLM trong một lần gọi và render qua file phụ trợsubtitle_styles.json. - Loại tác vụ Người dẫn kỹ thuật số — người dẫn AI qua t2i hoặc i2i (ảnh tham chiếu người dùng tải lên); bản thảo được chia thành đoạn 5–12 giây, mỗi đoạn tạo clip i2v độc nhất với cử chỉ/biểu cảm khác nhau; TTS hợp nhất + lớp phụ đề tối ưu hóa LLM; âm thanh từ mô hình hoặc sau khi nối;
POST /api/tasks/anchor. - Tạo hình ảnh đơn giản — tab thứ năm mới;
SimpleImageTasknhẹ; hỗ trợ system prompt;GET /api/image/{id}để lấy kết quả. - Hỗ trợ system prompt — system prompt tùy chọn cho tác vụ video và hình ảnh đơn giản, thêm vào trước prompt cuối.
Tái cấu trúc & tối ưu hóa
- Tách bước pipeline —
_step_audio_subtitleđược thay thế bằng_step_audio+_step_subtitleđộc lập trong pipeline sáng tạo và bản thảo. - Cải thiện render phụ đề — hiển thị nhiều dòng với chồng 0,3 giây, chồng chuyển tiếp 0,8 giây, định thời
extend-endhai lượt, bảo vệ tràn lề an toàn, định vị vùng dọc bằng LLM để đa dạng thị giác.
Sửa lỗi
subprocess.rungiờ thêmstdin=DEVNULL, ngăn tiến trình nền treo do SIGTTIN.SilentTTSEngine.generate()trảNone→dictrỗng, sửa việc tạo SRT chế độ chỉ phụ đề.- Dòng thời gian SRT dựa trên thời lượng âm thanh thực, không phải thời lượng video ước tính.
- Khi tạo hình ảnh thất bại, xuất lỗi cụ thể (HTTP status + body + traceback).
- Sửa mã hóa UTF-8 phòng thủ trong pipeline người dẫn kỹ thuật số; TTS tạo trước để lấy thời lượng âm thanh thực.
Về Agnes Video Generator
Trình tạo video AI hoàn toàn miễn phí và mã nguồn mở: biến văn bản thành video AI nhiều cảnh có thuyết minh và phụ đề.
- Miễn phí và mã nguồn mở — không trả phí, không cần GPU cao cấp
- Văn bản thành video, hình ảnh thành video, người dẫn kỹ thuật số và tạo hình ảnh
- Chạy trên mô hình Agnes AI miễn phí, video được tạo hoàn toàn trên đám mây
- Chạy qua Web UI, Docker hoặc npm, hỗ trợ tự lưu trữ
Trang liên quan
Ghi chú phát hành
Lịch sử phiên bản Agnes Video Generator: tính năng mới, cải tiến và sửa lỗi cho từng bản phát hành.
Dùng thử Demo trực tuyến | Agnes Video
Nhập prompt và tạo video cùng hình ảnh AI ngay lập tức
API Text to Video — API tạo video AI miễn phí, không cần GPU | Agnes Video
Gọi theo chương trình mô hình video miễn phí Agnes AI: văn bản thành video, hình ảnh thành video, tạo tường thuật, v.v. được bao phủ đầy đủ bởi API REST, bao gồm các tham số yêu cầu, xác thực người mang, thăm dò trạng thái tác vụ và các ví dụ mã hoàn chỉnh (Python/cURL/HTTP). Thân thiện với nhà phát triển, không có chi phí và không cần card đồ họa hiệu suất cao để truy cập.
Vì sao bạn có thể tin nội dung này
Bài viết này được viết bởi những người hành nghề tuyến đầu. Khi viết, họ đã kiểm tra chéo các nguồn trực tiếp như bài báo arXiv, báo cáo kỹ thuật của nhà sản xuất và Chỉ số AI Stanford, chứ không phải kết luận dựa trên ấn tượng chủ quan.
SandGrid@lcy362
Tác giả Agnes Video Generator · Lập trình viên Full-stack
Nhà phát triển độc lập và tác giả của công cụ tạo Video AI mã nguồn mở Agnes Video Generator. Dự án dựa trên mô hình video hoàn toàn miễn phí của Agnes AI và giao thức MIT mã nguồn mở. Nó đã giúp hơn 1.000 người sáng tạo sản xuất video AI với chi phí 0. Tôi đã tập trung vào kỹ thuật và phổ biến các mô hình tạo video trong một thời gian dài. Nội dung của các bài viết đều đến từ thực tiễn tuyến đầu và nghiên cứu trực tiếp.
Xem trên GitHubCập nhật lần cuối:2026-08-21
Sẵn sàng bắt đầu sáng tạo?
“Hãy để AI đẳng cấp thế giới thuộc về tất cả mọi người” – Bruce Yang. Hoàn toàn miễn phí, không cần thẻ tín dụng hay card đồ họa hiệu suất cao, tạo video AI đầu tiên của bạn với chi phí 0. Bạn muốn sử dụng mô hình video miễn phí của Agnes AI? Bắt đầu từ đây.
Clone kho GitHub và khởi chạy trong 2 phút