Cách viết Prompt cho năm chế độ
Văn bản→video, video dài sáng tạo, video bản thảo, video thơ, người dẫn chương trình — cách viết từng chế độ
Trước khi viết lời nhắc nhở, hãy suy nghĩ xem bạn muốn sử dụng chế độ nào: video Vincent (mô tả đơn đoạn, cũng có thể đính kèm hình ảnh tham khảo để khóa chủ thể), video dài sáng tạo (mạch truyện + danh sách cảnh), video dài bản thảo (toàn bộ bản thảo được tự động chia thành đoạn), video thơ (chia bài thơ gốc từng câu để tạo ra hình ảnh) hoặc phát sóng bằng miệng kỹ thuật số (tham khảo hình ảnh + bản thảo bằng miệng, lồng tiếng và phụ đề được tạo tự động, xem "Tường thuật và phụ đề" để biết chi tiết). Mỗi phương pháp viết của năm chế độ đều có trọng tâm riêng, chúng tôi sẽ thảo luận từng cái một bên dưới. Tất cả các chế độ đều tuân theo cùng một bộ giới hạn: khoảng 16 yêu cầu/phút, tối đa 720p và tối đa 20 giây cho một cảnh quay.
Năm chế độ, năm cách viết
Mỗi chế độ nhấn mạnh một trọng tâm khác nhau.
Văn bản→video (một đoạn)
Một đoạn mô tả trực tiếp hình ảnh: chủ thể, hành động, bối cảnh, ánh sáng. Viết như lời thuyết minh, chỉ dùng từ có thể vẽ thành hình. Để khóa chủ thể, bạn có thể đính kèm ảnh tham chiếu (ảnh→video).
Ví dụ: văn bản đơn giảnVideo dài sáng tạo (nhiều cảnh)
Đưa cốt truyện một câu + danh sách cảnh cho từng phân cảnh: thời gian, nơi chốn, nhân vật, hành động, không khí. Model dựng từng cảnh rồi nối lại.
Ví dụ: video dài sáng tạoVideo bản thảo (dài)
Dán toàn bộ bài viết hoặc bản thảo: AI chia theo thời gian đọc, tạo hình ảnh cho từng phần, rồi thêm lồng tiếng và phụ đề thống nhất trước khi ghép. Hợp cho video giải thích và nội dung khóa học.
Ví dụ: video bản thảoVideo thơ
Nhập một bài thơ, AI chia từng câu: câu thơ gốc được đọc và phụ đề, hình ảnh được tạo theo ý từng câu rồi ghép thành phim ngắn đậm chất thơ. Thích hợp cho thơ cổ và hoạt hình theo ý thơ.
Ví dụ: video thơNgười dẫn chương trình
Chân dung tham chiếu + kịch bản đọc. Gương mặt do ảnh quyết định, giọng điệu do kịch bản; lồng tiếng và phụ đề tự động. Hợp thuyết minh, giảng dạy, giới thiệu sản phẩm.
Ví dụ: người dẫn chương trìnhĐiểm chung khi viết prompt
Viết cụ thể
Biến từ trừu tượng thành hình ảnh có thể vẽ. Không nói «cô gái xinh đẹp», mà nói «cô gái váy đỏ xoay nhẹ trên sân ga đẫm mưa».
Một câu một cảnh
Tách cảnh và nhịp bằng dấu chấm, chấm phẩy; một câu một hành động. Đừng dồn ba sự kiện vào một câu.
Nêu rõ ánh sáng và máy quay
Ghi nguồn sáng, tương phản, độ sâu trường ảnh, góc máy (ánh sáng ấm, độ sâu nông, máy cầm tay). Ánh sáng đúng thì chất lượng tăng rõ rệt.
Đặt một câu định phong cách
Mở đầu bằng một câu khóa toàn bộ phong cách: «neon cyberpunk», «tranh thủy mặc». Phong cách ổn định giúp các cảnh sau khớp nhau.
Sai lầm thường gặp
- Một prompt chất nhiều cảnh
«nổ+đuổi+ tình» trong một câu — model chọn ngẫu nhiên và hình ảnh vỡ. Viết từng cảnh một.
- Chỉ viết tính từ
«đẹp, ấn tượng» là nhận xét, không phải chỉ dẫn. Hãy chuyển thành ánh sáng, bố cục, hành động và khung hình.
- Quên sự nhất quán của chủ thể
Khuôn mặt nhân vật thay đổi giữa các cảnh là vì chủ thể chưa được khóa. Hãy dùng ảnh tham chiếu hoặc lặp lại các đặc điểm.
Thử ngay trong Demo
Viết một câu theo gợi ý và dán vào Demo để tạo video ngay. Miễn phí.
Mở demo →Prompt-Methodology References
The prompt-writing approaches here are grounded in the following model technical reports and prompt-engineering guides.
- VideoPoet: A Large Language Model for Zero-Shot Video GenerationGoogle Research · arXiv:2312.14125 (2023)
The VideoPoet paper demonstrates the sensitivity of LLM-driven video generation to prompt structure, providing academic grounding for the prompt tips on this page.
- Sora: Video Generation Model Technical ReportOpenAI · OpenAI Technical Report (2024)
OpenAI's Sora technical report details how prompt engineering affects video quality, including best practices for camera language and physical descriptions.
- OpenAI Prompt Engineering Guide — 提示词工程最佳实践OpenAI · OpenAI Docs (2025)
OpenAI's official prompt-engineering guide offers general methods — be specific, step-by-step, constrained — consistent with this page's tips.
Vì sao bạn có thể tin nội dung này
Bài viết này được viết bởi những người hành nghề tuyến đầu. Khi viết, họ đã kiểm tra chéo các nguồn trực tiếp như bài báo arXiv, báo cáo kỹ thuật của nhà sản xuất và Chỉ số AI Stanford, chứ không phải kết luận dựa trên ấn tượng chủ quan.
SandGrid@lcy362
Tác giả Agnes Video Generator · Lập trình viên Full-stack
Nhà phát triển độc lập và tác giả của công cụ tạo Video AI mã nguồn mở Agnes Video Generator. Dự án dựa trên mô hình video hoàn toàn miễn phí của Agnes AI và giao thức MIT mã nguồn mở. Nó đã giúp hơn 1.000 người sáng tạo sản xuất video AI với chi phí 0. Tôi đã tập trung vào kỹ thuật và phổ biến các mô hình tạo video trong một thời gian dài. Nội dung của các bài viết đều đến từ thực tiễn tuyến đầu và nghiên cứu trực tiếp.
Xem trên GitHubCập nhật lần cuối:2026-08-21
Sẵn sàng bắt đầu sáng tạo?
“Hãy để AI đẳng cấp thế giới thuộc về tất cả mọi người” – Bruce Yang. Hoàn toàn miễn phí, không cần thẻ tín dụng hay card đồ họa hiệu suất cao, tạo video AI đầu tiên của bạn với chi phí 0. Bạn muốn sử dụng mô hình video miễn phí của Agnes AI? Bắt đầu từ đây.
Clone kho GitHub và khởi chạy trong 2 phút