手动模式使用说明
在视频生成的检查点暂停,确认或修改产物后再继续——自动随性生成,手动精准出片。
Agnes Video Generator 新增了手动模式:默认的自动模式一次跑完整个流水线,适合「给个思路随性生成」;手动模式则会在你选择的检查点暂停,让你确认、修改或重新生成中间产物后再继续,适合有明确输出预期的创作,还能借助更强的外部 AI 或其他工具强化输出效果。
自动模式 vs 手动模式
两种模式共用同一套流水线,区别只在要不要中途停下来检查:
自动模式
vibe video generating输入创意后一次跑完整个流水线:分镜 → 参考图 → 视频 → 配音 → 字幕 → 成片,全程无需干预。
- ✓适合提供思路、随性生成(vibe video generating)
- ✓零操作成本,一键出片
- ✓结果有一定随机性,适合探索创意
手动模式
precise output在检查点暂停,确认或修改每个阶段的产物后再继续。可以微调分镜、润色旁白、修正字幕、精修片段,甚至把产物交给更强的外部 AI 或工具处理后回填。
- ✓适合有明确输出预期的成片
- ✓每个环节都可预览、可修改、可重新生成
- ✓可配合更强的外部 AI / ffmpeg / PIL 等工具
手动模式在哪里暂停
暂停点按任务类型不同:创意长视频(creative)支持细粒度暂停点——每个有产物的环节都可暂停;稿件、诗词、数字人等其余类型使用常规暂停点。创建任务时可勾选要暂停的点:
细粒度暂停点(创意长视频)
- 1
图片分析 image_analysis
分析参考图与尾帧图
- 2
故事 story
生成故事剧情
- 3
脚本 script
生成分镜脚本与旁白
- 4
角色参考图 character_ref
生成角色参考图
- 5
尾帧提示词 end_frame_prompts
生成每个场景的尾帧提示词
- 6
尾帧图 end_frame_gen
预生成尾帧图
- 7
视频片段 videos
预览并精修每个场景的视频片段
- 8
配音 audio
试听配音,可先润色旁白再重新合成
- 9
字幕 subtitle
检查字幕时间轴与断句
- 10
合成 final
确认最终合成的成片
常规暂停点(稿件 / 诗词 / 数字人)
- 1
分镜 scenes
确认或优化分镜脚本、画面描述与旁白文本
- 2
参考图 references
检查角色参考图(数字人主播)
- 3
视频片段 videos
预览并精修每个场景的视频片段
- 4
配音 audio
试听配音,可先润色旁白再重新合成
- 5
字幕 subtitle
检查字幕时间轴与断句
- 6
合成 final
确认最终合成的成片
默认暂停点
创建任务时按任务类型自动预填默认暂停点(可增删,未勾选的自动通过):
- →创意长视频:故事、脚本、角色参考图、视频片段、字幕
- →稿件 / 诗词:分镜、视频片段、字幕
- →数字人主播:分镜、视频片段
不支持手动模式的场景
文生视频(单段)与简单图片类型不支持手动模式(仅完成后展示产物清单)。
四种产物处理方式
每个检查点暂停后,可以任选一种方式处理当前产物:
🤖 AI 帮我改
输入修改要求(如「第二幕更电影感」),系统调用模型直接修改,查看 diff 后应用。
✏️ 我自己改
复制产物路径,在本地直接编辑(JSON / 字幕 / 图片 / 视频),改完点「已修改,继续」。
💻 在线编辑
在网页弹窗内直接编辑文本类产物(分镜 / 旁白 / 字幕),可随时与原内容对比,保存后继续。
只重跑受影响的步骤
修改产物后,系统按产物级依赖图精准重跑:改旁白 → 只重跑配音/字幕/成片;改画面描述 → 只重跑参考图/视频/成片。不受影响的产物原样保留,不浪费。
运行中可随时切换
自动任务运行中可一键切为手动(在下一个安全点暂停);手动任务暂停中可切回自动(清空暂停点立即跑完)。
怎么选:自动还是手动?
没有标准答案,只有适合与否:
- →想快速出片、探索灵感 → 自动模式,随性生成
- →有明确画面/风格/口播预期 → 手动模式,逐环节微调产物
- →想让成片超出模型默认水平 → 手动模式 + 更强的外部 AI 或工具
开始创作
在线 Demo 使用自动模式;手动模式是桌面版功能,下载后在创建任务时选择「手动」即可体验检查点暂停。
相关页面
快速上手:免费 AI 视频生成使用指南
从拿免费 API Key 到生成第一条 AI 视频,这份快速上手指南手把手带你走完:注册拿密钥、填进页面、写提示词、选模式和时长、等渲染、下载成片。全程不用付费、不需要高性能显卡,几分钟上手,零技术背景也能行。
Agnes Video Generator 自托管部署教程 — 手动/Docker/npm/AI Agent | 免费 AI 视频
把免费开源的 AI 视频生成器跑在自己的电脑或服务器上:start.sh 手动部署、Docker 一条命令、npm CLI、AI Agent 辅助共四种方式,含完整命令、系统要求与环境变量说明,轻松自托管。
旁白与字幕:给 AI 视频加配音和字幕
数字人口播模式自带 TTS 配音和口型对齐,输入文案直接出片,不用额外处理;普通文生视频可以通过主流剪辑工具自己加字幕。本文讲清各模式的配音字幕能力、具体设置步骤和成片效果对比,帮你快速做出带解说的完整视频。
项目与文档依据
手动模式的检查点、智能重跑等机制说明,以本项目官方仓库与 API 文档为准。
- agnes-video-generator — 开源 AI 视频生成项目lcy362 · GitHub (2026)
手动/自动模式的实现与使用说明,以开源仓库 README 与源码为准。
- Agnes AI Open API — 视频 / 图片生成接口Agnes AI · apihub.agnes-ai.com (2026)
各检查点对应的生成接口(视频/图片/配音/字幕)契约,见 Agnes 开放 API 文档。
- opencode — 开源 AI 编程助手SST / opencode 社区 · opencode.ai (2025)
「外部 Agent」通道推荐的 opencode 为开源工具,其能力以官方文档为准。
内容可信度说明
本文由一线实践者撰写,写的时候交叉核对了 arXiv 论文、厂商技术报告和 Stanford AI Index 等一手来源,不是凭主观印象下的结论。
SandGrid@lcy362
Agnes Video Generator 项目作者 · 全栈开发者
独立开发者,开源 AI 视频生成工具 Agnes Video Generator 的作者。项目基于 Agnes AI 完全免费的视频模型,MIT 协议开源,已经帮 1,000+ 创作者零成本产出过 AI 视频。长期关注视频生成模型的工程化和普及,文章内容都来自一线实践和一手研究。
访问 GitHub最后更新:2026-08-21