4.6.0 — 诗词视频任务类型 + 多场景管线重构
诗词视频任务类型 + 多场景管线重构
更新内容
新功能与改进
- 诗词视频任务类型 — 新增
POST /api/tasks/poetry:LLM 把一首诗拆分为多个场景(原句 | 画面描述格式),每句由 TTS 旁白朗读,场景以 t2v 片段生成,字幕与旁白时间对齐后拼接。 - 诗词场景配置对齐创意视频 — 每场景时长模型和时长提取模式;场景数/水印/旁白语速选项。
- 两阶段诗词生成 — 场景批量提交并并行等待,完成更快。
重构与优化
- MultiScenePipeline 基类 — 创意/稿件/数字人/诗词长视频管线共享一个模板方法基类(
build_scenes → build_reference_images → generate_videos → audio+subtitle → composite),消除各管线重复逻辑。 - 诗词生成复用基础生成器 — 视频生成上移到
MultiScenePipeline._generate_videos。
Bug 修复
- 诗词视频中每场景 TTS 音频截断(只有前半段可听)。
- 续跑复用了没有音轨的过期
final_clip.mp4。 - 诗词进度步骤指示器未显示。
switchTaskType缺少闭合大括号,导致整页 JS 失效。
关于 Agnes Video Generator
完全免费、开源的 AI 视频生成器:输入文字即可生成带旁白与字幕的多镜头 AI 视频。
- 完全免费开源,无需付费与高性能显卡
- 支持文字转视频、图片转视频、数字人口播、文生图
- 基于 Agnes AI 免费模型,视频全部在云端生成
- Web UI、Docker、npm 多种运行方式,支持自托管
相关页面
内容可信度说明
本文由一线实践者撰写,写的时候交叉核对了 arXiv 论文、厂商技术报告和 Stanford AI Index 等一手来源,不是凭主观印象下的结论。
S
SandGrid@lcy362
Agnes Video Generator 项目作者 · 全栈开发者
独立开发者,开源 AI 视频生成工具 Agnes Video Generator 的作者。项目基于 Agnes AI 完全免费的视频模型,MIT 协议开源,已经帮 1,000+ 创作者零成本产出过 AI 视频。长期关注视频生成模型的工程化和普及,文章内容都来自一线实践和一手研究。
访问 GitHub最后更新:2026-08-21