4.6.0 — 诗词视频任务类型 + 多场景管线重构

诗词视频任务类型 + 多场景管线重构

次版本发布于 2026年7月12日在 GitHub 查看

更新内容

新功能与改进

  • 诗词视频任务类型 — 新增 POST /api/tasks/poetry:LLM 把一首诗拆分为多个场景(原句 | 画面描述格式),每句由 TTS 旁白朗读,场景以 t2v 片段生成,字幕与旁白时间对齐后拼接。
  • 诗词场景配置对齐创意视频 — 每场景时长模型和时长提取模式;场景数/水印/旁白语速选项。
  • 两阶段诗词生成 — 场景批量提交并并行等待,完成更快。

重构与优化

  • MultiScenePipeline 基类 — 创意/稿件/数字人/诗词长视频管线共享一个模板方法基类(build_scenes → build_reference_images → generate_videos → audio+subtitle → composite),消除各管线重复逻辑。
  • 诗词生成复用基础生成器 — 视频生成上移到 MultiScenePipeline._generate_videos

Bug 修复

  • 诗词视频中每场景 TTS 音频截断(只有前半段可听)。
  • 续跑复用了没有音轨的过期 final_clip.mp4
  • 诗词进度步骤指示器未显示。
  • switchTaskType 缺少闭合大括号,导致整页 JS 失效。

关于 Agnes Video Generator

完全免费、开源的 AI 视频生成器:输入文字即可生成带旁白与字幕的多镜头 AI 视频。

  • 完全免费开源,无需付费与高性能显卡
  • 支持文字转视频、图片转视频、数字人口播、文生图
  • 基于 Agnes AI 免费模型,视频全部在云端生成
  • Web UI、Docker、npm 多种运行方式,支持自托管

相关页面

内容可信度说明

本文由一线实践者撰写,写的时候交叉核对了 arXiv 论文、厂商技术报告和 Stanford AI Index 等一手来源,不是凭主观印象下的结论。

S

SandGrid@lcy362

Agnes Video Generator 项目作者 · 全栈开发者

独立开发者,开源 AI 视频生成工具 Agnes Video Generator 的作者。项目基于 Agnes AI 完全免费的视频模型,MIT 协议开源,已经帮 1,000+ 创作者零成本产出过 AI 视频。长期关注视频生成模型的工程化和普及,文章内容都来自一线实践和一手研究。

访问 GitHub

最后更新2026-08-21

准备好开始创作了吗?

「让世界级的 AI 属于每一个人。」—— Bruce Yang。完全免费,不用信用卡,也不要高性能显卡,零成本做出你的第一支 AI 视频。想用 Agnes AI 的免费视频模型?从这里开始就行。

克隆 GitHub 仓库,两分钟即可启动