4.6.0 — 詩動画タスクタイプ + マルチシーンパイプラインのリファクタリング

詩動画タスクタイプ + マルチシーンパイプラインのリファクタリング

マイナーリリース日 2026年7月12日GitHub で見る

新機能

新機能と改善

  • 詩動画タスクタイプ — 新設の POST /api/tasks/poetry: LLMが詩を複数のシーン(原句 | 映像の説明形式)に分割し、各行をTTSナレーションで読み上げ、シーンをt2vクリップとして生成、字幕をナレーションに時間同期して連結します。
  • 詩のシーン設定をクリエイティブ動画に整合 — シーンごとの所要時間モデルと所要時間抽出モード。シーン数/ウォーターマーク/ナレーション速度のオプション。
  • 2フェーズの詩生成 — シーンを一括送信し並列待機、より速く完了。

リファクタリングと最適化

  • MultiScenePipelineベースクラス — クリエイティブ/原稿/アンカー/詩の長尺動画パイプラインが単一のテンプレートメソッドベース(build_scenes → build_reference_images → generate_videos → audio+subtitle → composite)を共有し、パイプラインごとの重複ロジックを排除。
  • 詩の生成が基本ジェネレーターを再利用 — 動画生成を MultiScenePipeline._generate_videos に引き上げ。

バグ修正

  • 詩動画でシーンごとのTTS音声が途中で切れる(前半しか聞こえない)。
  • 再開時に音声トラックのない古い final_clip.mp4 を再利用していた。
  • 詩の進捗ステップインジケーターが表示されない。
  • switchTaskType の閉じ波括弧がなく、ページ全体のJSが無効になっていた。

Agnes Video Generator について

完全無料・オープンソースの AI 動画生成ツール。テキストをナレーションと字幕付きの複数シーン AI 動画に変換できます。

  • 完全無料・オープンソース、高性能 GPU 不要
  • テキストから動画、画像から動画、デジタルアンカー、画像生成に対応
  • 無料の Agnes AI モデルを使用、動画はすべてクラウドで生成
  • Web UI・Docker・npm で起動でき、セルフホストも可能

関連ページ

信頼性について

この記事は第一線の実践者によって書かれており、主観的な印象による結論ではなく、arXiv論文、メーカー技術報告書、Stanford AI Indexなどの一手のソースをクロスチェックして書いています。

S

SandGrid@lcy362

Agnes Video Generator 開発者 · フルスタックエンジニア

オープンソースAIビデオ生成ツール「Agnes Video Generator」の著者、インディーズ开発者。プロジェクトはAgnes AIの完全に無料のビデオモデルに基づいており、MITプロトコルはオープンソースで、すでに1,000人以上のクリエイターがゼロコストでAIビデオを生産したことがある。長期にわたってビデオ生成モデルのエンジニアリングと普及に注目しており、記事の内容はすべて第一線の実践と一手の研究から来ています。

GitHub で見る

最終更新2026-08-21

作成を始めますか?

「世界クラスの AI をすべての人のものにしましょう。」 - Bruce Yang完全に無料で、クレジットカードも高性能グラフィックスカードも必要なく、ゼロコストで初めてのAIビデオを作成できます。Agnes AIの無料動画モデルを使いたいですか?ここから始めてください。

GitHubリポジトリをクローンして2分で起動