4.6.0 — 詩動画タスクタイプ + マルチシーンパイプラインのリファクタリング
詩動画タスクタイプ + マルチシーンパイプラインのリファクタリング
新機能
新機能と改善
- 詩動画タスクタイプ — 新設の
POST /api/tasks/poetry: LLMが詩を複数のシーン(原句 | 映像の説明形式)に分割し、各行をTTSナレーションで読み上げ、シーンをt2vクリップとして生成、字幕をナレーションに時間同期して連結します。 - 詩のシーン設定をクリエイティブ動画に整合 — シーンごとの所要時間モデルと所要時間抽出モード。シーン数/ウォーターマーク/ナレーション速度のオプション。
- 2フェーズの詩生成 — シーンを一括送信し並列待機、より速く完了。
リファクタリングと最適化
- MultiScenePipelineベースクラス — クリエイティブ/原稿/アンカー/詩の長尺動画パイプラインが単一のテンプレートメソッドベース(
build_scenes → build_reference_images → generate_videos → audio+subtitle → composite)を共有し、パイプラインごとの重複ロジックを排除。 - 詩の生成が基本ジェネレーターを再利用 — 動画生成を
MultiScenePipeline._generate_videosに引き上げ。
バグ修正
- 詩動画でシーンごとのTTS音声が途中で切れる(前半しか聞こえない)。
- 再開時に音声トラックのない古い
final_clip.mp4を再利用していた。 - 詩の進捗ステップインジケーターが表示されない。
switchTaskTypeの閉じ波括弧がなく、ページ全体のJSが無効になっていた。
Agnes Video Generator について
完全無料・オープンソースの AI 動画生成ツール。テキストをナレーションと字幕付きの複数シーン AI 動画に変換できます。
- 完全無料・オープンソース、高性能 GPU 不要
- テキストから動画、画像から動画、デジタルアンカー、画像生成に対応
- 無料の Agnes AI モデルを使用、動画はすべてクラウドで生成
- Web UI・Docker・npm で起動でき、セルフホストも可能
関連ページ
リリースノート
Agnes Video Generator のバージョン履歴:各バージョンの新機能・改善・不具合修正。
オンラインデモ | Agnes Video
プロンプトを入力してAI動画・画像を生成
テキスト動画API — 無料AI動画生成API | Agnes Video
Agnes AI 無料ビデオ モデルのプログラム呼び出し: テキストからビデオ、画像からビデオ、ナレーション生成など、リクエスト パラメータ、ベアラー認証、タスク ステータス ポーリング、完全なコード サンプル (Python/cURL/HTTP) を含む REST API の完全なカバレッジ。開発者に優しく、コストがゼロで、高性能ビデオカードを必要とせずにアクセスできます。
信頼性について
この記事は第一線の実践者によって書かれており、主観的な印象による結論ではなく、arXiv論文、メーカー技術報告書、Stanford AI Indexなどの一手のソースをクロスチェックして書いています。
S
SandGrid@lcy362
Agnes Video Generator 開発者 · フルスタックエンジニア
オープンソースAIビデオ生成ツール「Agnes Video Generator」の著者、インディーズ开発者。プロジェクトはAgnes AIの完全に無料のビデオモデルに基づいており、MITプロトコルはオープンソースで、すでに1,000人以上のクリエイターがゼロコストでAIビデオを生産したことがある。長期にわたってビデオ生成モデルのエンジニアリングと普及に注目しており、記事の内容はすべて第一線の実践と一手の研究から来ています。
GitHub で見る最終更新:2026-08-21