6.0.0 — マニュアルモード:各チェックポイントで一時停止・調整・再開
マニュアルモード:各チェックポイントで一時停止・調整・再開
新機能
マニュアルモード(人介入チェックポイント)
- チェックポイントでの一時停止 — パイプラインは成果物生成後にチェックポイントで停止し、操作を待って、最後に確認した段階から続行します。
- 細かい一時停止ポイント(クリエイティブ) — 最大10段階:画像分析、ストーリー、脚本とナレーション、キャラクター参照、最終フレーム用プロンプト、最終フレーム生成、動画、音声、字幕、最終合成。
- 標準の一時停止ポイント(原稿 / 詩 / アバター) — 6段階:シーン、参照、動画、音声、字幕、最終。
- デフォルトの一時停止ポイントを事前入力 — 作成時にタスク種別ごとに自動入力(編集可能;未チェックのチェックポイントは自動通過)。
- 未対応 — シンプル(単発)動画と単純な画像タスクは、完了時に成果物リストのみ表示します。
成果物を仕上げる4つの方法
- 🤖 AI支援編集 — 変更内容を説明する(例:「シーン2をもっと映画的に」)と、内蔵モデルが成果物を書き直します。適用前に差分を確認できます。
- ✏️ ローカル編集 — 成果物のパスをコピーしてファイルを直接編集(JSON / SRT / 画像 / 動画)し、「変更済み、続行」をクリック。
- 🤝 外部エージェント — 既製の協業プロンプトをコピーし、より高性能なローカルエージェント(例:opencode / CodeBuddy CLI / ffmpeg / PIL)に成果物を渡し、結果を書き戻します。
- 💻 オンライン編集 — ページ内ダイアログでテキスト成果物(脚本 / ナレーション / 字幕)を編集し、原文と並べて比較できます。
成果物レベルの依存関係グラフ(変更分のみ再実行)
- ナレーション編集 → 音声 / 字幕 / 最終合成のみ再実行。
- シーン説明の編集 → 参照画像 / 動画 / 最終合成のみ再実行。
- 「変更前」プロンプトで、どの成果物が再生成され、どれが保持されるかを正確に一覧表示。
自動と手動をいつでも切り替え
- 実行中の自動タスクを手動に切り替える — 次の安全なチェックポイントで一時停止します。
- 一時停止中の手動タスクを自動に戻す — 一時停止ポイントがクリアされ、最後まで直接実行します。
その他の機能と改善
- 専用のタスク進捗ページ — ステップのタイムラインとリアルタイムステータスを備えた全画面の進捗ビュー。
- タスク詳細ページ — 新規タブで開き、公式サイトへのリンクとサポート案内を表示。
- プロジェクトカードのピン留め — タスクカードをリスト上部に固定;成果物プレビューは自動展開。
- 各一時停止ポイントの「変更せず続行」ボタン — どのチャネルでもレビューをスキップ。
- バイリンガル起動スクリプト — プロンプトがシステムロケールに適応。
- 完全な22言語対応 — 不足していた翻訳を補完し、リリース回帰ゲートとして言語完全性チェッカーを追加、タスク進捗ヘッダーに言語切替を実装。
リファクタリングと最適化
- パイプライン横断の統一チェックポイント機構 — 同じMultiScenePipelineチェックポイントシステムが、クリエイティブ / 原稿 / 詩 / アバターのタスクを型別の成果物マトリクスで支えます。
- 独立した成果物依存関係グラフ —
core/dependency_graph.pyは純粋な宣言型エッジテーブルモジュール(製品レベル+パラメータレベル)で、影響予測、承認処理、フロントエンドのハイライトで共有され、ユニットテスト済み。 - 標準化された成果物マニフェスト — チェックポイントごとの
checkpoint.jsonリストとタスクディレクトリのMANIFEST.mdにより、すべての中間成果物を検出・読み取り・再入力可能に。 - 再開時に完了済みのシーン構築ステップをスキップ — クリエイティブ / アバター / 詩タスク再開時のLLM重複呼び出しを回避。
バグ修正
- チェックポイント成果物のフィールド名不一致による「編集ウィンドウを開く」ボタンがクリックできない問題を修正。
- 複数PIDのポート使用中ヒントを修正し、killコマンドを1行でコピー可能に。
- 進捗制御フローの修正 — 再開後すぐに一時停止UIをクリアし、待機中/実行中タスクがリアルタイムで進捗メッセージを表示。
- キャラクター参照画像の生成を参照段階に移動し、順序を正しく。
- マニュアルモードUIの磨き込み — 無効状態の可視化、成果物フィルタ互換性、初期段階の自動折りたたみ、非アクティブな未完了タスクの再開。
Agnes Video Generator について
完全無料・オープンソースの AI 動画生成ツール。テキストをナレーションと字幕付きの複数シーン AI 動画に変換できます。
- 完全無料・オープンソース、高性能 GPU 不要
- テキストから動画、画像から動画、デジタルアンカー、画像生成に対応
- 無料の Agnes AI モデルを使用、動画はすべてクラウドで生成
- Web UI・Docker・npm で起動でき、セルフホストも可能
関連ページ
リリースノート
Agnes Video Generator のバージョン履歴:各バージョンの新機能・改善・不具合修正。
オンラインデモ | Agnes Video
プロンプトを入力してAI動画・画像を生成
テキスト動画API — 無料AI動画生成API | Agnes Video
Agnes AI 無料ビデオ モデルのプログラム呼び出し: テキストからビデオ、画像からビデオ、ナレーション生成など、リクエスト パラメータ、ベアラー認証、タスク ステータス ポーリング、完全なコード サンプル (Python/cURL/HTTP) を含む REST API の完全なカバレッジ。開発者に優しく、コストがゼロで、高性能ビデオカードを必要とせずにアクセスできます。
信頼性について
この記事は第一線の実践者によって書かれており、主観的な印象による結論ではなく、arXiv論文、メーカー技術報告書、Stanford AI Indexなどの一手のソースをクロスチェックして書いています。
S
SandGrid@lcy362
Agnes Video Generator 開発者 · フルスタックエンジニア
オープンソースAIビデオ生成ツール「Agnes Video Generator」の著者、インディーズ开発者。プロジェクトはAgnes AIの完全に無料のビデオモデルに基づいており、MITプロトコルはオープンソースで、すでに1,000人以上のクリエイターがゼロコストでAIビデオを生産したことがある。長期にわたってビデオ生成モデルのエンジニアリングと普及に注目しており、記事の内容はすべて第一線の実践と一手の研究から来ています。
GitHub で見る最終更新:2026-08-21