2.0 — 3パイプラインアーキテクチャ + 多言語Web UI
3パイプラインアーキテクチャ + 多言語Web UI
新機能
新機能と改善
- 共通基盤を持つ3つのタスクタイプ — シンプル動画(単一プロンプト→Agnes Video APIで1本の動画、
t2v/i2v/ti2vid/keyframes)、クリエイティブ動画(AI脚本家→ストーリーボード→シーン別動画→edge_ttsナレーション→細かな字幕→連結)、原稿動画(長文分割→AIシーンプロンプト→セグメント別動画→統合TTS+字幕→連結)。 - 多言語Web UI — 3タブのシングルページフロントエンド(シンプル/クリエイティブ/原稿)。i18nは 中文 / English / Русский / 日本語 / 한국어 / Bahasa Melayu / Bahasa Indonesia に対応。
- リアルタイム進捗 — WebSocketでパイプラインの進捗をプッシュ。タスクの一時停止・再開・停止に対応。
- きめ細かい字幕システム — edge_ttsのタイムスタンプに基づく語単位のSRTグルーピング、CJK複数行折り返し、
method="caption"レンダリング(ストローク/背景/位置をカスタマイズ可能)。
リファクタリングと最適化
- 4層アーキテクチャ —
core/api(Agnes Chat/Image/Videoラッパー、リトライ+ポーリング)、core/audio(edge_tts + SRT + moviepyオーバーレイ)、core/compositor(連結/スケーリング/フレーム抽出)、core/pipelines(3つのパイプライン実装)。 - Pydantic v2データモデル — 永続状態のシリアライズと後方互換のタスク読み込みを持つ型付きタスクサブクラス。
- 2フェーズ原稿生成 — ビデオ生成のA/B分割により並列化し、完了を高速化。
バグ修正
- 字幕の
bg_color/positionのMoviePy 2.x互換対応。TTS音量を自動ブースト。 - 旧タスク向けCJKフォントフォールバック。信頼性の高いレンダリングのためフォントを同梱。
- ビデオフレーム上限をAgnes APIの制限(720pで409)に合わせ、一時的な失敗は自動リトライ。
- 原稿パイプラインで単一の連続TTS + SRTを使用し、セグメントごとのパディングずれを解消。
- 互換性/設定変更の注意:v1.0の
start.shワンクリック起動にvenv作成と依存関係インストールを内蔵。アップグレード後の初回起動で環境が自動準備されます。
Agnes Video Generator について
完全無料・オープンソースの AI 動画生成ツール。テキストをナレーションと字幕付きの複数シーン AI 動画に変換できます。
- 完全無料・オープンソース、高性能 GPU 不要
- テキストから動画、画像から動画、デジタルアンカー、画像生成に対応
- 無料の Agnes AI モデルを使用、動画はすべてクラウドで生成
- Web UI・Docker・npm で起動でき、セルフホストも可能
関連ページ
リリースノート
Agnes Video Generator のバージョン履歴:各バージョンの新機能・改善・不具合修正。
オンラインデモ | Agnes Video
プロンプトを入力してAI動画・画像を生成
テキスト動画API — 無料AI動画生成API | Agnes Video
Agnes AI 無料ビデオ モデルのプログラム呼び出し: テキストからビデオ、画像からビデオ、ナレーション生成など、リクエスト パラメータ、ベアラー認証、タスク ステータス ポーリング、完全なコード サンプル (Python/cURL/HTTP) を含む REST API の完全なカバレッジ。開発者に優しく、コストがゼロで、高性能ビデオカードを必要とせずにアクセスできます。
信頼性について
この記事は第一線の実践者によって書かれており、主観的な印象による結論ではなく、arXiv論文、メーカー技術報告書、Stanford AI Indexなどの一手のソースをクロスチェックして書いています。
S
SandGrid@lcy362
Agnes Video Generator 開発者 · フルスタックエンジニア
オープンソースAIビデオ生成ツール「Agnes Video Generator」の著者、インディーズ开発者。プロジェクトはAgnes AIの完全に無料のビデオモデルに基づいており、MITプロトコルはオープンソースで、すでに1,000人以上のクリエイターがゼロコストでAIビデオを生産したことがある。長期にわたってビデオ生成モデルのエンジニアリングと普及に注目しており、記事の内容はすべて第一線の実践と一手の研究から来ています。
GitHub で見る最終更新:2026-08-21