2.0 — معماری سه‌خط‌لوله + رابط کاربری وب چندزبانه

معماری سه‌خط‌لوله + رابط کاربری وب چندزبانه

اصلیمنتشر شده در ۲۶ خرداد ۱۴۰۵مشاهده در GitHub

چه چیز جدید است

ویژگی‌ها و بهبودها

  • سه نوع وظیفه با پایه‌های مشترک — ویدیوی ساده (یک پرامپت → یک ویدیو از طریق Agnes Video API، t2v/i2v/ti2vid/keyframes)، ویدیوی خلاقانه (فیلم‌نامه‌نویس هوش مصنوعی → استوری‌بورد → ویدیوی هر صحنه → روایت edge_tts → زیرنویس‌های دقیق → اتصال)، ویدیوی دست‌نویس (تقسیم متن بلند → پرامپت‌های صحنه هوش مصنوعی → ویدیوی هر بخش → TTS یکپارچه + زیرنویس → اتصال).
  • رابط کاربری وب چندزبانه — فرانت‌اند تک‌صفحه‌ای سه‌زبانه (ساده/خلاقانه/دست‌نویس) با i18n برای 中文 / English / Русский / 日本語 / 한국어 / Bahasa Melayu / Bahasa Indonesia.
  • پیشرفت بلادرنگ — WebSocket پیشرفت خط لوله را ارسال می‌کند؛ توقف، ادامه و متوقف‌کردن وظایف.
  • سیستم زیرنویس دقیق — گروه‌بندی SRT در سطح کلمه از زمان‌سنج‌های edge_tts، شکستن چندخطی CJK، رندر method="caption" با سفارشی‌سازی خط/پس‌زمینه/موقعیت.

بازسازی و بهینه‌سازی

  • معماری چهارلایهcore/api (پوشش‌دهنده‌های Agnes Chat/Image/Video با تلاش مجدد + نظرسنجی)، core/audio (edge_tts + SRT + لایه moviepy)، core/compositor (اتصال/تغییر مقیاس/استخراج فریم)، core/pipelines (سه پیاده‌سازی خط لوله).
  • مدل‌های داده Pydantic v2 — زیرکلاس‌های وظیفه تایپ‌شده با سریال‌سازی حالت پایدار و بارگذاری وظایف سازگار با نسخه‌های قبلی.
  • تولید دست‌نویس دو مرحله‌ای — تقسیم A/B تولید ویدیو برای موازی‌سازی و تکمیل سریع‌تر.

رفع اشکالات

  • سازگاری MoviePy 2.x برای bg_color/position زیرنویس؛ صدای TTS به‌صورت خودکار تقویت شد.
  • جایگزینی فونت CJK برای وظایف قدیمی؛ فونت‌های همراه برای رندر قابل اعتماد.
  • سقف فریم ویدیو مطابق محدودیت Agnes API (409 در 720p) با تلاش مجدد خودکار برای خرابی‌های موقت.
  • TTS + SRT پیوسته واحد برای خط لوله دست‌نویس، حذف انحراف پر کردن هر بخش.
  • یادآوری سازگاری/تغییر پیکربندی: شروع یک‌کلیکی start.sh نسخه v1.0 از قبل شامل ایجاد venv و نصب وابستگی‌هاست؛ پس از ارتقا، اولین اجرا محیط را خودکار آماده می‌کند.

درباره Agnes Video Generator

یک تولیدکننده ویدیوی هوش مصنوعی کاملاً رایگان و متن‌باز: متن را به ویدیوهای هوش مصنوعی چندصحنه‌ای با روایت و زیرنویس تبدیل کنید.

  • کاملاً رایگان و متن‌باز — بدون پرداخت، بدون GPU قدرتمند
  • متن به ویدیو، تصویر به ویدیو، مجری دیجیتال و تولید تصویر
  • مبتنی بر مدل‌های رایگان Agnes AI، ویدیوها کاملاً در ابر تولید می‌شوند
  • اجرا از طریق Web UI، Docker یا npm، پشتیبانی از میزبانی خود

صفحات مرتبط

چرا می‌توانید به این محتوا اعتماد کنید

این مقاله توسط یک پزشک خط مقدم نوشته شده است. هنگام نوشتن ، من منابع دست اولی مانند مقالات arXiv ، گزارش های فنی سازنده و شاخص هوش مصنوعی استنفورد را بررسی کردم و بر اساس نتیجه گیری ذهنی نبودم.

S

SandGrid@lcy362

نویسنده Agnes Video Generator · توسعه‌دهنده فول‌استک

توسعه دهنده مستقل و نویسنده ابزار تولید ویدیوی هوش مصنوعی منبع باز Agnes Video Generator. این پروژه مبتنی بر مدل ویدیویی کاملاً رایگان Agnes AI است و پروتکل MIT منبع باز است. این پروژه به 1000 خالق کمک کرده است تا ویدیوهای هوش مصنوعی را با هزینه صفر تولید کنند. من مدتهاست که به مهندسی و محبوبیت مدلهای تولید ویدئو توجه کردهام و محتوای مقاله از تمرین خط مقدم و تحقیقات دست اول میآید.

مشاهده در GitHub

آخرین به‌روزرسانی2026-08-21

آماده شروع خلاقیت هستید؟

«اجازه دهید هوش مصنوعی در سطح جهانی متعلق به همه باشد.» – بروس یانگ کاملاً رایگان ، بدون کارت اعتباری یا کارت گرافیک با کارایی بالا ، اولین ویدیوی هوش مصنوعی خود را با هزینه صفر بسازید. آیا می خواهید از مدل ویدیویی رایگان Agnes AI استفاده کنید ؟ فقط از اینجا شروع کن

مخزن GitHub را کلون کنید و در ۲ دقیقه راه‌اندازی کنید