3.0.0 — سب ٹائٹل اور نریٹر آزاد کنٹرول + AI سب ٹائٹل اسٹائلنگ + ڈیجیٹل اینکر + امیج جنریشن

سب ٹائٹل اور نریٹر آزاد کنٹرول + AI سب ٹائٹل اسٹائلنگ + ڈیجیٹل اینکر + امیج جنریشن

بڑاتاریخ اجرا 21 جون، 2026GitHub پر دیکھیں

نیا کیا ہے

خصوصیات اور بہتری

  • سب ٹائٹل اور نریٹر آزاد کنٹرولSubtitleConfig کو AudioConfig کے ہم پلہ بنایا گیا، ہر ایک کا اپنا enabled سوئچ; چار امتزاج موڈ (نریٹر+سب ٹائٹل، صرف نریٹر، صرف سب ٹائٹل، خاموش); تخلیقی اور مخطوطہ اینڈ پوائنٹس پر نیا subtitle_enabled پیرامیٹر۔
  • AI سے چلنے والی سب ٹائٹل اسٹائلنگ (LLM موڈ)style_mode "fixed" (عالمی انداز) یا "llm" (ہر سب ٹائٹل کی پوزیشن/رنگ/فونٹ سائز LLM طے کرتا ہے); style_hints قدرتی زبان کی رہنمائی قبول کرتا ہے ("اہم سطریں سرخ، خلاصے پیلے"); generate_subtitle_styles() تمام سب ٹائٹلز ایک کال میں LLM کو بھیجتا ہے اور سائیڈ کار subtitle_styles.json کے ذریعے رینڈر کرتا ہے۔
  • ڈیجیٹل اینکر (ڈیجیٹل انسان پیش کنندہ) ٹاسک کی قسم — t2i یا i2i (صارف کی اپ لوڈ کردہ حوالہ تصویر) کے ذریعے AI پیش کنندہ; مخطوطہ 5–12 سیکنڈ کے پیراگراف میں تقسیم ہوتا ہے، ہر ایک مختلف اشاروں/اظہار کے ساتھ منفرد i2v کلپ بناتا ہے; متحد TTS + LLM سے بہتر سب ٹائٹل اوورلے; آڈیو ماڈل سے یا جوڑنے کے بعد; POST /api/tasks/anchor۔
  • سادہ امیج جنریشن — نیا پانچواں ٹیب; ہلکا SimpleImageTask; سسٹم پرامپٹ سپورٹ; نتائج حاصل کرنے کے لیے GET /api/image/{id}۔
  • سسٹم پرامپٹ سپورٹ — سادہ ویڈیو اور امیج ٹاسکس کے لیے اختیاری سسٹم پرامپٹ، حتمی پرامپٹ سے پہلے شامل کیا جاتا ہے۔

ریفیکٹرنگ اور آپٹیمائزیشن

  • پائپ لائن مرحلے کی تقسیم — تخلیقی اور مخطوطہ پائپ لائنوں میں _step_audio_subtitle کی جگہ آزاد _step_audio + _step_subtitle نے لے لی۔
  • سب ٹائٹل رینڈرنگ میں بہتری — 0.3 سیکنڈ اوورلیپ کے ساتھ کثیر سطر ڈسپلے، 0.8 سیکنڈ ٹرانزیشن اوورلیپ، دو پاس extend-end ٹائمنگ، محفوظ مارجن اوور فلو تحفظ، بصری تنوع کے لیے LLM عمودی زون پوزیشننگ۔

بگ فکسز

  • subprocess.run اب stdin=DEVNULL شامل کرتا ہے، پس منظر کے عمل کو SIGTTIN پر لٹکنے سے روکتا ہے۔
  • SilentTTSEngine.generate() None → خالی dict لوٹاتا ہے، صرف سب ٹائٹل موڈ SRT جنریشن ٹھیک کرتا ہے۔
  • SRT ٹائم لائن تخمینی ویڈیو مدت کے بجائے حقیقی آڈیو مدت پر مبنی۔
  • امیج جنریشن ناکام ہونے پر مخصوص خرابی آؤٹ پٹ (HTTP status + body + traceback)۔
  • ڈیجیٹل اینکر پائپ لائن میں دفاعی UTF-8 انکوڈنگ فکس; حقیقی آڈیو مدت حاصل کرنے کے لیے TTS پہلے تیار ہوتا ہے۔

Agnes Video Generator کے بارے میں

مکمل طور پر مفت، اوپن سورس AI ویڈیو جنریٹر: متن کو وائس اوور اور سب ٹائٹلز کے ساتھ ملٹی سین AI ویڈیو میں تبدیل کریں۔

  • مکمل طور پر مفت اور اوپن سورس — کوئی ادائیگی نہیں، ہائی اینڈ GPU درکار نہیں
  • ٹیکسٹ ٹو ویڈیو، امیج ٹو ویڈیو، ڈیجیٹل اینکر اور امیج جنریشن
  • مفت Agnes AI ماڈلز پر چلتا ہے، ویڈیوز مکمل طور پر کلاؤڈ میں بنتی ہیں
  • Web UI، Docker یا npm سے چلائیں، سیلف ہوسٹنگ سپورٹ

متعلقہ صفحات

آپ اس پر کیوں بھروسہ کر سکتے ہیں

یہ مضمون فرنٹ لائن پریکٹیشنرز نے لکھا ہے ، اس نے فرسٹ ہینڈ ذرائع جیسے کہ arXiv پیپرز ، مینوفیکچررز کی تکنیکی رپورٹس ، اور اسٹینفورڈ AI انڈیکس کی جانچ پڑتال کی ہے ، اور ساپیکش تاثرات پر مبنی نتائج اخذ نہیں کیے ہیں۔

S

SandGrid@lcy362

Agnes Video Generator کے مصنف · فل اسٹیک ڈویلپر

آزاد ڈویلپر اور اوپن سورس AI ویڈیو جنریشن ٹول ایگنیس ویڈیو جنریٹر کے مصنف۔ یہ پروجیکٹ Agnes AI کے مکمل طور پر مفت ویڈیو ماڈل پر مبنی ہے اور MIT پروٹوکول کے ساتھ اوپن سورس ہے اس نے 1,000+ تخلیق کاروں کو صفر قیمت پر AI ویڈیوز تیار کرنے میں مدد کی ہے۔ ہم طویل عرصے سے ویڈیو جنریشن ماڈلز کی انجینئرنگ اور مقبولیت پر توجہ مرکوز کر رہے ہیں ، اور مضمون کا مواد فرنٹ لائن پریکٹس اور فرسٹ ہینڈ ریسرچ سے آتا ہے۔

GitHub پر دیکھیں

آخری اپ ڈیٹ2026-08-21

تخلیق شروع کرنے کے لیے تیار؟

"عالمی معیار کا AI ہر ایک کا ہو۔" - بروس یانگ۔ بالکل مفت ، کوئی کریڈٹ کارڈ یا اعلیٰ کارکردگی والے گرافکس کارڈ کی ضرورت نہیں ، صفر قیمت پر اپنی پہلی AI ویڈیو بنائیں۔ Agnes AI سے مفت ویڈیو ماڈل استعمال کرنا چاہتے ہیں ؟ یہاں سے شروع کرو.

GitHub ریپوزٹری کلون کریں اور 2 منٹ میں لانچ کریں