3.0.0 — সাবটাইটেল ও ন্যারেটর স্বাধীন নিয়ন্ত্রণ + AI সাবটাইটেল স্টাইলিং + ডিজিটাল অ্যাংকর + ছবি তৈরি

সাবটাইটেল ও ন্যারেটর স্বাধীন নিয়ন্ত্রণ + AI সাবটাইটেল স্টাইলিং + ডিজিটাল অ্যাংকর + ছবি তৈরি

প্রধানপ্রকাশিত ২১ জুন, ২০২৬GitHub-এ দেখুন

নতুন কী আছে

ফিচার ও উন্নতি

  • সাবটাইটেল এবং ন্যারেটর স্বাধীন নিয়ন্ত্রণSubtitleConfig কে AudioConfig-এর সমকক্ষ করা হয়েছে, প্রতিটির নিজস্ব enabled সুইচ; চারটি সংমিশ্রণ মোড (ন্যারেটর+সাবটাইটেল, শুধু ন্যারেটর, শুধু সাবটাইটেল, নীরব); ক্রিয়েটিভ এবং পাণ্ডুলিপি এন্ডপয়েন্টে নতুন subtitle_enabled প্যারামিটার।
  • AI-চালিত সাবটাইটেল স্টাইলিং (LLM মোড)style_mode "fixed" (গ্লোবাল স্টাইল) বা "llm" (প্রতিটি সাবটাইটেলের অবস্থান/রং/ফন্ট সাইজ LLM ঠিক করে); style_hints স্বাভাবিক ভাষা নির্দেশনা নেয় ("মূল লাইন লাল, সারাংশ হলুদ"); generate_subtitle_styles() সব সাবটাইটেল এক কলেই LLM-এ পাঠায় এবং সাইডকার subtitle_styles.json দিয়ে রেন্ডার করে।
  • ডিজিটাল অ্যাংকর (ডিজিটাল মানব উপস্থাপক) টাস্ক টাইপ — t2i বা i2i (ব্যবহারকারীর আপলোড করা রেফারেন্স ফটো) দিয়ে AI উপস্থাপক; পাণ্ডুলিপি 5–12 সেকেন্ডের অনুচ্ছেদে ভাগ হয়, প্রতিটি ভিন্ন অঙ্গভঙ্গি/অভিব্যক্তি সহ অনন্য i2v ক্লিপ তৈরি করে; একীভূত TTS + LLM-অপ্টিমাইজড সাবটাইটেল ওভারলে; অডিও মডেল থেকে বা জোড়ার পরে; POST /api/tasks/anchor
  • সাধারণ ছবি তৈরি — নতুন পঞ্চম ট্যাব; হালকা SimpleImageTask; সিস্টেম প্রম্পট সমর্থন; ফলাফল পেতে GET /api/image/{id}
  • সিস্টেম প্রম্পট সমর্থন — সাধারণ ভিডিও ও ছবি টাস্কের জন্য ঐচ্ছিক সিস্টেম প্রম্পট, চূড়ান্ত প্রম্পটের আগে যুক্ত হয়।

রিফ্যাক্টরিং ও অপ্টিমাইজেশন

  • পাইপলাইন ধাপ বিভাজন — ক্রিয়েটিভ ও পাণ্ডুলিপি পাইপলাইনে _step_audio_subtitle স্বাধীন _step_audio + _step_subtitle দিয়ে প্রতিস্থাপিত হয়েছে।
  • সাবটাইটেল রেন্ডারিং উন্নতি — 0.3 সেকেন্ড ওভারল্যাপসহ বহু-লাইন প্রদর্শন, 0.8 সেকেন্ড ট্রানজিশন ওভারল্যাপ, দুই-পাস extend-end টাইমিং, নিরাপদ-মার্জিন ওভারফ্লো সুরক্ষা, ভিজ্যুয়াল বৈচিত্র্যের জন্য LLM উল্লম্ব-জোন অবস্থান।

বাগ ফিক্স

  • subprocess.run-এ stdin=DEVNULL যোগ করা হয়েছে, ব্যাকগ্রাউন্ড প্রসেসকে SIGTTIN-এ আটকে যাওয়া থেকে রোধ করে।
  • SilentTTSEngine.generate() None → খালি dict ফেরত দেয়, শুধু-সাবটাইটেল মোড SRT তৈরি ঠিক করে।
  • SRT টাইমলাইন আনুমানিক ভিডিও দৈর্ঘ্যের বদলে প্রকৃত অডিও দৈর্ঘ্যের উপর ভিত্তি করে।
  • ছবি তৈরি ব্যর্থ হলে নির্দিষ্ট ত্রুটি আউটপুট (HTTP status + body + traceback)।
  • ডিজিটাল অ্যাংকর পাইপলাইনে প্রতিরক্ষামূলক UTF-8 এনকোডিং ঠিক করা; প্রকৃত অডিও দৈর্ঘ্য পেতে TTS আগে তৈরি হয়।

Agnes Video Generator সম্পর্কে

সম্পূর্ণ বিনামূল্যের, ওপেন-সোর্স AI ভিডিও জেনারেটর: টেক্সটকে বর্ণনা ও সাবটাইটেলসহ মাল্টি-সিন AI ভিডিওতে রূপান্তর করুন।

  • সম্পূর্ণ বিনামূল্য ও ওপেন-সোর্স — কোনো অর্থ নয়, হাই-এন্ড GPU দরকার নেই
  • টেক্সট-থেকে-ভিডিও, ছবি-থেকে-ভিডিও, ডিজিটাল উপস্থাপক ও ছবি তৈরি
  • বিনামূল্যের Agnes AI মডেলে চলে, ভিডিও সম্পূর্ণ ক্লাউডে তৈরি হয়
  • Web UI, Docker বা npm-এ চালান, সেলফ-হোস্টিং সমর্থিত

সম্পর্কিত পেজ

কেন এটি বিশ্বাস করতে পারেন

এই নিবন্ধটি একজন ফ্রন্ট-লাইন অনুশীলনকারীর দ্বারা লেখা হয়েছিল, এটি লেখার সময়, আমি প্রাথমিক উত্সগুলি যেমন arXiv কাগজপত্র, প্রস্তুতকারকের প্রযুক্তিগত প্রতিবেদন এবং স্ট্যানফোর্ড এআই সূচক ক্রস-চেক করেছি এবং বিষয়গত ছাপের উপর ভিত্তি করে উপসংহার তৈরি করিনি ।

S

SandGrid@lcy362

Agnes Video Generator-এর লেখক · ফুল-স্ট্যাক ডেভেলপার

স্বাধীন বিকাশকারী এবং ওপেন সোর্স এআই ভিডিও জেনারেশন টুল অ্যাগনেস ভিডিও জেনারেটরের লেখক । প্রকল্পটি Agnes AI-এর সম্পূর্ণ বিনামূল্যের ভিডিও মডেলের উপর ভিত্তি করে এবং MIT প্রোটোকলের অধীনে এটি 1,000+ নির্মাতাকে শূন্য খরচে AI ভিডিও তৈরি করতে সাহায্য করেছে । আমি দীর্ঘদিন ধরে ভিডিও জেনারেশন মডেলগুলির প্রকৌশল এবং জনপ্রিয়করণের দিকে মনোযোগ দিয়েছি এবং নিবন্ধের বিষয়বস্তু প্রথম-সারির অনুশীলন এবং প্রথম-হাতের গবেষণা

GitHub-এ দেখুন

সর্বশেষ আপডেট2026-08-21

তৈরি শুরু করতে প্রস্তুত?

"বিশ্বমানের এআই প্রত্যেকের জন্য হোক ।" - ব্রুস ইয়াং সম্পূর্ণ বিনামূল্যে, কোন ক্রেডিট কার্ড বা উচ্চ-পারফরম্যান্স গ্রাফিক্স কার্ডের প্রয়োজন নেই, শূন্য খরচে আপনার প্রথম AI ভিডিও তৈরি করুন । Agnes AI থেকে বিনামূল্যে ভিডিও মডেল চান? শুধু এখানে শুরু করুন ।

GitHub রিপো মোট করে ২ মিনিটে চালু করুন