पाँच मोड के लिए Prompt लिखने का तरीका

टेक्स्ट-टू-वीडियो, क्रिएटिव लंबा वीडियो, मैनुस्क्रिप्ट वीडियो, कविता वीडियो और डिजिटल प्रेजेंटर — हर मोड की पृथक विधि

prompt लिखने से पहले सोच लें कि कौन सा मोड इस्तेमाल करना है: text-to-video (एक क्लिप का विवरण, सब्जेक्ट लॉक करने के लिए रेफ़रेंस इमेज भी लगा सकते हैं), क्रिएटिव लॉन्ग वीडियो (कहानी लाइन + सीन लिस्ट), मैनुस्क्रिप्ट वीडियो (पूरा मैनुस्क्रिप्ट ऑटो-स्प्लिट), कविता वीडियो (मूल कविता की हर पंक्ति अलग करके इमेज बनाना) या डिजिटल प्रेज़ेंटर (रेफ़रेंस इमेज + वॉइस-ओवर स्क्रिप्ट, आवाज़ और सबटाइटल अपने आप, देखें 「आवाज़ और सबटाइटल」)। पाँचों मोड की लिखाई का फ़ोकस अलग है, नीचे एक-एक करके समझाते हैं। सभी मोड पर एक ही सीमाएँ लागू होती हैं: लगभग 16 रिक्वेस्ट/मिनट, अधिकतम 720p, एक सीन अधिकतम 20 सेकंड।

पाँच मोड, पाँच तरीके

हर मोड में प्रॉम्प्ट की दिशा अलग होती है।

1

टेक्स्ट-टू-वीडियो (एक खंड)

एक पैराग्राफ में दृश्य का सीधा वर्णन: विषय, क्रिया, पृष्ठभूमि, आलोक। वायस-ओवर की पंक्ति जैसा लिखें — ऐसे शब्द जिन्हें चित्रित किया जा सके। विषय को स्थिर रखने के लिए एक संदर्भ इमेज लगा सकते हैं (इमेज-टू-वीडियो)।

उदाहरण: सरल टेक्स्ट वीडियो
2

क्रिएटिव लंबा वीडियो (मल्टी-शॉट)

एक पंक्ति की कहानी + प्रत्येक दृश्य की सूची: समय, स्थान, पात्र, क्रिया, माहौल। मॉडल हर दृश्य बनाकर जोड़ता है।

उदाहरण: क्रिएटिव लंबा वीडियो
3

मैनुस्क्रिप्ट वीडियो (लंबा)

पूरा लेख या स्क्रिप्ट सीधे दें: AI पढ़ने के समय के अनुसार खंड करता है, हर भाग के लिए दृश्य बनाता है, फिर एक समान वॉयसओवर और सबटाइटल जोड़कर जोड़ देता है। समझाने वाले और कोर्स कंटेंट के लिए उपयुक्त।

उदाहरण: मैनुस्क्रिप्ट वीडियो
4

कविता वीडियो

एक कविता दें, AI पंक्ति दर पंक्ति विभाजित करता है: मूल पंक्ति पढ़ी जाती है और सबटाइटल होती है, हर पंक्ति के अर्थ के अनुसार चित्र बनते हैं और एक वातावरणीय लघु फिल्म में जुड़ते हैं। क्लासिक कविता और मूड एनीमेशन के लिए आदर्श।

उदाहरण: कविता वीडियो
5

डिजिटल प्रेजेंटर

संदर्भ इमेज + पढ़ी जाने वाली स्क्रिप्ट। चेहरा इमेज से, स्वर स्क्रिप्ट से तय होता है; वॉयसओवर और सबटाइटल स्वतः। शिक्षा और समाचार के लिए उपयुक्त।

उदाहरण: प्रेजेंटर

सामान्य लेखन बिंदु

  • विस्तार से लिखें

    अमूर्त विशेषण को खींची जा सकने वाली इमेज में बदलें। «सुंदर नर्तकी» नहीं, बल्कि «बारिश में गीले प्लेटफ़ॉर्म पर लाल कपड़े में घूमती हुई लड़की»।

  • एक वाक्य एक दृश्य

    पूर्ण विराम और अर्धविराम से दृश्य तथा गति को बाँटें; एक वाक्य में एक क्रिया। तीन घटनाओं को एक वाक्य में न ऐँ।

  • प्रकाश व कोण लिखें

    प्रकाश स्रोत, कंट्रास्ट, गहराई व कोण लिखिए (गर्म सीमा प्रकाश, उथली गहराई, हाथ में कमरा-का-ऐंगल)। सही प्रकाश से गुणवत्ता तुरंत ऊपर जाती है।

  • पहली पंक्ति में शैली चुनें

    शुरुआत में पूरे वीडियो की शैली तय करें: साइबरपंक नियॉन, वॉटरकलर, अर्तु। शैली निश्चित होने से आगे के दृश्य भी संगत रहते हैं।

आम गलतियाँ

  • एक ही प्रॉम्प्ट में कई दृश्य

    «विस्फोट + पीछा + प्रेम» एक वाक्य में — मॉडल बेतरतीब से कुछ चुन लेता है और दृश्य बिगड़ जाता है। एक बार में एक ही दृश्य लिखें।

  • सिर्फ विशेषण

    «सुंदर, शानदार» समीक्षा है, आदेश नहीं। उन्हें प्रकाश, संरचना, क्रिया और फ्रेम में बदलें।

  • विषय की एकरूपता भूलना

    हर दृश्य में चेहरा बदलना विषय के स्थिर न होने का संकेत है। संदर्भ इमेज दें या विशेषताओं को दोहराएँ।

Demo में आज़माएँ

इन नियमों के अनुसार एक पंक्ति लिखें और Demo में डालें — तुरंत बन जाएगा। मुफ़्त।

डेमो खोलें →

Prompt-Methodology References

The prompt-writing approaches here are grounded in the following model technical reports and prompt-engineering guides.

  1. VideoPoet: A Large Language Model for Zero-Shot Video GenerationGoogle Research · arXiv:2312.14125 (2023)

    The VideoPoet paper demonstrates the sensitivity of LLM-driven video generation to prompt structure, providing academic grounding for the prompt tips on this page.

  2. Sora: Video Generation Model Technical ReportOpenAI · OpenAI Technical Report (2024)

    OpenAI's Sora technical report details how prompt engineering affects video quality, including best practices for camera language and physical descriptions.

  3. OpenAI Prompt Engineering Guide — 提示词工程最佳实践OpenAI · OpenAI Docs (2025)

    OpenAI's official prompt-engineering guide offers general methods — be specific, step-by-step, constrained — consistent with this page's tips.

इस पर भरोसा क्यों करें

यह लेख एक फ्रंटलाइन प्रैक्टिशनर ने लिखा है। लिखते समय arXiv पेपर, वेंडर तकनीकी रिपोर्ट और Stanford AI Index जैसे प्राथमिक स्रोतों को क्रॉस-चेक किया गया, न कि सिर्फ़ व्यक्तिपरक धारणा पर निष्कर्ष।

S

SandGrid@lcy362

Agnes Video Generator के लेखक · फुल-स्टैक डेवलपर

स्वतंत्र डेवलपर, ओपन सोर्स AI वीडियो जनरेशन टूल Agnes Video Generator के लेखक। यह प्रोजेक्ट Agnes AI के पूरी तरह मुफ़्त वीडियो मॉडल पर आधारित है, MIT ओपन सोर्स लाइसेंस, 1,000+ क्रिएटर की बिना लागत AI वीडियो बनाने में मदद कर चुका है। लंबे समय से वीडियो जनरेशन मॉडल के इंजीनियरिंग और लोकतंत्रीकरण पर ध्यान देता है; लेख की सामग्री सब फ्रंटलाइन प्रैक्टिस और प्राथमिक शोध से है।

GitHub पर देखें

अंतिम अपडेट2026-08-21

बनाना शुरू करने के लिए तैयार?

「दुनिया का सर्वश्रेष्ठ AI हर किसी का हो।」 — ब्रूस यांग। पूरी तरह मुफ़्त, कोई क्रेडिट कार्ड नहीं, हाई-एंड GPU की ज़रूरत नहीं। आपका पहला AI वीडियो शून्य लागत पर शुरू। Agnes AI का मुफ़्त वीडियो मॉडल इस्तेमाल करना चाहते हैं? यहीं से शुरू करें।

GitHub रेपो क्लोन करें और 2 मिनट में लॉन्च करें