پاسخ کوتاه
برای ساخت ویدیو با هوش مصنوعی، Brief و شاتلیست کوتاه بنویسید، مرجع تصویری هماهنگ بسازید، هر شات را با حرکت مشخص تولید و بازبینی کنید، سپس خروجیهای سالم را تدوین و برای موبایل کنترل کنید.
- برای شروع سه نما و یک سوژه ساده کافی است.
- پیوستگی تصاویر ثابت را پیش از تولید ویدیو بررسی کنید.
- برای هر شات یک کنش اصلی مشخص کنید.
- خروجی تولیدشده را گزینش و تدوین کنید؛ همه ثانیهها لازم نیست.
پاسخ کوتاه: برای ساخت ویدیو با هوش مصنوعی، ابتدا هدف و مخاطب را مشخص کنید، ایده را به چند شات کوتاه تبدیل کنید، برای هر شات تصویر مرجع یا پرامپت روشن بسازید، خروجیها را جداگانه تولید و بازبینی کنید و در پایان با تدوین، صدا و زیرنویس به یک ویدیوی قابل انتشار برسید. در این راهنما همین مسیر را با تمرین یک ویدیوی سهشاتی برای یک ماگ سفالی انجام میدهیم. این سناریو یک تمرین پیشنهادی است؛ تصویر کاور، تصویرسازی مفهومی است و ادعای آزمایش یک مدل مشخص یا تضمین نتیجه نیست.
اگر ابتدا به دنبال مسیر یادگیری و انتخاب مهارتها هستید، نقشه راه یادگیری ساخت ویدیو با هوش مصنوعی را بخوانید. این مقاله روی اجرای یک پروژه از ابتدا تا فایل نهایی تمرکز دارد. برای تمرین منظمتر نیز دوره ساخت ویدیو با هوش مصنوعی آونا و سرفصلهای آن را ببینید.
قبل از شروع، خروجی را تعریف کنید
یک دستور کلی مثل «یک ریلز جذاب بساز» تصمیمهای ضروری را به مدل واگذار میکند. Brief (شرح پروژه) کوتاه زیر کمک میکند قبل از هزینهکردن برای تولید، بدانید خروجی چه هدفی دارد:
| پرسش | پاسخ تمرین ما | اثر روی تولید |
|---|---|---|
| مخاطب و هدف؟ | معرفی فضای آرام یک کافه در ریلز | روایت تصویری ساده، بدون فروش تهاجمی |
| سوژه ثابت؟ | ماگ سفالی آجری با دسته گرد | رنگ، فرم و دسته در همه نماها کنترل میشود |
| خروجی کجا منتشر میشود؟ | ویدیوی عمودی شبکه اجتماعی | فضای مناسب برای برش، متن و عناصر رابط حفظ میشود |
| محدودیت؟ | سه نما، یک محیط، نور صبح و بدون چهره | متغیرهای کمتری برای خطایابی داریم |
قبل از تولید، مجوز استفاده از عکس، ویدیوی مرجع، موسیقی و چهره افراد را بررسی کنید. تصویر یا صدای فرد واقعی را بدون رضایت او به مدل ندهید. برای پروژه مشتری، این موضوع را در Brief و قرارداد روشن کنید.
قدم ۱: یک سناریوی کوتاه با سه شات بنویسید
Shot List (فهرست نماها) یعنی هر نما یک وظیفه مستقل داشته باشد. در این مثال، نمای باز فضای کافه و پنجره را معرفی میکند؛ نمای متوسط نگاه را به ماگ و بخار میبرد؛ نمای نزدیک بافت سفال را نشان میدهد. حرکت هر نما عمداً کوچک است تا تغییر شکل سوژه و پرش بصری کمتر شود.
| نما | هدف | کنش و دوربین | نکته تدوین |
|---|---|---|---|
| باز | شناخت محیط | دوربین ثابت؛ نور از چپ | فضای خالی برای تیتر آغاز |
| متوسط | تمرکز روی محصول | بخار آرام؛ حرکت خیلی کم دوربین | حفظ جهت نور و جای دسته |
| نزدیک | پایان با جزئیات | تأکید بر بافت سفال | برش روی حرکت یا ریتم موسیقی |
برای اجرای حرفهایتر چند شات، آموزش استوریبورد ویدیوی چندشاتی را کنار این تمرین باز کنید. اگر پروژه شخصیت دارد، پیش از ساخت ویدیو کاراکترشیت ثابت تهیه کنید.
قدم ۲: روش تولید را انتخاب کنید
Text-to-Video (تبدیل متن به ویدیو) برای کشف سریع قاب و حالوهوا مناسب است. Image-to-Video (تبدیل عکس به ویدیو) وقتی ظاهر سوژه، محصول یا ترکیببندی دقیق اهمیت دارد، نقطه شروع قابلکنترلتری میدهد. این انتخاب یک قانون مطلق نیست؛ امکانات مدل و کیفیت مرجع نیز نتیجه را تغییر میدهند. راهنمای رسمی Google Flow مسیرهای فریم و مرجع را شرح میدهد و راهنمای Runway روی توصیف حرکت در کنار تصویر ورودی تمرکز میکند.
برای تمرین ما، اول یک تصویر مرجع تأییدشده از ماگ کنار پنجره میسازیم. در همه نماها رنگ و فرم ماگ، جنس میز، سمت پنجره و جهت نور را از همان مرجع نگه میداریم. اگر سه تصویر ثابت کنار هم ناهماهنگاند، ویدیو ساختن را عقب بیندازید و ابتدا مرجع را اصلاح کنید.
یک سوژه ثابت، سه قاب متفاوت و خط زمان تدوین؛ این تصویر خروجی واقعی ابزارهای نامبرده نیست.
قدم ۳: برای هر شات پرامپت مشخص بنویسید
Prompt (دستور تولید) را از پنج جزء بسازید: سوژه، کنش، محیط، قاب و حرکت دوربین، و نور. برای Image-to-Video لازم نیست ظاهر کامل تصویر را در متن دوباره تکرار کنید؛ روی تغییری تمرکز کنید که باید در زمان رخ دهد. راهنمای رسمی پرامپت متن به ویدیوی Runway نیز از توصیف روشن صحنه و حرکت پشتیبانی میکند.
نمونه پرامپت نمای متوسط: متن زیر نمونه آموزشی است و روی مدل مشخصی در این مقاله اجرا نشده است. آن را با تصویر مرجع و تنظیمات ابزار خود تطبیق دهید.
Use the reference image for the same terracotta ceramic mug
with a round handle on the oak table beside the cafe window.
Medium shot. Soft morning light comes from the left.
A thin wisp of steam rises slowly; the mug remains still.
The camera makes a subtle, slow push-in. Keep the mug shape,
handle position, window and lighting consistent.
در نسخه اول فقط یک حرکت اصلی بخواهید. اگر خروجی بیثبات شد، حرکت دوربین را حذف کنید و با دوربین ثابت دوباره امتحان کنید. اگر محل انتشار ریلز است، نسبت تصویر و فضای امن متن را پیش از تولید تنظیم کنید؛ آموزش ویدیوی عمودی در Google Flow جزئیات این سناریو را توضیح میدهد.
قدم ۴: خروجیها را با معیار مشخص بازبینی کنید
هر شات را جداگانه بسنجید: آیا سوژه همان است؟ آیا حرکت طبیعی است؟ آیا نور و جهت آن بین نماها سازگار مانده؟ آیا فضای کافی برای متن و برش وجود دارد؟ بهترین بخش هر خروجی را نگه دارید؛ لازم نیست تمام طول تولیدشده وارد تدوین شود. طول، نسبت تصویر، هزینه اعتبار و قابلیتهای مرجع را در تنظیمات مدل انتخابی همان روز بررسی کنید؛ این موارد بین مدلها و پلنها تغییر میکنند. مستندات مدلها و قابلیتهای Flow هم بر بررسی مدل فعال و هزینه اعتبار پیش از تولید تأکید دارد.
| خطا | علت محتمل | اصلاح پیشنهادی |
|---|---|---|
| رنگ یا دسته ماگ تغییر میکند | مرجعها متفاوتاند یا چند وصف متناقض وجود دارد | یک مرجع تأییدشده و چند ویژگی ثابت استفاده کنید |
| حرکت غیرطبیعی است | چند کنش همزمان یا حرکت شدید دوربین | یک حرکت کوچک؛ در صورت نیاز دوربین ثابت |
| شاتها به هم نمیخورند | نور، جهت قاب یا پسزمینه عوض شده | تصاویر ثابت را قبل از تولید کنار هم بازبینی کنید |
| متن ریلز روی سوژه میافتد | فضای امن در Brief تعریف نشده | قاب را با فضای خالی برای تیتر دوباره بسازید |
برای حفظ چهره در پروژه دارای انسان، راهنمای مرجع و ثبات شخصیت در Google Flow مفید است. اگر ویدیوی واقعی مرجع حرکت دارید، آموزش Higgsfield Genjutsu با ویدیوی رفرنس مسیر متفاوتی را پوشش میدهد: استفاده از حرکت ویدیو به عنوان ورودی. طبق معرفی رسمی Genjutsu، این ابزار برای انتقال حرکت یا تغییر عناصر ویدیوی مرجع طراحی شده است؛ شرایط دقیق ورودی را هنگام استفاده در خود ابزار بررسی کنید.
قدم ۵: صدا، تدوین و خروجی را آماده کنید
سه قطعه سالم را در یک تایملاین قرار دهید، تغییرات نور و رنگ را بررسی کنید و برشها را با ریتم متناسب هماهنگ کنید. نریشن و موسیقی را پس از تثبیت تصویر اضافه کنید تا مجبور نشوید هر بار صدا را با یک شات تازه هماهنگ کنید. در ویدیوی فارسی، زیرنویس را روی موبایل و در اندازه واقعی بازبینی کنید. قبل از انتشار، یک بار بدون صدا و یک بار با صدا تماشا کنید؛ پیام اصلی باید در هر دو حالت قابل فهم باشد.
- نام فایلها و نسخههای تأییدشده را نگه دارید تا بازتولید هدفمند باشد.
- خروجی را روی موبایل واقعی از نظر برش، خوانایی متن و حجم بررسی کنید.
- اگر محتوای تبلیغاتی است، ادعاها، لوگو و حقوق استفاده از داراییها را دوباره کنترل کنید.
- عملکرد انتشار را با حفظ مخاطب، نرخ تکمیل و اقدام موردنظر بسنجید؛ تعداد بازدید به تنهایی کیفیت تولید را نشان نمیدهد.
کدام ابزار برای کدام مسئله؟
نام ابزار بهتنهایی پاسخ نیست. برای شروع از متن، یک مدل پشتیبان Text-to-Video را انتخاب کنید؛ برای محصول با ظاهر ثابت، تصویر مرجع و Image-to-Video را ترجیح دهید؛ برای ویدیوی چندنما، مدیریت مرجع و تدوین اهمیت بیشتری دارد؛ برای انتقال حرکت از ویدیو، ابزارهایی مانند Genjutsu را بررسی کنید. قابلیتها و قیمتها سریع تغییر میکنند، پس پیش از تصمیم نهایی، صفحه رسمی ابزار را ببینید. برای ساخت تبلیغ محصول با Flow و تبدیل عکس به ویدیو راهنماهای تخصصی جدا داریم.
جمعبندی و تمرین پیشنهادی
یک سوژه ساده انتخاب کنید، Brief چهارخطی بنویسید، سه قاب ثابت هماهنگ بسازید، برای هر قاب فقط یک حرکت مشخص تعریف کنید و بخشهای سالم را تدوین کنید. در پایان از خودتان بپرسید مخاطب از ابتدا تا انتها چه چیزی فهمید و کدام شات واقعاً به روایت کمک کرد. همین بازبینی، پیش از عوضکردن ابزار، معمولاً مفیدترین قدم بعدی است.
برای یادگیری ساخت ویدیو با تمرین و بازخورد: سرفصلهای دوره پروژهمحور آونا را ببینید و اگر برای انتخاب مسیر سؤال دارید، در تلگرام avenadesign_support یا اینستاگرام آونا پیام بدهید.
پرسشهای متداول
برای شروع ساخت ویدیو با هوش مصنوعی به چه چیزهایی نیاز دارم؟
یک ایده کوچک، هدف انتشار، چند نمای مشخص، ابزار تولید و امکان تدوین کافی است. برای پروژه دارای محصول یا شخصیت ثابت، تصویر مرجع هماهنگ نیز آماده کنید.
از متن شروع کنم یا از عکس؟
اگر در حال آزمودن ایده و قاب هستید، متن نقطه شروع خوبی است. اگر شکل سوژه یا محصول باید ثابت بماند، تصویر مرجع کنترل بیشتری میدهد. نتیجه به امکانات مدل و کیفیت ورودی هم وابسته است.
چطور چهره در چند شات یکسان بماند؟
کاراکترشیت و مرجع تأییدشده بسازید، لباس و ویژگیهای اصلی را ثابت نگه دارید و تصاویر ثابت را پیش از متحرکسازی کنار هم بررسی کنید. ثبات کامل در همه خروجیها تضمینشده نیست.
آیا یک پرامپت برای ساخت ریلز کامل کافی است؟
برای پروژه چندشاتی بهتر است هدف هر نما، مرجع و حرکت آن جدا تعریف شود و سپس خروجیهای سالم تدوین شوند. درخواست همزمان چند اتفاق، اصلاح خطا را دشوار میکند.
آیا این راهنما جای دوره را میگیرد؟
این مقاله یک تمرین مستقل را آموزش میدهد. دوره آونا مسیر متنی و پروژهمحور با تکلیف، بازخورد و سرفصلهای گستردهتر دارد؛ وضعیت ثبتنام و جزئیات دوره بعدی در صفحه دوره اعلام میشود.
نویسنده: کارشناس محتوای هوشمند آونا · بازبینی: ۴ مهر ۱۴۰۵
منابع و راهنماهای رسمی
منابع و روش بررسی
سناریوی ماگ آموزشی است؛ تصویرسازی مفهومی است. نمونه پرامپت روی مدل مشخصی در این مقاله آزمایش نشده و هیچ تضمین خروجی یا درآمد داده نمیشود.
بازبینی: کارشناس محتوای هوشمند آونا · ۴ مهر ۱۴۰۵
- Create videos in FlowGoogle
- Image to Video Prompting GuideRunway
- GenjutsuHiggsfield




