مجله آونا/ساخت ویدیو با هوش مصنوعی

آموزش ساخت ویدیو با هوش مصنوعی؛ پروژه عملی از ایده تا تدوین

آموزش مرحله‌به‌مرحله تولید ویدیوی سه‌شاتی با هوش مصنوعی: سناریو، تصویر مرجع، پرامپت، رفع خطا، تدوین و ابزار مناسب با مثال عملی.

تصویرسازی مفهومی آموزش ساخت ویدیو با هوش مصنوعی با سه نمای ماگ، تصویر مرجع و تدوین
AVENA JOURNALدانش کاربردی برای تصمیم‌های بهتر
QUICK ANSWER

پاسخ کوتاه

برای ساخت ویدیو با هوش مصنوعی، Brief و شات‌لیست کوتاه بنویسید، مرجع تصویری هماهنگ بسازید، هر شات را با حرکت مشخص تولید و بازبینی کنید، سپس خروجی‌های سالم را تدوین و برای موبایل کنترل کنید.

  • برای شروع سه نما و یک سوژه ساده کافی است.
  • پیوستگی تصاویر ثابت را پیش از تولید ویدیو بررسی کنید.
  • برای هر شات یک کنش اصلی مشخص کنید.
  • خروجی تولیدشده را گزینش و تدوین کنید؛ همه ثانیه‌ها لازم نیست.

پاسخ کوتاه: برای ساخت ویدیو با هوش مصنوعی، ابتدا هدف و مخاطب را مشخص کنید، ایده را به چند شات کوتاه تبدیل کنید، برای هر شات تصویر مرجع یا پرامپت روشن بسازید، خروجی‌ها را جداگانه تولید و بازبینی کنید و در پایان با تدوین، صدا و زیرنویس به یک ویدیوی قابل انتشار برسید. در این راهنما همین مسیر را با تمرین یک ویدیوی سه‌شاتی برای یک ماگ سفالی انجام می‌دهیم. این سناریو یک تمرین پیشنهادی است؛ تصویر کاور، تصویرسازی مفهومی است و ادعای آزمایش یک مدل مشخص یا تضمین نتیجه نیست.

اگر ابتدا به دنبال مسیر یادگیری و انتخاب مهارت‌ها هستید، نقشه راه یادگیری ساخت ویدیو با هوش مصنوعی را بخوانید. این مقاله روی اجرای یک پروژه از ابتدا تا فایل نهایی تمرکز دارد. برای تمرین منظم‌تر نیز دوره ساخت ویدیو با هوش مصنوعی آونا و سرفصل‌های آن را ببینید.

قبل از شروع، خروجی را تعریف کنید

یک دستور کلی مثل «یک ریلز جذاب بساز» تصمیم‌های ضروری را به مدل واگذار می‌کند. Brief (شرح پروژه) کوتاه زیر کمک می‌کند قبل از هزینه‌کردن برای تولید، بدانید خروجی چه هدفی دارد:

پرسشپاسخ تمرین مااثر روی تولید
مخاطب و هدف؟معرفی فضای آرام یک کافه در ریلزروایت تصویری ساده، بدون فروش تهاجمی
سوژه ثابت؟ماگ سفالی آجری با دسته گردرنگ، فرم و دسته در همه نماها کنترل می‌شود
خروجی کجا منتشر می‌شود؟ویدیوی عمودی شبکه اجتماعیفضای مناسب برای برش، متن و عناصر رابط حفظ می‌شود
محدودیت؟سه نما، یک محیط، نور صبح و بدون چهرهمتغیرهای کمتری برای خطایابی داریم

قبل از تولید، مجوز استفاده از عکس، ویدیوی مرجع، موسیقی و چهره افراد را بررسی کنید. تصویر یا صدای فرد واقعی را بدون رضایت او به مدل ندهید. برای پروژه مشتری، این موضوع را در Brief و قرارداد روشن کنید.

قدم ۱: یک سناریوی کوتاه با سه شات بنویسید

Shot List (فهرست نماها) یعنی هر نما یک وظیفه مستقل داشته باشد. در این مثال، نمای باز فضای کافه و پنجره را معرفی می‌کند؛ نمای متوسط نگاه را به ماگ و بخار می‌برد؛ نمای نزدیک بافت سفال را نشان می‌دهد. حرکت هر نما عمداً کوچک است تا تغییر شکل سوژه و پرش بصری کمتر شود.

نماهدفکنش و دوربیننکته تدوین
بازشناخت محیطدوربین ثابت؛ نور از چپفضای خالی برای تیتر آغاز
متوسطتمرکز روی محصولبخار آرام؛ حرکت خیلی کم دوربینحفظ جهت نور و جای دسته
نزدیکپایان با جزئیاتتأکید بر بافت سفالبرش روی حرکت یا ریتم موسیقی

برای اجرای حرفه‌ای‌تر چند شات، آموزش استوری‌بورد ویدیوی چندشاتی را کنار این تمرین باز کنید. اگر پروژه شخصیت دارد، پیش از ساخت ویدیو کاراکترشیت ثابت تهیه کنید.

قدم ۲: روش تولید را انتخاب کنید

Text-to-Video (تبدیل متن به ویدیو) برای کشف سریع قاب و حال‌وهوا مناسب است. Image-to-Video (تبدیل عکس به ویدیو) وقتی ظاهر سوژه، محصول یا ترکیب‌بندی دقیق اهمیت دارد، نقطه شروع قابل‌کنترل‌تری می‌دهد. این انتخاب یک قانون مطلق نیست؛ امکانات مدل و کیفیت مرجع نیز نتیجه را تغییر می‌دهند. راهنمای رسمی Google Flow مسیرهای فریم و مرجع را شرح می‌دهد و راهنمای Runway روی توصیف حرکت در کنار تصویر ورودی تمرکز می‌کند.

برای تمرین ما، اول یک تصویر مرجع تأییدشده از ماگ کنار پنجره می‌سازیم. در همه نماها رنگ و فرم ماگ، جنس میز، سمت پنجره و جهت نور را از همان مرجع نگه می‌داریم. اگر سه تصویر ثابت کنار هم ناهماهنگ‌اند، ویدیو ساختن را عقب بیندازید و ابتدا مرجع را اصلاح کنید.

تصویرسازی مفهومی سه نمای پیوسته ماگ در کافه، تصویر مرجع و خط زمان تدوین ویدیو با هوش مصنوعییک سوژه ثابت، سه قاب متفاوت و خط زمان تدوین؛ این تصویر خروجی واقعی ابزارهای نام‌برده نیست.

قدم ۳: برای هر شات پرامپت مشخص بنویسید

Prompt (دستور تولید) را از پنج جزء بسازید: سوژه، کنش، محیط، قاب و حرکت دوربین، و نور. برای Image-to-Video لازم نیست ظاهر کامل تصویر را در متن دوباره تکرار کنید؛ روی تغییری تمرکز کنید که باید در زمان رخ دهد. راهنمای رسمی پرامپت متن به ویدیوی Runway نیز از توصیف روشن صحنه و حرکت پشتیبانی می‌کند.

نمونه پرامپت نمای متوسط: متن زیر نمونه آموزشی است و روی مدل مشخصی در این مقاله اجرا نشده است. آن را با تصویر مرجع و تنظیمات ابزار خود تطبیق دهید.

Use the reference image for the same terracotta ceramic mug
with a round handle on the oak table beside the cafe window.
Medium shot. Soft morning light comes from the left.
A thin wisp of steam rises slowly; the mug remains still.
The camera makes a subtle, slow push-in. Keep the mug shape,
handle position, window and lighting consistent.

در نسخه اول فقط یک حرکت اصلی بخواهید. اگر خروجی بی‌ثبات شد، حرکت دوربین را حذف کنید و با دوربین ثابت دوباره امتحان کنید. اگر محل انتشار ریلز است، نسبت تصویر و فضای امن متن را پیش از تولید تنظیم کنید؛ آموزش ویدیوی عمودی در Google Flow جزئیات این سناریو را توضیح می‌دهد.

قدم ۴: خروجی‌ها را با معیار مشخص بازبینی کنید

هر شات را جداگانه بسنجید: آیا سوژه همان است؟ آیا حرکت طبیعی است؟ آیا نور و جهت آن بین نماها سازگار مانده؟ آیا فضای کافی برای متن و برش وجود دارد؟ بهترین بخش هر خروجی را نگه دارید؛ لازم نیست تمام طول تولیدشده وارد تدوین شود. طول، نسبت تصویر، هزینه اعتبار و قابلیت‌های مرجع را در تنظیمات مدل انتخابی همان روز بررسی کنید؛ این موارد بین مدل‌ها و پلن‌ها تغییر می‌کنند. مستندات مدل‌ها و قابلیت‌های Flow هم بر بررسی مدل فعال و هزینه اعتبار پیش از تولید تأکید دارد.

خطاعلت محتملاصلاح پیشنهادی
رنگ یا دسته ماگ تغییر می‌کندمرجع‌ها متفاوت‌اند یا چند وصف متناقض وجود داردیک مرجع تأییدشده و چند ویژگی ثابت استفاده کنید
حرکت غیرطبیعی استچند کنش هم‌زمان یا حرکت شدید دوربینیک حرکت کوچک؛ در صورت نیاز دوربین ثابت
شات‌ها به هم نمی‌خورندنور، جهت قاب یا پس‌زمینه عوض شدهتصاویر ثابت را قبل از تولید کنار هم بازبینی کنید
متن ریلز روی سوژه می‌افتدفضای امن در Brief تعریف نشدهقاب را با فضای خالی برای تیتر دوباره بسازید

برای حفظ چهره در پروژه دارای انسان، راهنمای مرجع و ثبات شخصیت در Google Flow مفید است. اگر ویدیوی واقعی مرجع حرکت دارید، آموزش Higgsfield Genjutsu با ویدیوی رفرنس مسیر متفاوتی را پوشش می‌دهد: استفاده از حرکت ویدیو به عنوان ورودی. طبق معرفی رسمی Genjutsu، این ابزار برای انتقال حرکت یا تغییر عناصر ویدیوی مرجع طراحی شده است؛ شرایط دقیق ورودی را هنگام استفاده در خود ابزار بررسی کنید.

قدم ۵: صدا، تدوین و خروجی را آماده کنید

سه قطعه سالم را در یک تایم‌لاین قرار دهید، تغییرات نور و رنگ را بررسی کنید و برش‌ها را با ریتم متناسب هماهنگ کنید. نریشن و موسیقی را پس از تثبیت تصویر اضافه کنید تا مجبور نشوید هر بار صدا را با یک شات تازه هماهنگ کنید. در ویدیوی فارسی، زیرنویس را روی موبایل و در اندازه واقعی بازبینی کنید. قبل از انتشار، یک بار بدون صدا و یک بار با صدا تماشا کنید؛ پیام اصلی باید در هر دو حالت قابل فهم باشد.

  • نام فایل‌ها و نسخه‌های تأییدشده را نگه دارید تا بازتولید هدفمند باشد.
  • خروجی را روی موبایل واقعی از نظر برش، خوانایی متن و حجم بررسی کنید.
  • اگر محتوای تبلیغاتی است، ادعاها، لوگو و حقوق استفاده از دارایی‌ها را دوباره کنترل کنید.
  • عملکرد انتشار را با حفظ مخاطب، نرخ تکمیل و اقدام موردنظر بسنجید؛ تعداد بازدید به تنهایی کیفیت تولید را نشان نمی‌دهد.

کدام ابزار برای کدام مسئله؟

نام ابزار به‌تنهایی پاسخ نیست. برای شروع از متن، یک مدل پشتیبان Text-to-Video را انتخاب کنید؛ برای محصول با ظاهر ثابت، تصویر مرجع و Image-to-Video را ترجیح دهید؛ برای ویدیوی چندنما، مدیریت مرجع و تدوین اهمیت بیشتری دارد؛ برای انتقال حرکت از ویدیو، ابزارهایی مانند Genjutsu را بررسی کنید. قابلیت‌ها و قیمت‌ها سریع تغییر می‌کنند، پس پیش از تصمیم نهایی، صفحه رسمی ابزار را ببینید. برای ساخت تبلیغ محصول با Flow و تبدیل عکس به ویدیو راهنماهای تخصصی جدا داریم.

جمع‌بندی و تمرین پیشنهادی

یک سوژه ساده انتخاب کنید، Brief چهارخطی بنویسید، سه قاب ثابت هماهنگ بسازید، برای هر قاب فقط یک حرکت مشخص تعریف کنید و بخش‌های سالم را تدوین کنید. در پایان از خودتان بپرسید مخاطب از ابتدا تا انتها چه چیزی فهمید و کدام شات واقعاً به روایت کمک کرد. همین بازبینی، پیش از عوض‌کردن ابزار، معمولاً مفیدترین قدم بعدی است.

برای یادگیری ساخت ویدیو با تمرین و بازخورد: سرفصل‌های دوره پروژه‌محور آونا را ببینید و اگر برای انتخاب مسیر سؤال دارید، در تلگرام avenadesign_support یا اینستاگرام آونا پیام بدهید.

پرسش‌های متداول

برای شروع ساخت ویدیو با هوش مصنوعی به چه چیزهایی نیاز دارم؟

یک ایده کوچک، هدف انتشار، چند نمای مشخص، ابزار تولید و امکان تدوین کافی است. برای پروژه دارای محصول یا شخصیت ثابت، تصویر مرجع هماهنگ نیز آماده کنید.

از متن شروع کنم یا از عکس؟

اگر در حال آزمودن ایده و قاب هستید، متن نقطه شروع خوبی است. اگر شکل سوژه یا محصول باید ثابت بماند، تصویر مرجع کنترل بیشتری می‌دهد. نتیجه به امکانات مدل و کیفیت ورودی هم وابسته است.

چطور چهره در چند شات یکسان بماند؟

کاراکترشیت و مرجع تأییدشده بسازید، لباس و ویژگی‌های اصلی را ثابت نگه دارید و تصاویر ثابت را پیش از متحرک‌سازی کنار هم بررسی کنید. ثبات کامل در همه خروجی‌ها تضمین‌شده نیست.

آیا یک پرامپت برای ساخت ریلز کامل کافی است؟

برای پروژه چندشاتی بهتر است هدف هر نما، مرجع و حرکت آن جدا تعریف شود و سپس خروجی‌های سالم تدوین شوند. درخواست هم‌زمان چند اتفاق، اصلاح خطا را دشوار می‌کند.

آیا این راهنما جای دوره را می‌گیرد؟

این مقاله یک تمرین مستقل را آموزش می‌دهد. دوره آونا مسیر متنی و پروژه‌محور با تکلیف، بازخورد و سرفصل‌های گسترده‌تر دارد؛ وضعیت ثبت‌نام و جزئیات دوره بعدی در صفحه دوره اعلام می‌شود.

نویسنده: کارشناس محتوای هوشمند آونا · بازبینی: ۴ مهر ۱۴۰۵

منابع و راهنماهای رسمی

EVIDENCE & SOURCES

منابع و روش بررسی

مبنای این مطلب

سناریوی ماگ آموزشی است؛ تصویرسازی مفهومی است. نمونه پرامپت روی مدل مشخصی در این مقاله آزمایش نشده و هیچ تضمین خروجی یا درآمد داده نمی‌شود.

بازبینی: کارشناس محتوای هوشمند آونا · ۴ مهر ۱۴۰۵

  1. Create videos in FlowGoogle
  2. Image to Video Prompting GuideRunway
  3. GenjutsuHiggsfield
پایان مقاله

این مطلب برایتان مفید بود؟

اگر درباره همین موضوع سؤال یا پروژه‌ای دارید، می‌توانید مستقیم با تیم آونا گفتگو کنید.

گفتگو با آوناشروع پروژه