از اینستاگرام اومدی؟ 👋 جای درستی هستی!
اینجا هم آموزش کامل رو داری، هم پرامپت آمادهای که برای ساخت همون ویدیوی «سفر داخل عکس» استفاده میشه.
فکر کن یه نقاشی کاملاً ثابت جلوت باشه...
بعد دوربین آروم واردش بشه، از کنار شخصیتها رد بشه، پشت سوژه بره و چیزی رو نشون بده که اصلاً داخل عکس اصلی دیده نمیشده.
جذابترش اینه که این تکنیک فقط برای نقاشی نیست.
میتونی از عکس خودت، تصویر ساختهشده با AI، عکس محصول، معماری، طبیعت یا هر تصویر مناسبی استفاده کنی.
و برای شروع لازم نیست سهبعدیسازی بلد باشی.
یک عکس + مسیر حرکت دوربین + یک مدل Image to Video + پرامپت درست
همین.
سریع میخوای بسازیش؟ از اینجا شروع کن
مرحله ۱: یک عکس مناسب انتخاب کن
برای این تکنیک هر عکسی نتیجه یکسانی نمیده.
عکسی انتخاب کن که داخلش بتوانی تشخیص بدهی چه چیزی نزدیک دوربین است، سوژه اصلی کجاست و پشت سوژه چه فضایی وجود دارد.
مثلاً تصور کن یک شخصیت وسط یک اتاق ایستاده و پشت سرش پنجره، میز و دیوار وجود دارد.
این تصویر خیلی بهتر از عکسی جواب میدهد که سوژه کاملاً به یک پسزمینه تخت چسبیده باشد.
راهنمای اصلی این تکنیک هم پیشنهاد میکند تصویر ورودی کیفیت بالا داشته باشد و فضای کافی برای حرکت دوربین در آن وجود داشته باشد.
مرحله ۲: مشخص کن دوربین قرار است کجا برود
این قسمت یکی از مهمترین بخشهای کاره.
قبل از اینکه عکس رو تبدیل به ویدیو کنی، باید خودت بدونی:
دوربین از کجا شروع میکنه و قراره کجا بره؟
یک نسخه از عکس بساز و مسیر رو اینجوری روی اون مشخص کن:
① → ② → ③ → ④
مثلاً:
① شروع از جلوی سوژه
② حرکت به سمت چپ
③ عبور از کنار سوژه
④ رسیدن به فضای پشت سوژه
اگر میخوای دوربین وارد عمق تصویر بشه، شمارهها رو از جلوی تصویر به سمت داخل قرار بده.
اگر میخوای دور سوژه بچرخه، شمارهها رو به شکل یک قوس کنار سوژه بچین.
و اگر تصویر شلوغه، میتونی مسیر رو به شکل چپ و راست بین آدمها یا اجسام طراحی کنی.
یک نکته مهم
شمارهگذاری، روش سادهایه که ما برای طراحی مسیر دوربین استفاده میکنیم.
در راهنمای اصلی Seedance پیشنهاد شده تصویر اصلی تا حد امکان تمیز و بدون علامتگذاری باشد. بنابراین اگر ابزار امکان چند Reference دارد، بهترین حالت اینه که:
عکس تمیز = تصویر اصلی
و
عکس شمارهگذاریشده = راهنمای مسیر
باشد.
اگر فقط یک عکس میتوانی وارد کنی، تصویر اصلی را تمیز نگه دار و مسیر 1 → 2 → 3 → 4 را دقیقاً داخل پرامپت توضیح بده.
مرحله ۳: عکس را وارد Image to Video کن
حالا عکس را داخل مدل ویدیوساز موردنظرت وارد کن.
اگر گزینهای مثل:
Start Frame
یا
First Frame
وجود داشت، تصویر اصلی را بهعنوان فریم شروع قرار بده.
هدف اینه که ویدیو دقیقاً از همان تصویری شروع شود که آپلود کردهای، نه اینکه مدل از همان فریم اول تصویر را دوباره طراحی کند.
بعد نوبت پرامپته.
🎁 پرامپت آماده سفر داخل عکس
پرامپت زیر یک قالب عمومی است که میتوانی برای تصاویر مختلف استفاده کنی:
FIRST FRAME:
Start exactly from the original reference image.
Preserve the original composition, subjects, faces, clothing, objects, environment, colors and lighting.
Treat the reference image as a real three-dimensional physical environment with genuine depth.
The foreground objects, main subject, middle ground and background exist at different physical distances from the camera.
CAMERA PATH:
Follow the intended camera route in this exact order:
1 → 2 → 3 → 4
Start from point 1 and move continuously toward point 2, then point 3 and finally point 4.
The camera must follow one smooth continuous cinematic path.
Never stop.
Never reverse direction.
Never return to a previous position.
Do not simply zoom into the image.
The camera must physically travel through the three-dimensional space.
PARALLAX:
Create strong natural parallax between all depth layers.
Objects closest to the camera move across the frame fastest.
The main subject moves at a different rate.
The background moves slowest.
Objects must correctly occlude each other as the viewing angle changes.
The scene must feel like a real physical environment being explored by a camera, not a flat photograph being warped.
PRESERVATION:
Preserve the exact identity and appearance of every important subject.
Faces, facial features, body proportions, hands, clothing, objects, architecture, textures, lighting and overall visual style must remain consistent.
No morphing.
No melting.
No stretching.
No warping.
No reshaping.
No duplicated objects.
No added people.
No disappearing objects.
If a detail naturally rotates out of view, allow it to leave the frame instead of inventing a new version of it.
CAMERA MOTION:
Smooth cinematic gimbal movement.
Natural acceleration.
Organic camera drift.
Realistic perspective.
Real physical depth.
No push-pull.
No zoom in and out.
No crash zoom.
No whip pan.
No sudden direction changes.
No unnatural camera shake.
Maintain continuous momentum until the final frame.
Cinematic look, realistic depth, natural lighting, high detail, 24fps.
No subtitles.
No captions.
No watermark.نکته: قسمت مسیر دوربین رو متناسب با شمارههایی که روی تصویرت مشخص کردی تغییر بده.
سه حرکت دوربین که نتیجه خیلی خوبی میدن
در منبعی که این تکنیک بر اساس آن تنظیم شده، سه الگوی اصلی برای Flythrough معرفی شده است: Orbit، Over the Shoulder و Weave. هر سه یک اصل مشترک دارند: تصویر باید مثل یک فضای سهبعدی واقعی در نظر گرفته شود، لایههای عمق مشخص باشند و دوربین تا پایان حرکت متوقف یا معکوس نشود.
۱. Orbit؛ دور سوژه بچرخ
اگر یک یا دو شخصیت اصلی داخل تصویر داری و پشت سر آنها محیط قابلمشاهدهای وجود دارد، Orbit یکی از بهترین انتخابهاست.
دوربین از جلوی تصویر شروع میکند و بهصورت قوسی از کنار سوژه عبور میکند.
این حرکت باعث میشود اشیای نزدیک سریعتر حرکت کنند، خود سوژه با سرعت متفاوتی از قاب عبور کند و پسزمینه خیلی آرامتر جابهجا شود.
همین اختلاف سرعت است که حس سهبعدی ایجاد میکند.
برای چنین حرکتی میتوانی مسیر را مثلاً اینطور طراحی کنی:
① جلو → ② کنار سوژه → ③ پشت شانه → ④ پشت سوژه
در راهنمای منبع برای Orbit تأکید شده که چرخش بیشازحد میتواند مدل را مجبور کند بخشهایی مثل پشت سر سوژه را از خودش بسازد و همین نقطه معمولاً محل شروع Morphing است.
۲. Over the Shoulder؛ برو پشت شخصیت
این یکی برای ریلز واقعاً جذابه.
فرض کن یک نفر داخل تصویر به یک منظره نگاه میکنه.
دوربین از نمای اصلی شروع میکنه، از کنارش رد میشه و در نهایت پشت شونهاش قرار میگیره.
حالا مخاطب چیزی رو میبینه که در عکس اولیه اصلاً وجود نداشته.
برای این حرکت، مهمه که فریم نهایی رو هم داخل پرامپت توضیح بدی.
مثلاً:
End behind the subject's left shoulder, looking forward in the same direction as the subject.
The camera is still moving gently when the video ends.منبع نیز توصیه میکند مقصد نهایی دوربین دقیق توصیف شود و دوربین در انتها فقط کمی آرام شود، اما کاملاً نایستد.
۳. Weave؛ بین شخصیتها پرواز کن
برای نقاشیهای شلوغ، خیابان، سالن، جمعیت و معماری عمیق این حرکت خیلی جذابه.
دوربین فقط مستقیم جلو نمیره.
مسیرش چیزی شبیه اینه:
چپ → راست → چپ → راست
در واقع دوربین بین آدمها و اجسام حرکت میکنه.
همین حرکت جانبی باعث میشه سوژههای نزدیک با سرعت از روی پسزمینه عبور کنند و حس Parallax شدیدتری ایجاد شود.
در راهنما هم تأکید شده که حرکت مستقیم رو به جلو بهتنهایی ممکن است فقط شبیه زوم روی یک پوستر دیده شود؛ حرکت جانبی بخش مهم ایجاد عمق در Weave است.
اصلاً Parallax چیه؟
اسمش شاید تخصصی به نظر برسه، ولی مفهومش خیلی سادهست.
وقتی داخل ماشین نشستی، تیر چراغ برق کنار خیابون خیلی سریع از کنارت رد میشه.
اما کوهی که کیلومترها دورتره تقریباً ثابت به نظر میرسه.
این همون Parallax ـه.
در ویدیوی ساختهشده از عکس هم باید همین اتفاق بیفته.
اجسام نزدیک سریعتر حرکت کنند.
سوژه اصلی کمی کندتر.
و دیوار، آسمان یا پسزمینه خیلی آرامتر جابهجا شود.
اگر همه اجزای تصویر با یک سرعت حرکت کنند، چشم ما خیلی سریع متوجه میشود که با یک عکس تخت طرف است.
مهمترین قانون این تکنیک
اگر فقط یک نکته از این مقاله یادت بمونه، همین باشه:
دوربین نباید وسط مسیر متوقف بشه و نباید جهتش رو عوض کنه.
یعنی اگر حرکت از راست شروع شده، وسط ویدیو ناگهان برنگردد سمت چپ.
اگر قرار است دور سوژه بچرخد، همان قوس را ادامه دهد.
منبع آموزشی این موضوع را بهعنوان قانون اصلی مطرح کرده:
One arc. One way. Never stop.
حتی در فریم آخر نیز دوربین بهتر است هنوز کمی در حال حرکت باشد.
ویدیو چند ثانیه باشه؟
برای شروع حدود ۷ ثانیه انتخاب خیلی خوبیه.
راهنمای مورد استفاده برای این تکنیک، ویدیوهای ۷ ثانیهای را پیشنهاد میکند و توضیح میدهد که در حرکتهای خیلی کوتاه، دوربین مجبور میشود مسیر را با سرعت زیادی طی کند و هندسه صحنه ممکن است خراب شود.
از طرف دیگر، اگر مسیر بیشازحد طولانی شود، مدل کمکم مجبور میشود بخشهایی را بسازد که در عکس اولیه وجود نداشتهاند.
البته این عدد به مدل ویدیوساز هم بستگی داره.
اگر ابزار شما خروجی ۱۰ ثانیهای میسازه، مسیر رو کمی طولانیتر طراحی کن؛ نه اینکه همون مسیر کوتاه رو مجبور کنی ۱۰ ثانیه ادامه بده.
چرا صورت سوژه خراب میشه؟
یکی از مشکلات رایج تبدیل عکس به ویدیو با هوش مصنوعی اینه که اول ویدیو همهچیز عالیه، ولی وقتی دوربین از کنار شخصیت رد میشه، ناگهان صورت یا سر تغییر میکنه.
دلیلش معمولاً خیلی سادهست.
مثلاً در عکس فقط جلوی صورت دیده میشه.
ولی وقتی از پشت سر رد میشی، مدل باید حدس بزنه:
پشت مو چه شکلیه؟
گوش کجاست؟
لباس پشت بدن چه شکلیه؟
هرچقدر مدل مجبور بشه چیزهای بیشتری حدس بزنه، احتمال خطا بالاتر میره.
اگر این مشکل رو داشتی، زاویه حرکت رو کمتر کن.
مثلاً بهجای اینکه دوربین کاملاً پشت سوژه بره، در نمای سهرخ یا کنار سوژه متوقفش کن.
البته «متوقف» به معنی توقف واقعی دوربین نیست؛ یعنی مسیر ویدیو را همانجا تمام کن در حالی که دوربین هنوز در حال حرکت است.
چرا ویدیوی من فقط زوم میکنه؟
احتمالاً فقط به مدل گفتی:
Camera moves forward.این برای ساخت Flythrough کافی نیست.
مدل باید بدونه:
چه چیزی جلوئه؟
چه چیزی پشتشه؟
دوربین از کنار چه چیزی عبور میکنه؟
چه چیزی باید جلوی چه چیزی قرار بگیره؟
برای مثال بهجای دستور عمومی، این بهتره:
The foreground object passes quickly along the left side of the lens.
The main subject moves more slowly across the frame.
The back wall remains deep in the background and moves slowest.هرچقدر لایههای صحنه رو دقیقتر تعریف کنی، احتمال اینکه مدل تصویر رو واقعاً سهبعدی تفسیر کنه بیشتر میشه.
در منبع نیز توصیه شده لایههای Parallax از نزدیکترین تا دورترین جسم مشخص شوند و حتی Occlusionهای مشخص توضیح داده شوند.
اگر نتیجه بار اول خوب نشد چی؟
لزومی نداره سریع پرامپت رو عوض کنی.
مدلهای ویدیوساز خروجی کاملاً ثابت و قطعی ندارند.
ممکنه یک پرامپت دقیقاً یکسان رو چند بار اجرا کنی و نتیجههای متفاوتی بگیری.
منبع اصلی پیشنهاد میکند یک پرامپت را سه بار اجرا کنی و بعد درباره کیفیت آن تصمیم بگیری.
اگر باز هم مشکل وجود داشت، هر بار فقط یک بخش رو تغییر بده.
مثلاً فقط زاویه دوربین رو کمتر کن.
یا فقط مسیر رو کوتاهتر کن.
اینطوری دقیقاً میفهمی چه چیزی باعث بهتر یا بدتر شدن نتیجه شده.
چه عکسهایی برای سفر داخل تصویر بهترن؟
بهطور کلی هر تصویری که فضای قابلدرک و عمق واقعی داشته باشه شانس بیشتری داره.
مثلاً یک اتاق با میز و پنجره، خیابانی که تا دوردست ادامه دارد، یک شخصیت در مقابل معماری، نقاشیهای چندلایه یا تصاویری که جسمی در پیشزمینه دارند.
در مقابل، عکسهایی با پسزمینه کاملاً تخت یا فضای خالی مطلق، بعد از عبور دوربین از سوژه چیز زیادی برای نمایش ندارند.
راهنمای اصلی هم تصاویر دارای پیشزمینه قوی، عمق واضح، یک یا دو سوژه مشخص و نورپردازی قابلتشخیص را گزینههای مناسبتری معرفی میکند.
آیا این روش فقط برای نقاشی جواب میده؟
نه.
اتفاقاً یکی از جذابترین قسمتهای این تکنیک اینه که محدود به نقاشی نیست.
مثلاً میتونی یک عکس معمولی از خودت داشته باشی و دوربین رو از کنارت رد کنی.
یا یک تصویر AI از یک شهر آیندهنگر بسازی و بعد دوربین رو داخل خیابونها بفرستی.
برای عکس محصول هم میتونی حرکت Orbit بسازی.
حتی برای معماری و طراحی داخلی، حرکت دوربین داخل تصویر میتونه خروجی بسیار جذابی ایجاد کنه.
بنابراین چیزی که بهش میگیم «سفر داخل نقاشی» در اصل یکی از کاربردهای تکنیک گستردهتر تبدیل عکس به ویدیو با هوش مصنوعی است.
خلاصه خیلی سریع
اگر تا اینجا فقط دنبال فرمول کار بودی:
عکس مناسب انتخاب کن → مسیر دوربین رو مشخص کن → ①②③④ رو روی نسخه راهنما قرار بده → عکس رو وارد Image to Video کن → پرامپت رو بده → حرکت دوربین رو یکطرفه و پیوسته نگه دار → خروجی رو چند بار تست کن.
تمام!
سوالات پرتکرار
چطور یک عکس را با هوش مصنوعی به ویدیو تبدیل کنیم؟
برای این کار باید از یک مدل دارای قابلیت Image to Video استفاده کنید. عکس بهعنوان Reference وارد مدل میشود و با پرامپت میتوانید نوع حرکت سوژه، دوربین، عمق صحنه و سبک ویدیو را مشخص کنید.
چطور از یک نقاشی ویدیوی سهبعدی بسازیم؟
تصویر را بهصورت یک فضای سهبعدی تعریف کنید و داخل پرامپت به مدل توضیح دهید که پیشزمینه، سوژه و پسزمینه در عمقهای متفاوت قرار دارند. سپس یک مسیر واقعی برای حرکت دوربین تعریف کنید.
پرامپت تبدیل عکس به ویدیو باید شامل چه چیزهایی باشد؟
یک پرامپت مناسب باید مسیر دوربین، نحوه حرکت، لایههای عمق، Parallax، حفظ هویت سوژه و محدودیتهایی برای جلوگیری از Morphing و تغییر شکل اجسام را مشخص کند.
چطور جلوی تغییر چهره در Image to Video را بگیریم؟
حفظ هویت سوژه را صریحاً در پرامپت ذکر کنید و زاویه دوربین را بیشازحد تغییر ندهید. هرچه مدل مجبور شود بخش بیشتری از سر یا بدن را از خودش بازسازی کند، احتمال تغییر ظاهر بالاتر میرود.
چرا تصویر بهجای سهبعدی شدن فقط زوم میشود؟
معمولاً به این دلیل که مسیر حرکت دوربین و لایههای Parallax بهاندازه کافی مشخص نشدهاند. بهجای دستور ساده «حرکت به جلو»، توضیح دهید چه اجسامی از کنار دوربین عبور میکنند و کدام لایهها سریعتر یا کندتر حرکت میکنند.
بهترین زمان برای ویدیوی Flythrough چقدره؟
برای شروع میتوانید حدود ۷ ثانیه را امتحان کنید. زمان نهایی به مدل و پیچیدگی مسیر دوربین بستگی دارد.
حالا نوبت توئه 🎨
یه عکس انتخاب کن.
مسیر دوربینت رو طراحی کن.
شمارههای ① → ② → ③ → ④ رو مشخص کن.
پرامپت بالا رو کپی کن و نتیجه رو بساز.
اگر خروجی جالبی گرفتی، برامون بفرست؛ شاید نمونه بعدی که توی پیج منتشر میکنیم و تحلیلش میکنیم، ویدیوی تو باشه.
آموزشهای بیشتر ساخت عکس و ویدیو با هوش مصنوعی رو از AVENA DESIGN دنبال کن.




