اگر تا چند سال قبل ساخت یک ویدیوی سینمایی به دوربین، بازیگر، نورپردازی، لوکیشن، تجهیزات صدابرداری و ساعتها تدوین نیاز داشت، ابزارهای جدید هوش مصنوعی این فرایند را بهشدت تغییر دادهاند. یکی از مهمترین محصولات گوگل در این حوزه Google Flow است؛ محیطی که فقط یک «مولد ویدیو» نیست، بلکه بهتدریج به یک استودیوی کامل برای طراحی شخصیت، ساخت تصویر، تولید ویدیو، کنترل شات، تولید صدا، ویرایش ویدیو و کنار هم قرار دادن صحنهها تبدیل شده است.
Google Flow ابتدا بهعنوان ابزار فیلمسازی مبتنی بر مدل Veo معرفی شد، اما امروز قابلیتهای آن بسیار گستردهتر شده است. Flow اکنون در کنار خانواده مدلهای Veo 3.1 از Gemini Omni Flash برای تولید و ویرایش ویدیو، مدلهای Nano Banana برای تولید و اصلاح تصاویر و یک Flow Agent برای مدیریت فرایند خلاقانه استفاده میکند.
در این آموزش، از ساخت اولین Project شروع میکنیم و بعد به سراغ Text to Video، Ingredients، Frames، کنترل شخصیت، صدا، Custom Voice، Extend، Video Editing، Scenebuilder، Agent، Characters، Collections، Tools، خروجی 1080p و 4K و تکنیکهای حرفهای پرامپتنویسی میرویم.
مقالات مرتبط :
رفع محدودیت گوگل فلو (مشکل ریجن و باز نشدن)
خرید اکانت گوگل پرو ( اکانت جمینای پرو و گوگل فلو) – ۱۸ ماهه فقط ۶۰۰ هزار تومان
گوگل فلو چیست؟
Google Flow یک محیط خلاقانه مبتنی بر هوش مصنوعی از Google Labs است که برای ساخت تصاویر، ویدیوها، شاتها و داستانهای تصویری طراحی شده است. نکته مهم این است که Google Flow را نباید با Veo اشتباه گرفت.
Veo یک مدل هوش مصنوعی تولید ویدیو است، اما Flow محیطی است که مدلها و ابزارهای مختلف گوگل را در قالب یک Workflow واحد در اختیار شما قرار میدهد. به زبان ساده:
- Veo = موتور تولید ویدیو
- Nano Banana = موتور تولید و ویرایش تصویر
- Gemini Omni = موتور چندرسانهای تولید و ویرایش ویدیو
- Flow = استودیویی که این ابزارها را مدیریت و به یکدیگر متصل میکند
به همین دلیل، در یک پروژه Flow میتوانید ابتدا شخصیت خود را بسازید، تصویر مرجع تولید کنید، تصویر را اصلاح کنید، از روی آن ویدیو بسازید، همان شخصیت را در صحنه دوم نگه دارید، شات را ادامه دهید، صدا تولید کنید و در پایان چند کلیپ را در Scenebuilder پشت سر هم قرار دهید.
قابلیتهای اصلی Google Flow
Flow در نسخه فعلی قابلیتهای بسیار بیشتری نسبت به زمان معرفی اولیه دارد. مهمترین بخشهای آن شامل Text to Video، Image to Video، Frames to Video، Ingredients to Video، Characters، Voice References، Custom Voices، Video Editing، Extend، Scenebuilder، Image Generation، Image Editing، Flow Agent، Collections، Tools و مدیریت Assetها است.
مدل Veo 3.1 نیز علاوه بر تولید تصویر متحرک، روی هماهنگی شخصیتها، کنترل بصری، فیزیک واقعگرایانه و تولید صدای هماهنگ با تصویر تمرکز دارد.
ورود به Google Flow و ساخت اولین پروژه
پس از ورود به محیط Google Flow، صفحه Projects را مشاهده میکنید.
دکمه اصلی برای شروع کار + New project است.
با انتخاب آن یک پروژه جدید ساخته میشود. بهتر است برای هر فیلم، تبلیغ، موزیکویدیو، محتوای شبکه اجتماعی یا پروژه مشتری یک Project جداگانه ایجاد کنید. Flow تمام تصاویر، ویدیوها، شخصیتها، صحنهها، پرامپتها و نسخههای ویرایششده را داخل همان Project نگه میدارد. همچنین Projectهای Flow میان نسخه دسکتاپ و اپلیکیشن موبایل همگام میشوند.
آشنایی کامل با رابط Google Flow
یکی از نکات مهم برای کار حرفهای با Flow، شناخت اجزای رابط کاربری آن است.
| بخش یا دکمه | کاربرد |
|---|---|
| New Project | ساخت پروژه جدید |
| Prompt Box | نوشتن دستور برای تولید تصویر یا ویدیو |
| Model Selector | انتخاب مدل تولید |
| Image | ورود به حالت ساخت تصویر |
| Video | ورود به حالت ساخت ویدیو |
| Frames | تعیین Start Frame یا Start + End Frame |
| Ingredients | استفاده از تصاویر و Assetهای مرجع |
| Add | افزودن تصویر، ویدیو، Asset یا Voice |
| Generate | اجرای پرامپت |
| Agent | فعال کردن Flow Agent |
| Expand | باز کردن Agent در پنل بزرگتر |
| Settings | تنظیم مدل، تعداد خروجی، ابعاد و تنظیمات دیگر |
| Agent Instructions | تعیین دستورالعمل دائمی برای Agent |
| Search | جستوجوی Assetها |
| Filters | فیلتر تصاویر، ویدیوها، Uploadها و… |
| Characters | ساخت و مدیریت شخصیت |
| Tools | ساخت ابزار یا Mini App سفارشی |
| More | دسترسی به عملیات جانبی Asset |
| Add to Prompt | استفاده از Asset در پرامپت |
| Add to Scene | افزودن کلیپ به Scenebuilder |
| Download | دانلود خروجی |
| Share | اشتراکگذاری Asset |
| Publish to YouTube | انتشار مستقیم کلیپ در YouTube |
| Extend | ادامه دادن کلیپ |
| Save Frame | استخراج یک فریم از ویدیو |
| History | مشاهده نسخههای قبلی Asset |
| Save to Project | ذخیره یک Version قدیمی بهعنوان Asset مستقل |
| Crop | برش تصویر |
| Select | انتخاب بخشی از تصویر برای ویرایش |
| Draw | طراحی روی تصویر |
| Text | افزودن متن هنگام ویرایش تصویر |
| Rectangle | ترسیم ناحیه مستطیلی |
| Collection | گروهبندی Assetها |
| Download Project | دانلود پروژه |
گوگل علاوه بر Grid View حالت Batch View را نیز ارائه میکند. در Batch View، نسلهای مختلف محتوا پشت سر هم همراه جزئیات نمایش داده میشوند. در Settings میتوان Grid Size، پخش صدا هنگام Hover، نمایش جزئیات Tile و حتی پاک شدن خودکار Prompt بعد از Generation را کنترل کرد.
انتخاب مدل در Google Flow؛ مهمترین تصمیم قبل از Generate
در Flow یک اشتباه رایج این است که کاربر فقط بهترین مدل از نظر کیفیت اسمی را انتخاب میکند. در حالی که مدل مناسب باید بر اساس نوع عملیات انتخاب شود. در نسخه فعلی Flow، خانواده اصلی مدلهای ویدیویی شامل Veo 3.1 Lite، Veo 3.1 Fast، Veo 3.1 Quality و Gemini Omni Flash 1.1 است.
| مدل | کاربرد مناسب | مدتهای مستندشده |
|---|---|---|
| Veo 3.1 Lite | تست، Iteration سریع، Text/Frames/Ingredients | 4، 6 و 8 ثانیه |
| Veo 3.1 Fast | تولید سریع با کیفیت بالاتر | 4، 6 و 8 ثانیه |
| Veo 3.1 Quality | شاتهای نهایی با اولویت کیفیت | 4، 6 و 8 ثانیه |
| Gemini Omni Flash 1.1 | تولید و خصوصاً ویرایش ویدیو | 4، 6، 8 و 10 ثانیه |
| Omni Flash 360p | Draft کمهزینه | تا 10 ثانیه |
| Omni Flash 720p | خروجی استاندارد | تا 10 ثانیه |
نکته مهم این است که تمام قابلیتها روی تمام مدلها فعال نیستند. برای مثال Gemini Omni Flash از Video-to-Video Editing پشتیبانی میکند؛ در حالی که Veo 3.1 Lite، Fast و Quality در صفحه فعلی Model Support برای این قابلیت پشتیبانی نشدهاند.
ساخت ویدیو از متن؛ Text to Video در Google Flow
سادهترین روش ساخت ویدیو، Text to Video است. داخل Project به Prompt Box بروید، حالت Video را انتخاب کنید و مدل موردنظر را تعیین کنید.
سپس صحنه را توضیح دهید. یک پرامپت ضعیف ممکن است این باشد:
A man walking in a street.
این دستور قابل اجراست، اما کنترل بسیار کمی به مدل میدهد. نسخه حرفهایتر میتواند چنین باشد:
A cinematic medium shot of a 35-year-old man wearing a dark wool coat walking slowly through a narrow Parisian street at dawn. Soft fog fills the background. Warm light from old cafes reflects on the wet pavement. The camera slowly tracks backward in front of him. Natural body movement, realistic cloth physics, shallow depth of field, 35mm cinematic lens, subtle film grain.
تفاوت اصلی، میزان اطلاعاتی است که به مدل درباره سوژه، حرکت، محیط، نور، دوربین و استایل میدهیم. گوگل نیز در راهنمای رسمی Flow توصیه میکند Subject، Action، Environment، Lighting و Style با جزئیات توصیف شوند.
فرمول حرفهای نوشتن پرامپت برای Google Flow
یک پرامپت خوب را میتوان تقریباً با ساختار زیر طراحی کرد:
Subject + Appearance + Action + Environment + Camera Shot + Camera Motion + Lighting + Visual Style + Audio + Constraints
مثلاً:
A young female astronaut with short black hair stands beside a damaged rover on Mars. She slowly turns toward the horizon as a distant dust storm approaches. Wide cinematic shot, slow dolly-in, low camera angle, dramatic orange sunset, realistic Mars atmosphere, subtle wind moving her suit fabric. Deep cinematic ambience, distant wind and mechanical radio noise. No text, no subtitles.
این ساختار احتمال خروجی قابلکنترل را بسیار بیشتر میکند.
Camera Shot؛ چگونه نوع شات را مشخص کنیم؟
Flow و Veo اصطلاحات سینمایی را بهخوبی درک میکنند. برای تعیین کادر میتوانید از اصطلاحاتی مانند Extreme Wide Shot، Wide Shot، Medium Shot، Medium Close-Up، Close-Up، Extreme Close-Up، Over-the-Shoulder Shot، Low-Angle Shot، High-Angle Shot و Top-Down Shot استفاده کنید.
برای مثال:
Close-up portrait, shallow depth of field.
یا:
Wide establishing shot of a futuristic Tokyo street.
توصیه مهم این است که در یک Generation کوتاه چند حرکت پیچیده دوربین را همزمان درخواست نکنید. یک شات ۶ یا ۸ ثانیهای معمولاً با یک حرکت مشخص دوربین پایدارتر است.
Camera Motion؛ حرکت دوربین در Google Flow
از مهمترین مزیتهای Flow برای کاربران حرفهای، قابلیت کنترل حرکت دوربین است. اصطلاحاتی مانند Dolly In، Dolly Out، Tracking Shot، Truck Left، Truck Right، Pan Left، Pan Right، Tilt Up، Tilt Down، Crane Shot، Orbit Shot، Handheld Camera و Static Camera معمولاً در Prompt قابل استفاده هستند.
مثلاً:
The camera slowly orbits clockwise around the product while keeping it perfectly centered.
بهجای:
Camera moves around.
هرچه مسیر حرکت دوربین واضحتر باشد، مدل فضای کمتری برای تفسیر اشتباه خواهد داشت. برخی کنترلهای Camera Position و Camera Motion پیشرفته در نسخه دسکتاپ Flow ارائه میشوند؛ گوگل نیز فعلاً قابلیتهای پیشرفتهای مانند Scenebuilder و Camera Position & Motion را دسکتاپمحور اعلام کرده است.
ساخت ویدیو با عکس؛ Frames to Video
یکی از کاربردیترین بخشهای Google Flow، Frames to Video است. در این حالت میتوانید یک تصویر را بهعنوان اولین فریم ویدیو تعیین کنید. مسیر کلی آن:
Video → Frames → Add start frame است.
سپس توضیح میدهید که از این تصویر چه حرکتی ایجاد شود. مثلاً اگر عکس یک خودرو دارید:
The car slowly accelerates forward while the camera follows from a low rear tracking angle. Reflections move naturally across the bodywork.
مدل ظاهر اولیه را از تصویر میگیرد و حرکت را از متن.
First and Last Frame؛ کنترل ابتدا و انتهای شات
یکی از قدرتمندترین ابزارهای Flow امکان مشخص کردن دو فریم است:
Start Frame و End Frame
در این حالت شما مشخص میکنید ویدیو دقیقاً از چه ترکیبی شروع شود و به چه ترکیبی برسد. این ویژگی برای Transitionها فوقالعاده است. فرض کنید تصویر اول یک شهر مدرن در روز و تصویر دوم همان شهر در شب است. با قرار دادن این دو تصویر میتوانید بنویسید:
Time rapidly passes from afternoon to night. Traffic gradually increases, building lights turn on one by one, and the sky smoothly transitions from blue to deep navy. Keep the architecture unchanged.
Flow سعی میکند مسیر میان این دو Frame را تولید کند. مدلهای Veo 3.1 و Gemini Omni Flash فعلی از Start/End Frame پشتیبانی میکنند، هرچند دسترسی دقیق به بعضی حالتها ممکن است بر اساس مدل یا پلتفرم متفاوت باشد.
Ingredients to Video چیست؟
اگر بخواهیم فقط یک قابلیت Flow را برای تولید حرفهای ویدیو انتخاب کنیم، Ingredients یکی از مهمترین گزینههاست. Ingredient یعنی یک Reference Asset که به مدل میگوید یک عنصر باید چگونه به نظر برسد. این Reference ممکن است شخصیت، محصول، شیء، لوکیشن یا Style باشد. بهجای اینکه در هر پرامپت دوباره ظاهر شخصیت را توضیح دهید، تصویر شخصیت را بهعنوان Ingredient اضافه میکنید. مسیر:
Video → Ingredients → Add
سپس تصاویر مرجع را انتخاب میکنید. گوگل پیشنهاد میکند Referenceهای مربوط به سوژه یا محصول تا جای ممکن پسزمینه ساده یا جداشده داشته باشند؛ زیرا وجود چند سوژه اضافی در یک تصویر Reference میتواند مدل را دچار ابهام کند.
چگونه از چند Ingredient همزمان استفاده کنیم؟
فرض کنید سه Ingredient دارید:
- تصویر یک زن
- تصویر یک خودرو
- تصویر یک خیابان بارانی
میتوانید در Prompt نحوه استفاده دقیق از آنها را توضیح دهید:
Use the woman as the main character. She opens the driver's door of the referenced black sports car on the referenced rainy street. Keep her face and outfit consistent with the reference.
اصل مهم این است که فقط تصاویر را آپلود نکنید؛ نقش هر Reference را در متن مشخص کنید.
استفاده از @ برای فراخوانی Asset
یکی از قابلیتهای بسیار مفید Flow، ارجاع مستقیم به Assetهای Project با علامت @ است. زمانی که در Prompt علامت @ را تایپ میکنید، میتوانید Asset یا Character موجود در پروژه را انتخاب کنید.
مثلاً:
@Sara walks toward the camera.
یا برای Avatar شخصی:
@me sitting in a modern recording studio.
این ساختار مخصوصاً زمانی مفید است که Project شما دهها تصویر و Character داشته باشد.
Characters؛ راه حرفهای حفظ ثبات شخصیت
برای پروژههایی که یک شخصیت چند بار در صحنههای مختلف ظاهر میشود، فقط استفاده از یک Reference Image همیشه کافی نیست.
- Flow بخشی مستقل به نام Characters دارد.
- Character میتواند مجموعهای از Referenceهای بصری و صوتی یک شخصیت باشد.
- گوگل میگوید Character میتواند ظاهر صورت، لباس و Voice را میان Generationهای مختلف پایدار نگه دارد.
- برای ساخت Character وارد بخش Characters شوید و New Character را انتخاب کنید.
- ظاهر شخصیت را توضیح دهید و یک یا دو تصویر مرجع اضافه کنید.
- Character حداقل باید یک Reference Image داشته باشد.
- سپس میتوانید برای آن Name، Voice و Character Info مشخص کنید.
- بعد از ذخیره، Character با نام خود از طریق
@داخل Prompt قابل فراخوانی است.
این روش برای فیلم کوتاه، تبلیغات سریالی، کاراکتر برند و پروژههایی که Identity Consistency اهمیت دارد بسیار بهتر از تعریف مجدد شخصیت در هر شات است.
Voice Reference؛ ثابت نگه داشتن صدای شخصیت
Flow فقط ظاهر شخصیت را حفظ نمیکند. در نسل جدید قابلیتهای Flow میتوانید از Voice Reference استفاده کنید. برای این کار Omni Flash را انتخاب کنید و وارد Ingredients شوید. سپس:
Add → Voices
را انتخاب کنید. میتوانید Voice را Preview کرده و سپس با @Voice در پرامپت به آن اشاره کنید.
مثلاً:
@Voice: Andrew
گوگل در مستندات فعلی این قابلیت را برای Video Generation مبتنی بر Ingredients توضیح داده است.
Custom Voice؛ ساخت صدای اختصاصی
یکی از قابلیتهای جالبتر Flow امکان تغییر ویژگیهای یک Voice آماده است. از مسیر:
Add → Voices → Create New Voice
میتوانید یک Base Voice انتخاب کنید. سپس برای Voice نام تعیین میکنید و در بخش Voice Performance توضیح میدهید چه تغییری انجام شود.
مثلاً:
Warm, calm documentary narrator with a subtle British accent and slightly breathy delivery.
یا:
Energetic young male voice with quick pacing and an enthusiastic advertising tone.
همچنین میتوانید Sample Dialogue وارد کنید و قبل از Save صدای نمونه را بشنوید.
تولید دیالوگ، افکت صوتی و صدای محیط
یکی از تفاوتهای مهم نسل جدید Veo با بسیاری از مدلهای قدیمی Video AI، تولید Audio همراه تصویر است.
Veo میتواند Environmental Sound، Sound Effect و Speech تولید کند. قابلیت Audio ابتدا محدودتر بود اما بعداً به Ingredients، Frames و Extend نیز اضافه شد. برای کنترل بهتر، بخش صوتی را واضح در Prompt بنویسید.
مثلاً:
Audio: heavy rain hitting the windows, distant thunder, subtle room tone.
برای دیالوگ:
The woman looks at him and says: "We don't have much time."
برای جلوگیری از دیالوگ:
No dialogue. Only environmental ambience.
برای جلوگیری از نوشته روی تصویر نیز بهتر است در صورت نیاز صراحتاً بنویسید:
No subtitles, no captions, no text overlays.
ساخت ویدیو عمودی 9:16
Flow و Veo 3.1 امکان ساخت ویدیو در Aspect Ratioهای مناسب محتوای افقی و عمودی را ارائه میکنند. برای Instagram Reels، TikTok و YouTube Shorts میتوانید خروجی Portrait انتخاب کنید.
Google در ارتقای Veo 3.1 پشتیبانی Native از ویدیوی عمودی 9:16 را نیز معرفی کرده است؛ یعنی مدل میتواند Composition را برای قاب عمودی تولید کند و مجبور نیستید ویدیو افقی را Crop کنید. برای محتوای عمودی بهتر است داخل Prompt هم Composition را توضیح دهید:
Vertical composition, subject centered in the upper-middle portion of the frame, enough negative space around the face for mobile viewing.
Animate؛ تبدیل سریع عکس به ویدیو
در نسخه موبایل Flow، هنگام انتخاب تصویر میتوانید از گزینه Animate استفاده کنید. پس از انتخاب تصویر، Animate را بزنید و حرکت موردنظر را توضیح دهید.
مثلاً:
Her hair gently moves in the wind as she slowly turns toward the camera.
این قابلیت برای جانبخشی سریع به تصاویر پرتره، Product Shotها و Concept Artها بسیار کاربردی است.
Extend؛ چگونه ویدیو را ادامه دهیم؟
فرض کنید یک کلیپ عالی ۸ ثانیهای تولید کردهاید اما میخواهید حرکت ادامه پیدا کند. بهجای تولید ویدیوی جدید از ابتدا، میتوانید از Extend استفاده کنید. ویدیوی موردنظر را باز کنید، گزینه Extend را انتخاب کنید و توضیح دهید بعد از پایان کلیپ چه اتفاقی بیفتد.
مثلاً:
The camera continues moving forward through the doorway and reveals a huge futuristic laboratory filled with blue light.
Flow از انتهای ویدیوی قبلی برای ادامه حرکت استفاده میکند. گوگل توضیح داده است که Extend برای ایجاد شاتهای طولانیتر و حفظ پیوستگی حرکت مفید است.
نکته مهم این است که Support دقیق Extend بین مدلها تغییر میکند. در زمان نگارش این مطلب، صفحه Model Support برای Veo 3.1 Lite پشتیبانی Extend را بهصراحت نشان میدهد، در حالی که جدول Credit Cost برای مدلهای بیشتری ردیف Extend دارد. بنابراین قبل از تولید نهایی، وضعیت همان مدل را داخل Model Selector بررسی کنید.
Video-to-Video Editing؛ ویرایش ویدیوی واقعی با متن
این بخش یکی از بزرگترین تغییرات Flow در سال ۲۰۲۶ است. با Gemini Omni Flash میتوانید ویدیوی موجود را وارد Flow کنید و با Prompt آن را تغییر دهید.
برای مثال:
Change the daytime lighting to a cinematic sunset.
یا:
Replace the background with a snowy pine forest while preserving the actor.
یا:
Add the text "COMING SOON" in the background as a realistic neon sign.
برای Video Editing در نسخه دسکتاپ، Flow فایلهای MOV، MP4، AVI و WMV را میپذیرد. فایل آپلودی میتواند تا ۱ گیگابایت باشد؛ برای ویدیوهای بلندتر از ۳۰ ثانیه باید بخشی را Trim کنید و برای عملیات Edit نیز میتوان تا یک Segment دهثانیهای را انتخاب کرد. Flow امکان چند مرحله Follow-up Editing را نیز فراهم میکند.
Insert و Remove؛ اضافه یا حذف کردن عناصر
Flow قابلیتهای Generative Editing برای اضافه یا حذف کردن عناصر صحنه را نیز توسعه داده است. در حالت Insert میتوانید عنصر جدیدی به صحنه اضافه کنید و مدل تلاش میکند نور، سایه و Perspective آن را با محیط هماهنگ کند.
مثلاً:
Add a small red vintage suitcase beside the character.
در Remove میتوان یک Object یا Character نامطلوب را حذف کرد و سیستم Background را بازسازی میکند. گوگل این دسته از قابلیتها را بهعنوان بخشی از ابزارهای ویرایشی پیشرفته Flow معرفی کرده است. در بعضی Workflowها دسترسی به Insert، Remove و Camera بسته به نوع Clip، مدل و Region متفاوت است. برای نمونه Google تصریح کرده که این Edit Modes روی Extended Clips قابل اعمال نیستند.
Save Frame؛ یک قابلیت کوچک اما بسیار حرفهای
یکی از بهترین تکنیکها برای ساخت صحنههای پیوسته این است که از ویدیوی قبلی یک Frame استخراج کنید.
- ویدیو را Pause کنید.
- روی Frame موردنظر قرار بگیرید.
- Save Frame را انتخاب کنید.
- حالا این Frame تبدیل به یک Image Asset میشود.
- سپس میتوانید آن را بهعنوان Start Frame صحنه بعدی استفاده کنید.
این روش یکی از بهترین تکنیکها برای ایجاد Shot Continuity است.
History و Stack؛ هیچ نسخهای را از دست ندهید
Flow ویرایشها را بهصورت Stack نگه میدارد. فرض کنید تصویر اصلی را سه بار تغییر دادهاید. بهجای اینکه نسخه قدیمی حذف شود، Versionهای مختلف در History باقی میمانند. اگر نسخه دوم بهتر بود، میتوانید آن را انتخاب و با Save to Project دوباره به یک Asset مستقل تبدیل کنید. این قابلیت برای Iteration حرفهای بسیار مهم است؛ زیرا در Generative AI همیشه آخرین Generation بهترین Generation نیست.
Scenebuilder چیست؟
تا اینجا درباره ساخت یک Clip صحبت کردیم. اما یک فیلم یا تبلیغ معمولاً از چند شات ساخته میشود. اینجاست که Scenebuilder وارد میشود. برای اضافه کردن یک ویدیو:
More → Add to Scene
را انتخاب کنید. کلیپ وارد Timeline یا Sequence مربوط به Scene میشود. Scenebuilder امکان مرتب کردن کلیپها، تغییر ترتیب، Trim ابتدا و انتهای هر Clip، Preview کل Sequence و Download Scene نهایی را فراهم میکند.
Scenebuilder جای Premiere Pro یا DaVinci Resolve را بهطور کامل نمیگیرد، اما برای ساخت Rough Cut و کنار هم قرار دادن خروجیهای AI بسیار مفید است.
Flow Agent؛ دستیار خلاق داخلی Google Flow
یکی از مهمترین امکانات جدید Flow، Flow Agent است. با فعال کردن دکمه Agent، Prompt Box معمولی به یک رابط مکالمهای تبدیل میشود. Agent میتواند ایدهپردازی کند، Storyboard پیشنهاد دهد، Prompt بنویسد، Image یا Video تولید کند، Asset ویرایش کند، چند Variation بسازد و حتی Assetهای Project را مرتب کند. مثلاً میتوانید بنویسید:
Create a 5-shot storyboard for a luxury watch commercial set in a rainy nighttime city.
بعد از آن Agent میتواند ساختار شاتها را پیشنهاد کند.
یا:
Create 6 variations of this product shot with different cinematic lighting setups.
Agent میتواند Batch Generation انجام دهد.
Expanded Agent و Sessions
با دکمه Expand میتوانید Agent را در یک Side Panel بزرگ باز کنید. مکالمات Agent به شکل Sessions ذخیره میشوند و هر Session به Project مربوط است. بنابراین میتوانید یک Session برای ایدهپردازی، یک Session برای تبلیغ اصلی و یک Session برای اصلاح خروجیها داشته باشید.
Sessionها قابلیت Rename و Delete نیز دارند. حذف Session فقط History گفتوگو را حذف میکند و Assetهایی که قبلاً تولید شدهاند باقی میمانند.
Agent Instructions؛ ساخت یک دستیار هماهنگ با پروژه
یکی از قابلیتهای حرفهایتر، Agent Instructions است. در این بخش میتوانید دستورهای ثابت پروژه را تعریف کنید.
مثلاً:
All generated videos must follow a premium cinematic commercial style. Use dark backgrounds, soft directional lighting and minimal compositions. Avoid bright cartoon colors.
از آن به بعد Agent میتواند این دستورها را در کل Project در نظر بگیرد. این قابلیت برای Brand Consistency بسیار ارزشمند است.
Confirm Before Generating
Agent قادر است به نمایندگی از شما Generation انجام دهد و Credit مصرف کند. در Agent Settings گزینه:
Confirm before generating وجود دارد.
حالت Always باعث میشود قبل از عملیات دارای هزینه از شما تأیید گرفته شود. حالت Never اجازه میدهد Agent بدون توقف Generation انجام دهد و Credit مصرف کند. برای شروع بهتر است Always فعال باشد.
تولید و ویرایش تصویر داخل Flow
یکی دیگر از تغییرات مهم Flow این است که لازم نیست برای ساخت تصاویر Reference به ابزار جداگانهای بروید. Flow اکنون Image Generation و Image Editing را مستقیماً داخل Project انجام میدهد.
در Model Selector حالت Image را انتخاب کنید. مدلهای فعلی شامل Nano Banana Pro، Nano Banana 2 و Nano Banana 2 Lite هستند. این تصاویر میتوانند بعداً بهعنوان Start Frame، End Frame یا Ingredient وارد ویدیو شوند.
Select Image؛ ویرایش فقط یک بخش تصویر
اگر نمیخواهید کل تصویر تغییر کند، ابزار Select بسیار مهم است.
- تصویر را باز کنید.
- Select را انتخاب کنید.
- ناحیه موردنظر را مشخص کنید.
سپس مثلاً بنویسید:
Replace the watch with a silver luxury chronograph.
یا:
Remove the coffee cup.
مدل تلاش میکند فقط همان ناحیه را تغییر دهد.
Crop، Draw، Text و Rectangle
Flow چند ابزار دستی نیز برای Image Editing دارد.
- Crop برای اصلاح Composition و نسبت تصویر است.
- Draw اجازه میدهد روی Image علامت بزنید.
- Text برای قرار دادن Text روی تصویر یا مشخص کردن ناحیه متنی استفاده میشود.
- Rectangle نیز امکان مشخص کردن یک محدوده مستطیلی را فراهم میکند.
این ابزارها به شما کمک میکنند Prompt را با Guidance بصری ترکیب کنید.
Google Flow Tools؛ ساخت ابزار اختصاصی بدون برنامهنویسی
یکی از پیشرفتهترین قابلیتهای جدید Flow، بخش Tools است. Tools اجازه میدهد با زبان طبیعی یک Mini App اختصاصی بسازید.
مثلاً:
Create a product-shot generator with controls for camera angle, background style, lighting softness and aspect ratio.
یا:
Build a storyboard generator that creates six frames based on a commercial brief.
Flow رابط و Code لازم را تولید میکند.
برای ساخت:
Tools → Create Tool
را انتخاب کنید و نیازتان را توضیح دهید. سپس Generate را بزنید. بعد از ساخته شدن Tool میتوانید رابط را بررسی و Save کنید.
Edit، Favorite، Pin و Remix Tool
Tools نیز مدیریت کامل دارند.
- Edit برای تغییر Tool با زبان طبیعی است.
- Favorite باعث میشود Tool در سطح عمومی حساب شما سریعتر در دسترس باشد.
- Pin آن را داخل Project فعلی در دسترس نگه میدارد.
- Remix Tool یک نسخه شخصی از Tool میسازد که میتوانید آن را تغییر دهید.
Tools را میتوان با Link نیز Share کرد. توجه کنید افرادی که لینک Tool را دارند میتوانند به Code، نام و Thumbnail Tool دسترسی داشته باشند.
مدیریت Assetها؛ تفاوت یک پروژه منظم و شلوغ
بعد از چند ساعت کار با Flow ممکن است صدها Asset داشته باشید. در Sidebar میتوانید Assetها را بر اساس All Media، Images، Videos، Characters، Scenes و Uploads فیلتر کنید.
Search Flow فقط بر Filename متکی نیست؛ میتواند محتوای بصری Asset را نیز تحلیل کند.
بنابراین عباراتی مانند:
melancholyfast cars
میتوانند Assetهای مرتبط را پیدا کنند، حتی اگر این کلمات در نام فایل یا Prompt اولیه وجود نداشته باشند.
Collections؛ پوشهبندی حرفهای Assetها
برای Projectهای بزرگ از Collections استفاده کنید. مثلاً میتوانید Collectionهای جداگانه برای Character References، Product Shots، Selected Clips، Rejected Tests، Scene 01 و Scene 02 داشته باشید.
Collection میتواند Collection دیگری را نیز داخل خود داشته باشد. برای ایجاد Collection از:
Add → Create Collection
استفاده کنید. همچنین میتوانید یک Asset را روی Asset دیگر Drag کنید تا Collection ساخته شود.
Grid Mode و Batch Mode
در Project Settings دو روش مهم نمایش وجود دارد.
- Grid Mode برای مرور سریع و بصری Generationها مناسب است.
- Batch Mode برای مقایسه مجموعهای از Generationها همراه Metadata بهتر است. اگر در حال تست ۲۰ Variation از یک Shot هستید، Batch Mode میتواند بررسی خروجیها را راحتتر کند.
دانلود ویدیو از Google Flow
روی Asset موردنظر این گزینه را انخاب کنید:
More → Download
Flow امکان دریافت Video File و در برخی حالتها GIF را دارد. برای GIF، گزینه 270p نیز ارائه میشود. گوگل همچنین قابلیت Upscale را برای خروجیهای باکیفیتتر ارائه کرده است.
1080p و 4K در Google Flow
یکی از بهروزرسانیهای مهم Flow امکان آمادهسازی خروجی با رزولوشن بالاتر است. گوگل قابلیت Upscale به 1080p و 4K را برای Workflowهای حرفهای توسعه داده است. در ساخت Draft بهتر است ابتدا Generation ارزانتر انجام شود و فقط خروجی منتخب Upscale شود.
این روش خصوصاً با Omni 360p مفید است. بهجای اینکه برای ده Variation از ابتدا خروجی سنگین بگیرید، آنها را با Draft 360p تولید کنید، بهترین مورد را انتخاب کنید و بعد سراغ خروجی نهایی بروید.
Omni 360p؛ ابزار بسیار مهم برای کاهش مصرف Credit
Gemini Omni Flash امکان Generation در Draft Resolution یعنی 360p را دارد. این حالت Credit کمتری نسبت به 720p مصرف میکند. برای فرایند حرفهای، ابتدا Composition، Motion و Prompt را با 360p تست کنید.
بعد از رسیدن به نتیجه مناسب، نسخه نهایی را با Resolution بالاتر تولید یا Upscale کنید. گوگل این Workflow را مشخصاً برای Draft سریع و کمهزینه معرفی کرده است.
سیستم Credit در Google Flow
هر Generation بر اساس مدل و نوع عملیات Credit مصرف میکند. در زمان نگارش این مقاله، گوگل روزانه ۵۰ Flow Credit برای استفاده آزمایشی در نظر گرفته و پلنهای اشتراکی Credit ماهانه بیشتری دریافت میکنند. Google AI Plus دارای ۲۰۰ Credit اضافه ماهانه، Pro دارای ۱۰۰۰ Credit، Ultra 100 دارای ۱۰ هزار Credit و Ultra 200 دارای ۲۵ هزار Credit ماهانه است. این مقادیر ممکن است در آینده تغییر کنند.
هزینه Generation نیز وابسته به مدل است.
| عملیات | Credit فعلی تقریبی طبق جدول رسمی |
|---|---|
| Veo 3.1 Lite | 10 برای کاربران غیر Ultra |
| Veo 3.1 Fast | 20 برای کاربران غیر Ultra |
| Veo 3.1 Quality | 100 |
| Omni Flash 720p چهارثانیهای | 7 |
| Omni Flash 720p ششثانیهای | 10 |
| Omni Flash 720p هشتثانیهای | 12 |
| Omni Flash 720p دهثانیهای | 15 |
| Video Editing با Omni | 40 |
| Upscale 1080p برای مشترکان Plus/Pro/Ultra | در جدول فعلی 0 Credit |
هزینهها سریع تغییر میکنند؛ بنابراین برای عدد نهایی همیشه Model Settings داخل Flow را بررسی کنید. خود گوگل نیز همین روش را توصیه میکند.
بهترین Workflow برای کاهش مصرف Credit
کاربر حرفهای نباید اولین Prompt خود را با گرانترین مدل اجرا کند.
- ابتدا Concept را با Image Generation تثبیت کنید.
- بعد Referenceها را بسازید.
- سپس Motion را با Lite یا Omni Draft آزمایش کنید.
- وقتی Camera، Character، Timing و Style درست شد، Generation نهایی را با مدل باکیفیتتر انجام دهید.
این روش میتواند دهها Generation گرانقیمت غیرضروری را حذف کند.
Share؛ اشتراکگذاری خروجی
از طریق:
More → Share
میتوانید لینک Asset را ایجاد کنید.
گزینه Include inputs نیز وجود دارد که در صورت فعال بودن، Inputها یا Ingredients استفادهشده همراه Creation قابل مشاهده خواهند بود. نکته مهم این است که طبق راهنمای فعلی Google، برای توقف Share یک Asset باید Creation اصلی را از Flow حذف کنید.
انتشار مستقیم روی YouTube
Google Flow میتواند کلیپ تولیدشده را مستقیماً به YouTube ارسال کند.
از:
More → Publish to YouTube
استفاده کنید. بعد از اتصال Channel میتوانید Title، Description، Visibility، Tags و Category را تعیین کنید. فعلاً Upload مستقیم بیشتر برای Clipهای مستقل است؛ برای یک Sequence کامل Scenebuilder باید فایل Scene را دانلود و سپس با YouTube Studio آپلود کنید.
SynthID؛ واترمارک نامرئی Google
ویدیوهای AI تولیدشده توسط Flow دارای SynthID هستند. SynthID یک واترمارک نامرئی برای شناسایی محتوای تولیدشده توسط هوش مصنوعی Google است. این واترمارک بخشی از رویکرد Google برای شناسایی Generated Content محسوب میشود و Google توصیه میکند در آن دستکاری نشود.
ساخت Avatar از خودتان
Flow همچنین قابلیت Avatar دارد. آواتار یک نسخه دیجیتال از چهره و صدای خود کاربر است. برای ایجاد آن، فرایند تأیید Face و Voice انجام میشود. بعد از ساخته شدن Avatar میتوانید با دستور:
@me
از آن در Prompt استفاده کنید.
مثلاً:
@me presenting a technology product in a minimal futuristic studio.
به دلایل حریم خصوصی و ایمنی، Avatar را نمیتوان از طریق Public Project Link یا Flow Tools به اشتراک گذاشت. همچنین این قابلیت در EEA، بریتانیا و سوئیس در دسترس نیست.
وضعیت Google Flow در ایران
Google Flow از زبان فارسی در فهرست زبانهای پشتیبانیشده نام برده است، هرچند خود Google برای رسیدن به بهترین کیفیت Prompt همچنان استفاده از زبان انگلیسی را توصیه میکند.
اما در زمان نگارش این مقاله، ایران در فهرست رسمی کشورهای پشتیبانیشده Google Flow قرار ندارد. بنابراین فعال بودن زبان فارسی به معنی پشتیبانی رسمی سرویس در ایران نیست. گوگل همچنین تصریح میکند که قابلیتها ممکن است براساس Region متفاوت باشند.
آیا پرامپت فارسی یا انگلیسی بهتر است؟
Flow و محصولات گوگل از زبان فارسی پشتیبانی دارند، اما گوگل رسماً توصیه میکند برای بهترین نتیجه از English Prompts استفاده شود. دلیل اصلی، فقط ترجمه نیست.
اصطلاحات سینمایی مانند:
slow dolly-inshallow depth of field35mm lensvolumetric lightingtracking shotrim lighthandheld documentary camera
در English Prompt معمولاً دقیقتر تفسیر میشوند. بنابراین حتی اگر ایده را فارسی مینویسید، بهتر است نسخه نهایی Prompt را انگلیسی کنید.
تکنیک حرفهای حفظ چهره شخصیت
برای حفظ Character Consistency فقط نوشتن:
same woman
کافی نیست.
- بهتر است یک Character بسازید یا یک Reference اصلی داشته باشید.
- سپس در هر Shot همان Character یا Ingredient را فراخوانی کنید.
- لباس، Hair Style و ویژگیهای ظاهری را نیز بدون دلیل تغییر ندهید.
- اگر Scene جدید است، فقط Environment و Action را تغییر دهید.
این روش احتمال Drift شخصیت را کاهش میدهد.
تکنیک حرفهای Product Video
برای Product Commercial ابتدا یک Reference تمیز از محصول بسازید.
پسزمینه Reference بهتر است ساده باشد.
در Prompt مشخص کنید:
Preserve the exact product shape, proportions, materials, logo placement and color.
بعد Camera Motion را جداگانه تعریف کنید.
مثلاً:
Slow clockwise orbit, 30 degrees, product remains centered.
و سپس Lighting:
Soft studio key light from upper left, narrow rim light from behind, dark premium background.
همین ساختار معمولاً نسبت به جمله مبهم «یک تبلیغ لوکس بساز» خروجی کنترلشدهتری ایجاد میکند.
تکنیک حرفهای برای فیلمهای چندشاته
برای ساخت یک فیلم ۳۰ یا ۶۰ ثانیهای، از Flow نخواهید در یک Generation کل فیلم را بسازد.
فیلم را به Shot تقسیم کنید.
مثلاً:
- Shot 01 نمای معرفی محیط باشد.
- Shot 02 شخصیت را معرفی کند.
- Shot 03 Action اصلی را نشان دهد.
- Shot 04 Close-Up باشد.
- Shot 05 Product Reveal یا Ending باشد.
هر Shot را جداگانه بسازید.
برای اتصال بصری، Frame پایانی شات قبلی را Save کنید و بهعنوان Reference یا Start Frame شات بعدی استفاده کنید.
سپس تمام کلیپها را در Scenebuilder قرار دهید.
این روش بسیار نزدیکتر به Workflow واقعی فیلمسازی است.
چگونه Prompt خراب را اصلاح کنیم؟
اگر خروجی مشکل دارد، کل Prompt را از ابتدا تغییر ندهید.
اول بفهمید مشکل کدام لایه است.
- اگر صورت شخصیت تغییر کرده، Reference را اصلاح کنید.
- اگر دوربین اشتباه حرکت میکند، Camera Motion را سادهتر کنید.
- اگر Objectها تغییر میکنند، Constraint دقیقتری بدهید.
- اگر Scene بیش از حد شلوغ است، عناصر را کم کنید.
- اگر Motion غیرطبیعی است، Action را به یک حرکت اصلی محدود کنید.
- اگر Style ناهماهنگ است، Referenceهای بصری را از نظر Style به یکدیگر نزدیکتر کنید.
Generative Video یک فرایند Iterative است، نه یک Prompt جادویی.
اشتباه بزرگ: پرامپت بیش از حد پیچیده
پرامپت طولانی همیشه بهتر نیست.
اگر در یک کلیپ ۸ ثانیهای درخواست کنید شخصیت راه برود، صحبت کند، خودرو منفجر شود، دوربین ۳۶۰ درجه بچرخد، باران شروع شود و Scene از روز به شب تبدیل شود، مدل باید چند دستور پیچیده را همزمان حل کند.
نتیجه معمولاً بیثباتتر خواهد بود.
بهترین Prompt فقط «جزئی» نیست؛ ساختارمند و قابل اجرا در زمان Clip است.
Negative Prompt را چگونه جایگزین کنیم؟
Flow همیشه مثل بعضی مدلهای تصویر یک فیلد مستقل Negative Prompt ندارد.
اما میتوانید Constraints را داخل همان Prompt بنویسید.
مثلاً:
No subtitles. No text overlays. No logos. No additional people. No camera shake.
بهتر است Negative Instructions کوتاه و دقیق باشند.
Search هوشمند؛ پروژههای بزرگ را سریع مدیریت کنید
اگر صدها Asset دارید، لازم نیست همه را دستی پیدا کنید.
Search میتواند Visual Descriptor، رنگ، Emotion و Vibe را در Assetها تشخیص دهد.
مثلاً:
red sports carnight citymelancholy portraitwarm sunset
این قابلیت Flow را به یک Media Library هوشمند تبدیل میکند.
میانبرهای مهم Google Flow
Flow روی دسکتاپ تعداد زیادی Keyboard Shortcut دارد.
برای مثال Spacebar برای Preview، کلیدهای جهتدار برای جابهجایی میان Assetها و Versionها، Ctrl/Cmd + D برای Download، Ctrl/Cmd + G برای ساخت Group یا Collection، Ctrl/Cmd + U برای Upload، Ctrl/Cmd + F برای Search و Shift + I یا Shift + V برای فیلتر Image و Video قابل استفاده هستند.
اگر روزانه با صدها Generation کار میکنید، یادگیری Shortcutها سرعت Workflow را بهشدت افزایش میدهد.
Backup گرفتن از کل اطلاعات Flow
Google Flow فقط امکان Download یک Video را ندارد.
از طریق Google Takeout میتوانید دادههای Flow خود را Export کنید.
این Backup میتواند Generated Media، Uploaded Media، Prompts، Generation Settings، Model Names، Camera Controls، Voice Configurations، Trim Offsetها، Projects، Collections، Characters، Scenes و Edit Stackها را شامل شود.
برای پروژههای تجاری بهتر است در پایان هر پروژه یک Archive مستقل نگهداری شود.
آیا Google Flow جای Premiere Pro یا DaVinci Resolve را میگیرد؟
هنوز نه؛ و لزوماً هدف اصلی Flow هم همین نیست.
Flow در Generative Production فوقالعاده قدرتمند است.
یعنی میتواند چیزی را که وجود ندارد بسازد، Asset تولید کند، تصویر را متحرک کند، شات را ادامه دهد، Character ایجاد کند و ویدیو را Generative Edit کند.
اما نرمافزارهایی مانند Premiere Pro و DaVinci Resolve همچنان برای تدوین Frame-Accurate، Color Grading دقیق، Sound Mixing پیچیده، Multi-Track Editing و Master Delivery حرفهای کنترل بیشتری ارائه میکنند.
بهترین Workflow حرفهای در بسیاری از پروژهها این است:
Google Flow برای Generation → DaVinci/Premiere برای Final Editing
بهترین Workflow پیشنهادی برای ساخت ویدیو حرفهای با Google Flow
- ابتدا Script یا Creative Brief را مشخص کنید.
- بعد فیلم را به Shotهای جداگانه تقسیم کنید.
- Character و Product Referenceها را بسازید.
- در Flow برای آنها Ingredients یا Character تعریف کنید.
- ابتدا Key Frameهای اصلی را با Image Generation بسازید.
- استایل بصری را تثبیت کنید.
- حرکت هر Shot را با مدل کمهزینهتر آزمایش کنید.
- Generation منتخب را با مدل مناسب نهایی کنید.
- برای انتقال میان شاتها از Start/End Frame یا Save Frame استفاده کنید.
- Shotهای طولانی را در صورت نیاز Extend کنید.
- مشکلات جزئی را با Omni Video Editing اصلاح کنید.
- سپس کلیپها را در Scenebuilder مرتب کنید.
- در صورت نیاز 1080p یا 4K Upscale بگیرید.
- در نهایت برای تدوین و Sound Mix دقیقتر خروجی را وارد Premiere Pro یا DaVinci Resolve کنید.
جمعبندی؛ Google Flow واقعاً چه چیزی را تغییر داده است؟
Google Flow دیگر صرفاً صفحهای نیست که در آن یک Prompt نوشته و یک Video دریافت کنید. فلو در حال تبدیل شدن به یک AI Production Environment است؛ محیطی که Ideation، Character Design، Image Generation، Reference Management، Video Generation، Voice، Generative Editing، Scene Assembly و Asset Management را به یک Workflow واحد متصل میکند.
مهمترین مزیت آن نیز دقیقاً همین یکپارچگی است. در یک پروژه میتوانید Character بسازید، Reference ذخیره کنید، همان Character را در چند Scene استفاده کنید، Frame استخراج کنید، Scene را ادامه دهید، Voice ثابت ایجاد کنید، ویدیو را با Prompt تغییر دهید، Versionهای مختلف را در History نگه دارید و در پایان کلیپها را با Scenebuilder کنار هم قرار دهید.
اما کیفیت خروجی همچنان بیش از هر چیز به سه عامل وابسته است: کیفیت Referenceها، ساختار Prompt و Workflow صحیح. کسی که Flow را فقط بهعنوان یک Text-to-Video Generator استفاده کند، بخش بزرگی از توانایی واقعی آن را نادیده میگیرد. قدرت اصلی Flow زمانی آشکار میشود که Images، Ingredients، Characters، Frames، Voices، Veo، Gemini Omni، Agent و Scenebuilder را بهعنوان اجزای یک سیستم تولید واحد ببینید.
در این حالت Google Flow از یک ابزار سرگرمکننده تولید ویدیو به یک استودیوی جدی برای پیشتولید، ساخت تبلیغات، محتوای شبکه اجتماعی، Concept Film، موزیکویدیو و پروژههای تصویری مبتنی بر هوش مصنوعی تبدیل میشود.
| پیشنهاد ویژه : تعمیر کامپیوتر |