صفحه اصلی > مدل‌ها و ابزارها : گوگل فلو (Google Flow) چیست؟ مدل‌ها، قابلیت‌ها و دسترسی از ایران

گوگل فلو (Google Flow) چیست؟ مدل‌ها، قابلیت‌ها و دسترسی از ایران

📅 تاریخ انتشار: 1405/07/10 🔄 آخرین بروزرسانی: 1405/07/10
مقدماتی زمان مطالعه: 13 دقیقه
تصویر شاخص مقاله گوگل فلو (Google Flow)؛ یکپارچگی مدل‌های هوش مصنوعی گوگل شامل Nano Banana، Veo 3.1 و Gemini Omni Flash در استودیوی خلاق گوگل

به طور خلاصه، گوگل فلو یک استودیوی هوش مصنوعی از گوگل است که برای ساخت و ویرایش ویدئو و تصویر طراحی شده است. این ابزار ابتدا در I/O 2025 به‌عنوان ابزار ساخت ویدئوی سینمایی معرفی شد و بعدتر به محیطی گسترده‌تر برای تولید و ویرایش تصویر و ویدئو تبدیل شد. فلو حول مدل‌های Veo، Imagen/Gemini Image و خانواده Gemini ساخته شده و به‌جای یک جعبه پرامپت ساده، لایه‌ای برای گردش‌کار خلاقانه فراهم می‌کند. اگر با این ابزار آشنا و فقط دنبال روشی برای دسترسی از ایران هستید راهنمای عملی دسترسی به گوگل فلو را مطالعه کنید.


گوگل فلو (Google Flow) چیست؟

گوگل فلو یک استودیو و زیرساخت خلاقانه مبتنی بر هوش مصنوعی از گوگل است که برای ساخت و ویرایش ویدئو و تصویر به کار می‌رود. این ابزار در I/O 2025 (۲۰ مه ۲۰۲۵) توسط Google DeepMind و Google Labs معرفی شد و در ابتدا برای ساخت ویدئوی سینمایی ارائه شد.


سیر تحول گوگل فلو (Google Flow) از 2025 تا 2026 و ادغام Whisk و ImageFX در استودیوی هوش مصنوعی گوگل


در I/O 2026 (۱۹ مه ۲۰۲۶) گوگل فلو به سطح یک استودیوی کامل خلاقیت ارتقا یافت و قابلیت‌هایی مانند Flow Music و مدل جدید Google برای ویرایش مکالمه‌ای به آن اضافه شد. بنابراین مسیر آن از یک ابزار فیلم‌سازی به محیطی برای تولید و ویرایش تصویر و ویدئو گسترش پیدا کرده است.


تفاوت اصلی فلو با ابزارهای تک‌پرامپتی در همین نقطه است: این ابزار فقط یک جعبه پرامپت برای تولید یک خروجی نیست؛ بلکه به‌عنوان یک لایه گردش‌کار عمل می‌کند. این لایه به کاربر اجازه می‌دهد ساخت، ویرایش و ادامه‌دادن به پروژه را در یک محیط استودیویی سازمان‌دهی کند. به همین دلیل، کار با آن بیشتر به مدیریت یک روند تولید شبیه است تا اجرای پرامپت‌های جداگانه.


منبع این بخش:

[گزارش رسمی گوگل درباره Flow و Veo]


گوگل فلو (Google Flow) شامل چه ابزارها و مدل‌هایی می‌شود؟

فلو از چند جزء متصل تشکیل شده است که هر یک وظیفه مشخصی در زنجیره تولید دارند. این اجزا شامل مدل‌های تولید ویدئو و تصویر و همچنین ابزارهای زیرساختی و گردش‌کاری می‌شوند. در ادامه، هر جزء و نقش اصلی آن فهرست شده است.

مدل / ابزارنقش اصلیدسته
Veo (نسخه‌های 3 و 3.1)موتور اصلی تولید ویدئو از متن/تصویر/ویدئوی مرجع و صدای بومیتولید ویدئو
Gemini Omni Flashتولید سریع ویدئو و ویرایش متوالی/مکالمه‌ای پیش‌نویس‌ها در ۴ تا ۱۰ ثانیهتولید ویدئو
Nano Banana Pro (Gemini 3 Pro Image)مدل ساخت تصویر برای مفاهیم پیچیده، جزئیات بالا و متن درون‌تصویریتولید تصویر
Nano Banana 2 (Gemini 3.1 Flash Image)مدل عمومی ساخت تصویر با توازن سرعت، کیفیت و ارجاع چندتصویریتولید تصویر
Nano Banana 2 Lite (Gemini 3.1 Flash Lite Image)مدل ساخت و ویرایش تصویر برای پیش‌نویس‌سازی سریعتولید تصویر
SceneBuilderویرایش، بسط صحنه و حفظ تداوم حرکتی در کات‌های متوالیزیرساخت/گردش‌کار
Asset Management (Flow Asset Grid)دسته‌بندی، گروه‌بندی و فراخوانی دارایی‌ها با نماد @زیرساخت/گردش‌کار
Flow Musicساخت، تغییر سبک و تنظیم موسیقی و صدا روی کات‌های ویدئوییزیرساخت/گردش‌کار
Flow TVنمایش تعاملی کات‌های تولیدشده همراه با پرامپت‌ها و تکنیک‌هازیرساخت/گردش‌کار

این اجزا در کنار هم به کاربر امکان می‌دهند از یک ایده اولیه به ویدئوی نهایی برسد. نقش هر جزء در این مسیر مشخص است و ترکیب آن‌ها یک روند تولید پیوسته را ممکن می‌کند. جزئیات مراحل تولید در بخش‌های بعدی توضیح داده می‌شود.


منابع اصلی این بخش:

[گزارش رسمی گوگل درباره Flow و Veo] و [صفحه رسمی مدل Veo در DeepMind]


گوگل فلو (Google Flow) چه کاری انجام می‌دهد؟

گوگل فلو تولید اولیه، ویرایش منطقی و کلامی، مدیریت دارایی‌ها و بسط روایی را در یک جریان کاری واحد کنار هم می‌گذارد. کاربر می‌تواند در همین محیط از ایده به تصویر و ویدئو برسد و سپس خروجی را ویرایش کند. این ساختار با ابزارهای تک‌پرامپتی تفاوت دارد؛ چون در آن‌ها هر خروجی یک نقطه ایستاست و ادامه کار به ابزارهای دیگر سپرده می‌شود. در فلو این مراحل به‌صورت پیوسته در دسترس‌اند.


مدیریت دارایی‌ها یعنی کاراکترها، سبک‌ها و محیط‌ها به‌عنوان متغیرهای بصری ذخیره و در پلان‌های مختلف بارفراخوانی می‌شوند. کاربر می‌تواند همان کاراکتر را در چند نما حفظ کند و تداوم چهره و داستان را در طول پروژه نگه دارد. این کار بدون بازتعریف مکرر هر عنصر انجام می‌شود و به انسجام بصری کمک می‌کند.


ویرایش در فلو فقط پرامپت و تولید نیست؛ شامل ویرایش منطقی و کلامی روی فریم‌های تولیدشده هم می‌شود. کاربر می‌تواند بخشی از تصویر را حذف کند، شیئی به فریم بیفزاید، یک عنصر را با زبان طبیعی تغییر دهد یا حرکت دوربین را در کات‌های متوالی حفظ کند. خروجی نهایی با تنظیمات زمان‌بندی و اصلاح رنگ به نرم‌افزارهای تدوین حرفه‌ای مانند Adobe After Effects متصل می‌شود. Flow Music و Flow TV نیز به‌عنوان بخش‌های مکمل در همین محیط قرار گرفته‌اند.


منبع این بخش:

[مستندات رسمی گوگل درباره Flow]


Veo در گوگل فلو (Google Flow) چه نقشی دارد؟

Veo موتور تخصصی تولید ویدئو در گوگل فلو است که در نسخه‌های Veo 3 و Veo 3.1 ارائه می‌شود. این مدل چند نوع ورودی را پردازش می‌کند: متن به ویدئو (Text-to-Video)، تصویر به ویدئو (Image-to-Video) و ویدئوی مرجع به ویدئو (Reference-to-Video). کیفیت خروجی آن تا 4K است. با ورود Gemini Omni Flash، Veo از فلو حذف نشده و برای نیازهای تخصصی‌تر در کنار آن باقی مانده است. این نسبت، وضعیت روز نگارش است و می‌تواند تغییر کند.


Veo صدای بومی (Native Audio) تولید می‌کند؛ یعنی صدای محیطی، افکت‌های صوتی و دیالوگ کاراکترها هم‌زمان با تصویر ساخته می‌شوند و حرکات لب با صدا هماهنگ است. در روش‌های سنتی، صداگذاری و هماهنگی لب‌خوانی معمولاً مرحله‌ای جدا و بعد از تولید تصویر انجام می‌شد، اما در Veo این دو همراه با هم شکل می‌گیرند.


کنترل‌های سینمایی دوربین در Veo:


  1. Pan: حرکت افقی چپ/راست
  2. Tilt: حرکت عمودی بالا/پایین
  3. Zoom: بزرگ‌نمایی/کوچک‌نمایی نوری
  4. Dolly: حرکت فیزیکی دوربین به جلو/عقب در عمق صحنه
  5. Orbit: حرکت چرخشی مداری به دور سوژه
  6. Handheld: شبیه‌سازی لرزش طبیعی دست


منبع اصلی این بخش:

[صفحه رسمی مدل Veo در DeepMind]


Gemini Omni Flash در گوگل فلو (Google Flow) چیست و چه فرقی با Veo دارد؟

Gemini Omni خانواده مدل جدید گوگل است که در I/O 2026 معرفی شد. Gemini Omni Flash اولین و تنها مدل فعلی این خانواده است. این مدل چند ورودی مانند متن، تصویر، ویدئو و صدا را در یک مدل واحد ترکیب می‌کند تا ویدئو را به‌صورت گفت‌وگومحور تولید و ویرایش کند.


مقایسه Veo 3.1 و Gemini Omni Flash در گوگل فلو (Google Flow)؛ کیفیت سینمایی در برابر ویرایش مکالمه‌ای و پیش‌نویس سریع


بر اساس اعلام رسمی گوگل، Gemini Omni Flash در Gemini App، Google Flow، Flow Music، YouTube Shorts/Create، Google AI Studio و Gemini API فعال است.


Gemini Omni Flash ویدئوهای کوتاه ۴ تا ۱۰ ثانیه تولید می‌کند و ویرایش مکالمه‌ای چندمرحله‌ای را ممکن می‌سازد. برای کاربر، این یعنی می‌تواند پیش‌نویس‌ها را سریع بسازد و در چند مرحله با گفتگو اصلاح کند. این مدل برای کاهش تأخیر پردازشی و دسترسی عمومی‌تر توسعه یافته است.

ویژگیGemini Omni FlashVeo 3.1
نقش اصلیموتور تعاملی و سریع برای پیش‌نویس و ایده‌پردازیموتور سینمایی برای خروجی نهایی با کیفیت بالا
نوع کاربردتولید و ویرایش گفت‌وگومحور و متوالیتولید دیالوگ بومی پیشرفته و پردازش ساختاری پیچیده
وضعیت در Flowدر کنار Veo برای کارهای سریع و تعاملیدر کنار Omni Flash برای نیازهای تخصصی‌تر

این خانواده قابلیت پذیرش تصاویر مرجع چندگانه را دارد، یعنی کاربر می‌تواند چند تصویر را برای ترکیب سبک به مدل بدهد. دکمه «Redo with Pro» هم امکان ارتقای کیفیت فرم‌های انتخاب‌شده را فراهم می‌کند.


منابع این بخش:

[کارت مدل Gemini Omni Flash در DeepMind] و [به‌روزرسانی‌های Flow در وبلاگ گوگل]


Nano Banana در گوگل فلو (Google Flow) چیست؟

Nano Banana خانواده مدل‌های تولید و ویرایش تصویر است که در گوگل فلو ادغام شده و بر پایه نسخه‌های مختلف Gemini Image توسعه یافته است. این خانواده در فلو دو نقش دارد: ساخت و ویرایش تصویر، و آماده‌سازی asset یا reference برای تولید ویدئو با Veo یا Gemini Omni Flash.


به این ترتیب، تصویر تولیدشده می‌تواند به‌عنوان ورودی یا مرجع در ادامه زنجیره تولید ویدئو به کار برود. مدل‌های این خانواده در سطوح دسترسی متفاوتی ارائه می‌شوند.


  1. Nano Banana Pro — پایه: Gemini 3 Pro Image. کاربرد: جزئیات بالا، طراحی پیچیده و متن دقیق درون تصویر. دسترسی: مدل پیش‌فرض برای مشترکین Google AI Ultra؛ تولید 5 تصویر روزانه برای کاربری رایگان در گوگل فلو
  2. Nano Banana 2 — پایه: Gemini 3.1 Flash Image. کاربرد: توازن سرعت و کیفیت و دریافت چندین تصویر مرجع. دسترسی: مدل استاندارد برای کاربران سیستم.
  3. Nano Banana 2 Lite — پایه: Gemini 3.1 Flash Lite Image. کاربرد: سرعت بالا، تولید در ۴ ثانیه و بهینه‌سازی بودجه. دسترسی: مدل پیش‌فرض برای همه کاربران در سطح رایگان.


این خانواده قابلیت پذیرش تصاویر مرجع چندگانه را دارد، یعنی کاربر می‌تواند چند تصویر را برای ترکیب سبک به مدل بدهد. دکمه «Redo with Pro» هم امکان ارتقای کیفیت فرم‌های انتخاب‌شده را فراهم می‌کند.


منابع این بخش:

[گزارش رسمی گوگل درباره Nano Banana 2] و [سند پشتیبانی گوگل درباره Gemini]


این مدل‌ها چطور با هم در گوگل فلو (Google Flow) کار می‌کنند؟

کاربری ایده‌ای در ذهن دارد و آن را در فلو پیش می‌برد. او می‌تواند با یک پرامپت اولیه شروع کند، تصویر پایه را با Nano Banana بسازد یا تصویر موجود را بارگذاری کند. سپس همان تصویر را به‌عنوان reference یا ingredient در اختیار Veo برای خروجی سینمایی یا Gemini Omni Flash برای پیش‌نویس سریع و ویرایش مکالمه‌ای می‌گذارد. در ادامه، نتیجه را در فلو اصلاح می‌کند و در صورت نیاز به هر نقطه از این مسیر برمی‌گردد. این روند خطی و اجباری نیست.


گردش کار مدل‌ها در Google Flow برای تولید تصویر و ویدئو با Nano Banana، Veo 3.1 و Gemini Omni Flash


Asset Management و SceneBuilder همین زنجیره را منسجم نگه می‌دارند. کاربر می‌تواند کاراکترها، سبک‌ها و محیط‌ها را با نماد @ در پلان‌های مختلف بارفراخوانی کند و تداوم داستانی را حفظ کند. SceneBuilder نیز به حفظ تداوم حرکتی در کات‌های متوالی کمک می‌کند.


کاربر می‌تواند در میانه کار بین Veo و Gemini Omni Flash جابه‌جا شود؛ بسته به اینکه به پیش‌نویس سریع نیاز دارد یا خروجی نهایی با کیفیت بالا.


منابع اصلی این بخش:

[گزارش رسمی گوگل درباره Flow و Veo] و [گزارش Digit درباره بازطراحی Flow]


Whisk و ImageFX کجا رفتند؟

گوگل در فوریه ۲۰۲۶ اعلام کرد که Whisk و ImageFX را مستقیماً در گوگل فلو ادغام می‌کند. هدف اعلام‌شده، تمرکز ابزارهای ایده‌پردازی تصویری، ساخت فریم و تبدیل تصویر به ویدئو در یک محیط کاری بود. از مارس ۲۰۲۶، یک مسیر انتقال اختیاری فعال شد که به کاربران اولیه اجازه داد پروژه‌ها، پرامپت‌ها و دارایی‌های تصویری موجود خود را به کتابخانه شخصی در فلو منتقل کنند. قابلیت‌های تصویری این ابزارها با مدل Nano Banana در این ابزار یکپارچه شد.


تاریخ دقیق خاموشی کامل دامنه مستقل ImageFX در اسناد رسمی گوگل منتشر نشده است؛ آنچه تأیید شده، آغاز روند انتقال از فوریه ۲۰۲۶ و انتقال پروژه‌ها از مارس ۲۰۲۶ است.


منبع این بخش:

[گزارش The Verge درباره گسترش Flow]


آیا گوگل فلو (Google Flow) از ایران در دسترس است؟

گوگل فلو در حال حاضر برای کاربران بالای ۱۸ سال در بیش از ۱۴۰ کشور و منطقه در دسترس است. ایران در فهرست مناطق پشتیبانی‌شده قرار ندارد. گوگل صریحاً قید کرده است که استفاده از ابزارهای تغییر IP (مانند تحریم گذر)، امکان دسترسی به سرویس را در مناطق پشتیبانی‌نشده ایجاد نمی‌کند. سیستم احراز هویت حساب‌ها بر اساس منطقه جغرافیایی تنظیم می‌شود.


برای دسترسی به گوگل فلو از ایران، جریان AI یک افزونه متن‌باز در راهنمای عملی دسترسی به گوگل فلو برای شما عزیزان تهیه کرده است.


بررسی دسترسی به گوگل فلو (Google Flow) و محدودیت‌ دسترسی ایران، بی‌اثر بودن تحریم گذر و افزونه جریان AI برای دسترسی به فلو


سطح بدون اشتراک دسترسی تجربی دارد: ساخت تصویر با Nano Banana 2 Lite و ۵۰ کردیت اختصاصی فلو در روز. پلن‌های اصلی شامل Google AI Plus، Google AI Pro و Google AI Ultra هستند که سطوح مختلفی از کردیت، دسترسی به Gemini Omni Flash، Veo 3.1 و Nano Banana Pro را ارائه می‌دهند. نسبت قیمت‌ها و سقف کردیت‌ها در اسناد مختلف متناقض است و پیش از تصمیم‌گیری بهتر است آخرین وضعیت را از صفحه رسمی پلن‌های Google AI بررسی کنید.


از نظر محدودیت‌های منطقه‌ای، واترمارک مرئی اجباری برای کاربران هند، کره جنوبی و ویتنام اعمال می‌شود و تنها کاربران AI Ultra می‌توانند آن را غیرفعال کنند. قابلیت Avatars و ویرایش ویدئوهای آپلودشده در بریتانیا، سوئیس و EEA غیرفعال است؛ همچنین ویرایش چهره افراد زیر سن قانونی و تولید ویدئو از چهره افراد سرشناس در همه مناطق ممنوع است.


منابع این بخش:

[سند پشتیبانی گوگل درباره Flow] و [سند پشتیبانی Google One درباره پلن‌ها]


گوگل فلو برای چه کارهایی مناسب است؟

گوگل فلو برای کارهای مختلفی به کار می‌رود و این بخش چند کاربرد کلیدی را معرفی می‌کند. این فهرست کامل نیست، اما طیف رایج استفاده از آن را نشان می‌دهد.


کاربردهای کلیدی گوگل فلو (Google Flow) شامل تولید ویدئوی سینمایی با Veo 3.1، پیش‌نویس سریع با Gemini Omni Flash و ایده پردازی بصری با Nano Banana


کانسپت و ایده‌پردازی بصریساخت تصاویر پایه با Nano Banana پیش از تولید ویدئو.
تولید ویدئوی کوتاه و پیش‌نویس سریعبا Gemini Omni Flash برای محتوای ۴ تا ۱۰ ثانیه.
تولید ویدئوی نهایی سینماییبا Veo 3.1 برای خروجی با کیفیت بالا و صدای بومی.
محتوای تبلیغاتی و تجاریساخت ویدئوهای تبلیغاتی با دسترسی نامحدود در پلن‌های بالا.
استوری‌بورد و پیش‌نمایش معماری/موشنساخت فریم‌های متحرک و نمونه‌سازی سریع برای صنایع بصری

منبع این بخش:

[گزارش رسمی گوگل درباره Flow و Veo]


سوالات پرتکرار درباره گوگل فلو (Google Flow)


گوگل فلو (Google Flow) رایگان است؟

گوگل فلو امکان استفاده محدود در سطح رایگان دارد؛ ساخت تصویر با Nano Banana بدون هزینه در دسترس است و تخصیص روزانه ۵۰ کردیت برای سرویس رایگان اعلام شده است. دسترسی مداوم به مدل‌های پیشرفته مانند Veo 3.1 و Nano Banana Pro نیازمند اشتراک پولی است. بنابراین رایگان بودن فلو محدود و وابسته به سطح دسترسی است.


فرق گوگل فلو (Google Flow) و Veo چیست؟

Veo یک مدل پایه هوش مصنوعی برای تولید ویدئو است، در حالی که Google Flow محیط کاری، رابط کاربری و ابزارهای مدیریت صحنه را فراهم می‌کند و Veo به‌عنوان یکی از موتورهای پردازشی درون آن قرار می‌گیرد. گوگل فلو فقط Veo نیست و مدل‌های دیگری مانند Nano Banana برای تصویر و Gemini Omni Flash برای پیش‌نویس سریع هم در آن حضور دارند.


Gemini Omni Flash چیست؟

Gemini Omni خانواده مدل جدید گوگل است که در I/O 2026 (۱۹ مه ۲۰۲۶) اعلام شد و Gemini Omni Flash اولین و تنها مدل فعلی این خانواده است. این مدل چند ورودی مانند متن، تصویر، ویدئو و صدا را در یک مدل واحد برای تولید و ویرایش گفت‌وگومحور ویدئو ترکیب می‌کند و در Gemini App، Google Flow، Flow Music، YouTube Shorts/Create، Google AI Studio و Gemini API فعال است. Gemini Omni Flash جایگزین Veo 3.1 نیست و در کنار آن سیستم پردازشی گوگل فلو را می‌سازد.


نقش Nano Banana در گوگل فلو (Google Flow) چیست؟

Nano Banana خانواده مدل‌های تولید و ویرایش تصویر در گوگل فلو است که سه نسخه فعلی دارد: Pro برای کیفیت بالا، 2 برای توازن سرعت و کیفیت، و 2 Lite برای تولید سریع. این خانواده در فلو دو نقش دارد: ساخت و ویرایش تصویر، و آماده‌سازی asset یا reference برای تولید ویدئو.


منبع این بخش:

[صفحه پشتیبانی Flow]

برچسب ها :
ابزار تولید تصویر Google Flow ابزار تولید ویدئو ابزار تولید صوت و آهنگ
عرفان سیف جهانی
سلام! من عرفان هستم؛ هم‌بنیان‌گذار جریان AI. اینجا به‌عنوان کارشناس سئو و طراح برند فعالیت می‌کنم و محتوا را طوری می‌چینم که پیدا کردنش در وب برای شما آسان باشد. می‌نویسم تا دنیای هوش مصنوعی را برای همهٔ فارسی‌زبان هایی که می‌خواهند با این ابزارها آشنا شوند و درست از آن‌ها استفاده کنند، ساده‌تر و قابل‌فهم‌تر کنم.
بیشتر بخوانید ...

دیدگاهتان را بنویسید

جریان AI