گوگل دو مدل رسانه مولد جدید را با هدف توسعه دهندگانی که به سرعت و مقیاس نیاز دارند ارائه کرده است: Nano Banana 2 Lite، سریع ترین و مقرون به صرفه ترین مدل تولید تصویر تا کنون، و Gemini Omni Flash، مدلی با کیفیت بالا برای تولید ویدئو و ویرایش مکالمه. هر دو در 30 ژوئن 2026 توسط Google DeepMind معرفی شدند و بلافاصله در دسترس توسعه دهندگان قرار گرفتند.

این انتشار موجی از پوشش اخیر صنعت هوش مصنوعی را گسترش می دهد که بر روی کاربردی کردن رسانه های مولد برای خطوط لوله تولید متمرکز شده است و نه فقط دموها. گوگل این جفت را به‌عنوان ابزارهایی قرار می‌دهد که به سازندگان اجازه می‌دهند تولید سریع تصویر را با ایجاد ویدیو در یک گردش کار انتها به انتها متصل کنند.

Nano Banana 2 Lite: ساخته شده برای سرعت

Nano Banana 2 Lite که با نام مدل «gemini-3.1-flash-lite-image» شناخته می شود، برای ایده پردازی سریع و خطوط لوله توسعه دهنده با سرعت بالا طراحی شده است که در آن سرعت و هزینه محدودیت های اصلی هستند. به گفته گوگل، خروجی های متن به تصویر را در 4 ثانیه ارائه می دهد که آن را برای نمونه سازی تعاملی و پیش نویس بصری سریع ایده آل می کند.

از نظر هزینه، قیمت این مدل 0.034 دلار به ازای هر 1000 تصویر است، رقمی که گوگل آن را به عنوان یک انتخاب مقرون به صرفه برای توسعه دهندگانی که بر تهیه پیش نویس، مدیریت بودجه های عملیاتی، یا مدیریت استفاده از پهنای باند کم متمرکز هستند، برجسته می کند. علیرغم اولویت‌بندی سرعت، این شرکت می‌گوید Nano Banana 2 Lite پایبندی سریع قابل‌اعتماد، ثبات کاراکتر قوی، و خوانایی متن درون تصویر را حفظ می‌کند – یک نقطه درد مکرر برای مدل‌های تصویر قبلی.

Google Nano Banana 2 Lite را به عنوان جایگزینی برای توسعه دهندگانی که هنوز از اولین نسخه Nano Banana («gemini-2.5-flash-image») استفاده می کنند، توصیه می کند، که نویدبخش مزایای فوری از نظر تأخیر، هزینه و کیفیت است.

خانواده موز در حال رشد

برای اینکه مشخص شود هر مدل کجا مناسب است، گوگل مجموعه کامل نانو موز را معرفی کرد:

  • Nano Banana 2 Lite (تصویر Flash Lite Gemini 3.1): ساخته شده برای سرعت، بهینه سازی شده برای گردش های کاری تقریباً واقعی و با حجم بالا که در آن تأخیر بسیار کم بسیار مهم است.
  • Nano Banana 2 (تصویر فلش Gemini 3.1): اسب کاری عمومی که کیفیت بالا را با تاخیر کمتر برای بهترین تعادل بین عملکرد و هزینه ارائه می دهد.
  • Nano Banana Pro (تصویر Gemini 3 Pro): برای موارد استفاده پیچیده و حرفه ای بهینه شده است، قوی ترین کنترل و استدلال پیشرفته را در جایی که دقت مهمتر است ارائه می دهد.

این رویکرد لایه‌ای نشان می‌دهد که گوگل چگونه مدل‌های متنی خود را ساختار داده است و به توسعه‌دهندگان مسیر ارتقای واضحی از ارزان و سریع به ممتاز و دقیق را می‌دهد.

Gemini Omni Flash ویدئو را برای توسعه دهندگان می آورد

در کنار مدل تصویر، گوگل برای اولین بار Gemini Omni Flash را برای توسعه دهندگان آورد. Omni Flash که به عنوان یک مدل با کیفیت بالا و مقرون به صرفه برای تولید ویدیو و ویرایش مکالمه توصیف می‌شود، به کاربران اجازه می‌دهد تا ویدیو را از طریق دستورالعمل‌های مکالمه‌ای چند نوبتی به جای یک اعلان سخت، ایجاد و اصلاح کنند.

گوگل این ترکیب را به عنوان کلید ایجاد تجربیات چند رسانه ای جامع در نظر گرفت: هزاران تصویر را به سرعت با Nano Banana 2 Lite ایجاد کنید، سپس با Omni Flash به دنباله های ویدیویی چند چرخشی بروید. این دو مدل به گونه‌ای طراحی شده‌اند که با هم کار کنند، بنابراین تکرار خلاقانه از تصاویر ثابت به حرکت بدون تغییر پلت‌فرم جریان می‌یابد.

از کجا به آنها دسترسی داشته باشید

هر دو مدل از روز راه‌اندازی در سراسر توسعه‌دهندگان و سطوح سازمانی Google در دسترس هستند. Nano Banana 2 Lite و Gemini Omni Flash از طریق Google AI Studio، Gemini API و Gemini Enterprise Agent Platform قابل دسترسی هستند. آنها همچنین در سراسر محصولات مصرفی Google، از جمله حالت هوش مصنوعی در جستجو، برنامه Gemini، و Google Flow در دسترس هستند.

در دسترس بودن گسترده استراتژیک است. Google با قرار دادن مدل‌های یکسان هم در ابزارهای توسعه‌دهنده و هم در برنامه‌های مصرف‌کننده، تضمین می‌کند که پیشرفت‌ها در هر دو جهت جریان دارند - بازخورد توسعه‌دهنده تجربه مصرف‌کننده را تیز می‌کند و مقیاس مصرف‌کننده مدل‌ها را برای استفاده در تولید سخت‌تر می‌کند.

جنگ قیمت مولد و رسانه ای

پرتاب ها در بحبوحه جنگ قیمتی شدید در رسانه های مولد وارد می شوند. همانطور که مدل های تصویر و ویدئو به بلوغ رسیده اند، مرز رقابتی از کیفیت خام به هزینه هر نسل و تاخیر تغییر کرده است. Nano Banana 2 Lite با قیمت 0.034 دلار به ازای هر 1000 تصویر و زمان‌های نسل 4 ثانیه‌ای، در مدل‌های تصویری رقیب یک عکس واضح است و کل بازار را به سمت خروجی سریع‌تر و ارزان‌تر سوق می‌دهد.

مدیران محصول آلیسا فورتین و آنیش نانگیا از Google DeepMind، که انتشار را اعلام کردند، تأکید کردند که ساختن با رسانه‌های مولد اساساً مربوط به تکرار خلاقانه است – و این تکرار تنها زمانی کار می‌کند که هر مرحله آنقدر سریع و مقرون به صرفه باشد که آزادانه تکرار شود.

از هوش مصنوعی جلوتر بمانید

رسانه‌های مولد سریع‌تر از همیشه در حال پیشرفت هستند و مدل‌های جدیدی به صورت هفتگی وارد می‌شوند. هر نسخه، معیار، و تغییر قیمت را در [AI Buzz Wire] (https://aibuzzwire.news)، خانه شما برای آخرین پیشرفت‌های هوش مصنوعی دنبال کنید.

بیشتر بخوانید اخبار هوش مصنوعی →