Gemini 3.5 Pro با تاخیر طولانی مدت، بارها و بارها در استخر آزمایش کور LMSYS Chatbot Arena ظاهر شده است و سیگنال واضحی را به جامعه توسعه دهندگان ارسال می کند مبنی بر اینکه عرضه عمومی مدل پرچمدار ممکن است در نهایت قریب الوقوع باشد. در حالی که خط رسمی شرکت همچنان این است که مدل «در حال حاضر در حال آزمایش شریک است»، مجموعه‌ای از مشاهده‌های جامعه، ناهنجاری‌های باطنی، و پاسخ‌های غیرمعمول قوی همه به آزمایش A/B در مرحله آخر قبل از عرضه گسترده‌تر اشاره می‌کنند.

مشاهده ها اهمیت دارند زیرا حضور در Chatbot Arena به ندرت تصادفی است. وقتی مدل‌های اعلام‌نشده در نبردهای ترجیحی کور پلتفرم ظاهر می‌شوند، معمولاً به عنوان آخرین مرحله آزمایش استرس قبل از راه‌اندازی عمومی API و وب عمل می‌کند. برای اطلاعات بیشتر در مورد چگونگی شکل‌دهی این چرخه‌های انتشار به بازار، [پوشش مدل AI] ما را دنبال کنید (https://aibuzzwire.news).

آنچه توسعه دهندگان می بینند

بر اساس مشاهدات جامعه گزارش شده توسط NokiaPowerUser در 2 آگوست 2026، آزمایش کنندگان X و Discord با یک مدل سریع و بسیار ماهر مواجه شده اند که خود را به عنوان یک ساخته DeepMind تحت شناسه gemini-3.5-pro معرفی می کند. چندین الگو ظاهر شده است:

  • ظاهر آزمایش کور مکرر: این مدل مدام در مقایسه‌های سر به سر ناشناس Chatbot Arena ظاهر می‌شود، نوع مواجهه‌ای که Google معمولاً برای مدل‌هایی که قرار است ارسال کند، حفظ می‌کند.
  • سیگنال های تست فعال A/B: رابط کاربری ظریف و به روز رسانی های باطن در سرتاسر پلتفرم های توسعه دهنده مشاهده شده است، الگویی که با مراحل استقرار قبل از راه اندازی سازگار است.
  • ناهنجاری‌های "فلش": چندین کاربر پاسخ‌های پرت را از مدل‌های استاندارد فلش مستند کردند که استدلال عمیق غیرمعمولی را نشان می‌دادند، که نشان می‌دهد در طول ارزیابی زنده، مسیریابی سایه به مدلی منتشر نشده و سطح بالاتر را نشان می‌دهد.

Google DeepMind معتقد است که اعتبار سنجی شریک هنوز ادامه دارد. اما همانطور که NokiaPowerUser اشاره کرد، تاریخ نشان می‌دهد که این مرحله معمولاً با شروع مرحله‌بندی Arena به سرعت به در دسترس بودن عمومی تبدیل می‌شود.

مدلی که دیر شده است

مشاهدات Arena پس از ماه‌ها ناامیدی برای غول جستجو صورت می‌گیرد. در کنفرانس توسعه دهندگان Google I/O خود در ماه مه 2026، گوگل یک مدل Gemini 3.5 Flash با وزن سبک‌تر را برای استفاده روزمره راه‌اندازی کرد و ساندار پیچای، مدیر عامل شرکت، در نشست رسانه‌ای پیش از کنفرانس گفت که نسخه Pro در ماه ژوئن عرضه خواهد شد. به گزارش مشبل، پیچای گفت: «ما همچنین برای 3.5 Pro هیجان‌زده هستیم. ما در داخل از آن استفاده می کنیم. پیشرفت های بزرگی را نشان می دهد.

خرداد آمد و رفت بدون رهایی. در اواسط جولای، بلومبرگ گزارش داد که این تاخیر باعث ناامیدی مهندسین گوگل، محققان هوش مصنوعی و مدیران شده است که این شرکت در خطر از دست دادن برتری خود در برابر رقبای Anthropic و OpenAI است. Mashable که گزارش بلومبرگ را در 17 ژوئیه تایید کرد، خاطرنشان کرد که گوگل فقط یک بیانیه مبهم در مورد "ارسال سریع در طیف گسترده ای از مدل ها" ارائه کرده است.

برای گوگل، این ریسک فراتر از حقوق لاف زدن است. افشای اطلاعات قبلی حاکی از آن بود که Gemini 3.5 Pro در زمینه‌های کلیدی مانند استدلال پیشرفته، کدنویسی و اجرای وظایف طولانی‌مدت مبارزه می‌کند و در برخی معیارها، آن را پشت سر رقبایی مانند Anthropic's Fable 5 و OpenAI GPT-5.6 قرار می‌دهد.

چرا شکاف کدنویسی مهم است

زمان هر عرضه بسیار مهم است. در حالی که نسخه‌های اخیر مانند Gemini 3.6 Flash کارایی توکن ثابت و تأخیر کمتری را ارائه می‌دهند، بازخورد توسعه‌دهندگان نشان می‌دهد که مدل‌های سبک وزن هنوز در طول وظایف مهندسی نرم‌افزار پیچیده و طولانی مدت کوتاهی می‌کنند. توسعه دهندگان به دنبال یک پرچمدار هستند که قادر به بازآفرینی در سطح سازمانی، اشکال زدایی مستقل و اجرای منطق پیچیده بدون قرار گرفتن در حلقه های توهم باشد.

بر اساس تعاملات اولیه جامعه و الگوهای انتشار اخیر گوگل، حوزه های مورد انتظار برای Gemini 3.5 Pro شامل کدگذاری عاملی پیشرفته، ادغام ابزار عمیق تر، و استدلال در سطح مرزی است - دقیقاً همان قابلیت هایی که مدل های سبک وزن آن را زیر پا گذاشته اند.

فشار رقابتی در حال افزایش است

گوگل در خلاء کار نمی کند. بازار گسترده‌تر مدل‌ها تحت تأثیر رقابت قیمتی تهاجمی و موجی از عرضه‌های با وزن باز، به‌ویژه از سوی توسعه‌دهندگان چینی، تحت تأثیر قرار گرفته است. DeepSeek و Moonshot AI Kimi K3 هزینه ها را کاهش داده و شکاف عملکرد را کاهش داده اند، در حالی که Anthropic و OpenAI به سرعت در پیشنهادات مرزی خود تکرار می کنند.

در آن محیط، تأخیر طولانی بیشتر از شرمندگی خطر دارد. هر هفته بدون پرچم‌دار رقابتی، یک هفته است که توسعه‌دهندگان و شرکت‌ها گزینه‌های جایگزین را ارزیابی می‌کنند – و برخی از این جایگزین‌ها اکنون ارزان‌تر و در کارهای خاص سریع‌تر هستند. مشاهده‌های Arena نشان می‌دهد که گوگل می‌داند ساعت در حال حرکت است.

اینکه آیا Gemini 3.5 Pro شکاف کدنویسی را می‌بندد و نگرانی‌ها در مورد قابلیت‌های استدلال خود را خاموش می‌کند، تنها زمانی مشخص خواهد شد که از آزمایش کور به دست توسعه‌دهندگان حرکت کند. اما پس از یک تابستان از مهلت‌های از دست رفته، ظهور این مدل در استخر تست LMSYS قوی‌ترین سیگنالی است که نشان می‌دهد پرتاب نزدیک است.

از هوش مصنوعی جلوتر بمانید

مسابقه برای ارسال مدل مرزی بعدی هرگز کند نمی شود. [AI Buzz Wire] (https://aibuzzwire.news) هر نسخه، نشت، و معیاری را که اتفاق می‌افتد ردیابی می‌کند.

آخرین پیشرفت‌های هوش مصنوعی را کاوش کنید →