Google DeepMind در حال آمادهسازی برای راهاندازی مدل جدید هوش مصنوعی، Gemini 3.8 Flash، در اوایل روز چهارشنبه است که قابلیتهای توسعه نرمافزار را هدف قرار میدهد که در آن گوگل از رقبای Anthropic و OpenAI عقب مانده است. وال استریت ژورنال روز دوشنبه با استناد به آزمایشهای داخلی که نشان میدهد مدل جدید در کدنویسی پیشرفت میکند، این برنامهها را گزارش کرد - منطقهای که به شدیدترین میدان جنگ در میان آزمایشگاههای مرزی تبدیل شده است.
این گزارش بازارها را به حرکت درآورد: به گفته بارونز، سهام آلفابت در معاملات بعد از ساعت کاری پس از داستان WSJ افزایش یافت. سرمایهگذاران عملکرد کدنویسی Google را از نزدیک تماشا میکنند، زیرا توسعهدهندگان به طور فزایندهای انتخاب ابزار خود را حول محور اینکه کدام مدل مینویسد، اشکالزدایی میکند و کد Refactor را با اطمینان بیشتری در جریانهای کاری عاملی کد مینویسد، دنبال میکنند. For more context on this story, see our ongoing AI news.
آنچه WSJ گزارش کرد
طبق گزارش ژورنال، آزمایشهای داخلی Gemini 3.8 Flash پیشرفتهایی را بهویژه در کدنویسی نشان میدهد، قابلیتی که Gemini از هر دو مدل کلود Anthropic و خط GPT OpenAI عقب افتاده است. انتظار می رود این هفته منتشر شود و چهارشنبه به عنوان اولین روز ممکن ذکر شده است.
چارچوب بندی مهم است: گوگل ادعای جهش همه جانبه نسبت به هر رقیب را ندارد. در عوض، این شرکت در حال حمله به مهمترین نقطه ضعف خود است. کدنویسی عاملی – جایی که یک مدل هوش مصنوعی در طول جلسات طولانی کد را در بسیاری از فایلها برنامهریزی میکند، مینویسد، آزمایش میکند و کد را اصلاح میکند – به معیاری تبدیل شده است که خریداران سازمانی و استارتآپهای ابزار توسعهدهنده بیشتر به آن اهمیت میدهند، و اینجاست که رقبای گوگل سرنخهای قدرتمند و پایگاههای کاربر وفادار ایجاد کردهاند.
شکاف کدنویسی که گوگل باید ببندد
کدنویسی بی سر و صدا به محرک اصلی درآمد صنعت هوش مصنوعی تبدیل شده است. Anthropic و OpenAI هر دو کسبوکارهای قابل توجهی را ایجاد کردهاند که مدلهای دارای قابلیت کدنویسی را به شرکتها و پلتفرمهای توسعهدهنده میفروشند، و ارزیابیهای شخص ثالث از عملکرد کدنویسی عاملی، مدلهای کلود و GPT را تا سال ۲۰۲۶ به طور مداوم جلوتر از Gemini قرار دادهاند.
این شکاف عواقب واقعی دارد. توسعهدهندگانی که یک مدل کدنویسی را انتخاب میکنند، تمایل دارند در اکوسیستم آن بمانند - ابزارهای CLI، ادغامهای ویرایشگر آن، صورتحساب API آن. مزیتهای توزیع عظیم گوگل از طریق جستجو، اندروید و فضای کاری به تسلط معادل در حوزه کدنویسی تبدیل نشده است، و گزارش WSJ نشان میدهد که DeepMind پنجرهای را برای تغییر میداند که اکنون وجود دارد.
نام تجاری فلش خود بخشی از محاسبه است. از زمانی که Google شروع به قرار دادن فلش به عنوان ردیف سریع و ارزان خانواده Gemini کرد، پسوند نشان دهنده مدلی است که توسعه دهندگان در واقع در تولید اجرا می کنند - حجم کاری بالا و حساس به قیمت که در آن تفاوت های کوچک در تأخیر و هزینه، انتخاب های API را تعیین می کند. یک مدل Flash-tier که در کدنویسی نیز پیشتاز است، همزمان با ادعاهای کیفیت رقبا، استدلالهای قیمتگذاری را کاهش میدهد.
دنبال کردن سریع Gemini 3.7 Flash
اگر عرضه چهارشنبه اتفاق بیفتد، تنها چند هفته پس از عرضه Gemini 3.7 Flash توسط گوگل در اواسط آگوست خواهد بود، نسخه ای که این شرکت به عنوان هوشمندترین مدل اسب کاری خود برای برنامه نویسی و عوامل با تقریباً نصف قیمت قبلی معرفی می شود. گوگل همچنین در اواخر ماه آگوست، از Gemini 3.7 Flash با قدرت کدنویسی پیشرفته رونمایی کرد.
آهنگ فشرده شده بی توجه نبوده است. NokiaPowerUser در این هفته گزارش داد که چگونه گوگل 3.7 فلش را به این سرعت برطرف کرده است، که منعکس کننده دیدگاه گسترده تری است مبنی بر اینکه DeepMind به حمل و نقل سریع و تدریجی روی آورده است - به ریتم تکرار هفتگی رقبای خود نزدیکتر از فاصله های یک ساله نسل های قبلی Gemini.
تمرکز کدگذاری و توهمات کمتر
فراتر از قدرت کدگذاری خام، پوشش مدل آینده به اولویت دوم اشاره دارد: کاهش توهم. VOI.ID گزارش داد که آزمایش فلش Gemini 3.8 بر روی کدنویسی تمرکز میکند و در عین حال توهمهای هوش مصنوعی را کاهش میدهد - مشکل قابلیت اطمینان که در کار نرمافزاری مهمتر است، جایی که یک پیشنهاد اشتباه مطمئناً میتواند سیستم تولید را خراب کند.
این ترکیب - کدگذاری عاملی قویتر به علاوه خروجیهای ساخته شده کمتر - دقیقاً دو محوری را هدف قرار میدهد که توسعهدهندگان هنگام توضیح اینکه چرا از ابزارهای مبتنی بر Claude یا GPT برای کارهای مهندسی جدی استفاده میکنند، اشاره میکنند.
نشت کاغذ Tencent
نام مدل قبل از گزارش WSJ به طور عمومی ظاهر شد، هرچند به سختی. همانطور که توسط Pasquale Pillitteri گزارش شده است، ذکر یک خطی از Gemini 3.8 Flash در یک مقاله تحقیقاتی از Tencent ظاهر شد که به علاقه مندان اولین تأیید سخت را داد که این مدل وجود داشته است در حالی که اساساً چیزی در مورد آن فاش نمی شود. نشت اتفاقی یک الگوی آشنا در صنعت است: جداول معیار و فهرستهای استناد در مقالات دانشگاهی به منبع مکرر اطلاعات قبل از عرضه در مورد مدلهای منتشر نشده تبدیل شدهاند.
برای توسعه دهندگان و بازار به چه معناست
اگر Gemini 3.8 Flash همانطور که گزارش شده است، در این هفته فرود بیاید، توسعه دهندگان سه آزمایشگاه مرزی خواهند داشت که مدل های کدگذاری سطح بالا را در همان ماه ارسال می کنند، پس از راه اندازی Claude Fable 5.1 و Mythos 5.1 توسط Anthropic در روز دوشنبه با کدگذاری عامل ارزان تر. فشار قیمتگذاری که از قبل شدیدتر است، شدیدتر خواهد شد – و سازندگان ابزار که بر روی این APIها ساخته میشوند، اهرم مذاکره با هر رقیب جدیدی را به دست میآورند.
برای گوگل، مخاطرات فراتر از ذهنیت توسعه دهندگان است. کسب و کار ابری Alphabet، مجموعه بهرهوری Workspace و اکوسیستم اندروید آن، همگی سود میبرند، اگر مدلهای خود این شرکت بتوانند به طور قابل اعتمادی جریانهای کاری کدگذاری را که کسبوکارها در ابتدا خودکار میکنند، تقویت کنند. یک داستان کدنویسی معتبر Gemini از هر سه پشتیبانی می کند.
گزارش WSJ نشان می دهد که گوگل معتقد است که بالاخره این شکاف را کاهش داده است. اینکه آیا معیارها - و مهمتر از آن، توسعه دهندگان فعال - موافق هستند، طی چند روز مشخص خواهد شد.
---
Stay Ahead of AIGet the latest AI news, analysis, and breakthroughs — all in one place.
Read more AI news →
