Google DeepMind در حال آماده‌سازی برای راه‌اندازی مدل جدید هوش مصنوعی، Gemini 3.8 Flash، در اوایل روز چهارشنبه است که قابلیت‌های توسعه نرم‌افزار را هدف قرار می‌دهد که در آن گوگل از رقبای Anthropic و OpenAI عقب مانده است. وال استریت ژورنال روز دوشنبه با استناد به آزمایش‌های داخلی که نشان می‌دهد مدل جدید در کدنویسی پیشرفت می‌کند، این برنامه‌ها را گزارش کرد - منطقه‌ای که به شدیدترین میدان جنگ در میان آزمایشگاه‌های مرزی تبدیل شده است.

این گزارش بازارها را به حرکت درآورد: به گفته بارونز، سهام آلفابت در معاملات بعد از ساعت کاری پس از داستان WSJ افزایش یافت. سرمایه‌گذاران عملکرد کدنویسی Google را از نزدیک تماشا می‌کنند، زیرا توسعه‌دهندگان به طور فزاینده‌ای انتخاب ابزار خود را حول محور اینکه کدام مدل می‌نویسد، اشکال‌زدایی می‌کند و کد Refactor را با اطمینان بیشتری در جریان‌های کاری عاملی کد می‌نویسد، دنبال می‌کنند. For more context on this story, see our ongoing AI news.

آنچه WSJ گزارش کرد

طبق گزارش ژورنال، آزمایش‌های داخلی Gemini 3.8 Flash پیشرفت‌هایی را به‌ویژه در کدنویسی نشان می‌دهد، قابلیتی که Gemini از هر دو مدل کلود Anthropic و خط GPT OpenAI عقب افتاده است. انتظار می رود این هفته منتشر شود و چهارشنبه به عنوان اولین روز ممکن ذکر شده است.

چارچوب بندی مهم است: گوگل ادعای جهش همه جانبه نسبت به هر رقیب را ندارد. در عوض، این شرکت در حال حمله به مهمترین نقطه ضعف خود است. کدنویسی عاملی – جایی که یک مدل هوش مصنوعی در طول جلسات طولانی کد را در بسیاری از فایل‌ها برنامه‌ریزی می‌کند، می‌نویسد، آزمایش می‌کند و کد را اصلاح می‌کند – به معیاری تبدیل شده است که خریداران سازمانی و استارت‌آپ‌های ابزار توسعه‌دهنده بیشتر به آن اهمیت می‌دهند، و اینجاست که رقبای گوگل سرنخ‌های قدرتمند و پایگاه‌های کاربر وفادار ایجاد کرده‌اند.

شکاف کدنویسی که گوگل باید ببندد

کدنویسی بی سر و صدا به محرک اصلی درآمد صنعت هوش مصنوعی تبدیل شده است. Anthropic و OpenAI هر دو کسب‌وکارهای قابل توجهی را ایجاد کرده‌اند که مدل‌های دارای قابلیت کدنویسی را به شرکت‌ها و پلت‌فرم‌های توسعه‌دهنده می‌فروشند، و ارزیابی‌های شخص ثالث از عملکرد کدنویسی عاملی، مدل‌های کلود و GPT را تا سال ۲۰۲۶ به طور مداوم جلوتر از Gemini قرار داده‌اند.

این شکاف عواقب واقعی دارد. توسعه‌دهندگانی که یک مدل کدنویسی را انتخاب می‌کنند، تمایل دارند در اکوسیستم آن بمانند - ابزارهای CLI، ادغام‌های ویرایشگر آن، صورت‌حساب API آن. مزیت‌های توزیع عظیم گوگل از طریق جستجو، اندروید و فضای کاری به تسلط معادل در حوزه کدنویسی تبدیل نشده است، و گزارش WSJ نشان می‌دهد که DeepMind پنجره‌ای را برای تغییر می‌داند که اکنون وجود دارد.

نام تجاری فلش خود بخشی از محاسبه است. از زمانی که Google شروع به قرار دادن فلش به عنوان ردیف سریع و ارزان خانواده Gemini کرد، پسوند نشان دهنده مدلی است که توسعه دهندگان در واقع در تولید اجرا می کنند - حجم کاری بالا و حساس به قیمت که در آن تفاوت های کوچک در تأخیر و هزینه، انتخاب های API را تعیین می کند. یک مدل Flash-tier که در کدنویسی نیز پیشتاز است، همزمان با ادعاهای کیفیت رقبا، استدلال‌های قیمت‌گذاری را کاهش می‌دهد.

دنبال کردن سریع Gemini 3.7 Flash

اگر عرضه چهارشنبه اتفاق بیفتد، تنها چند هفته پس از عرضه Gemini 3.7 Flash توسط گوگل در اواسط آگوست خواهد بود، نسخه ای که این شرکت به عنوان هوشمندترین مدل اسب کاری خود برای برنامه نویسی و عوامل با تقریباً نصف قیمت قبلی معرفی می شود. گوگل همچنین در اواخر ماه آگوست، از Gemini 3.7 Flash با قدرت کدنویسی پیشرفته رونمایی کرد.

آهنگ فشرده شده بی توجه نبوده است. NokiaPowerUser در این هفته گزارش داد که چگونه گوگل 3.7 فلش را به این سرعت برطرف کرده است، که منعکس کننده دیدگاه گسترده تری است مبنی بر اینکه DeepMind به حمل و نقل سریع و تدریجی روی آورده است - به ریتم تکرار هفتگی رقبای خود نزدیکتر از فاصله های یک ساله نسل های قبلی Gemini.

تمرکز کدگذاری و توهمات کمتر

فراتر از قدرت کدگذاری خام، پوشش مدل آینده به اولویت دوم اشاره دارد: کاهش توهم. VOI.ID گزارش داد که آزمایش فلش Gemini 3.8 بر روی کدنویسی تمرکز می‌کند و در عین حال توهم‌های هوش مصنوعی را کاهش می‌دهد - مشکل قابلیت اطمینان که در کار نرم‌افزاری مهم‌تر است، جایی که یک پیشنهاد اشتباه مطمئناً می‌تواند سیستم تولید را خراب کند.

این ترکیب - کدگذاری عاملی قوی‌تر به علاوه خروجی‌های ساخته شده کمتر - دقیقاً دو محوری را هدف قرار می‌دهد که توسعه‌دهندگان هنگام توضیح اینکه چرا از ابزارهای مبتنی بر Claude یا GPT برای کارهای مهندسی جدی استفاده می‌کنند، اشاره می‌کنند.

نشت کاغذ Tencent

نام مدل قبل از گزارش WSJ به طور عمومی ظاهر شد، هرچند به سختی. همانطور که توسط Pasquale Pillitteri گزارش شده است، ذکر یک خطی از Gemini 3.8 Flash در یک مقاله تحقیقاتی از Tencent ظاهر شد که به علاقه مندان اولین تأیید سخت را داد که این مدل وجود داشته است در حالی که اساساً چیزی در مورد آن فاش نمی شود. نشت اتفاقی یک الگوی آشنا در صنعت است: جداول معیار و فهرست‌های استناد در مقالات دانشگاهی به منبع مکرر اطلاعات قبل از عرضه در مورد مدل‌های منتشر نشده تبدیل شده‌اند.

برای توسعه دهندگان و بازار به چه معناست

اگر Gemini 3.8 Flash همانطور که گزارش شده است، در این هفته فرود بیاید، توسعه دهندگان سه آزمایشگاه مرزی خواهند داشت که مدل های کدگذاری سطح بالا را در همان ماه ارسال می کنند، پس از راه اندازی Claude Fable 5.1 و Mythos 5.1 توسط Anthropic در روز دوشنبه با کدگذاری عامل ارزان تر. فشار قیمت‌گذاری که از قبل شدیدتر است، شدیدتر خواهد شد – و سازندگان ابزار که بر روی این APIها ساخته می‌شوند، اهرم مذاکره با هر رقیب جدیدی را به دست می‌آورند.

برای گوگل، مخاطرات فراتر از ذهنیت توسعه دهندگان است. کسب و کار ابری Alphabet، مجموعه بهره‌وری Workspace و اکوسیستم اندروید آن، همگی سود می‌برند، اگر مدل‌های خود این شرکت بتوانند به طور قابل اعتمادی جریان‌های کاری کدگذاری را که کسب‌وکارها در ابتدا خودکار می‌کنند، تقویت کنند. یک داستان کدنویسی معتبر Gemini از هر سه پشتیبانی می کند.

گزارش WSJ نشان می دهد که گوگل معتقد است که بالاخره این شکاف را کاهش داده است. اینکه آیا معیارها - و مهمتر از آن، توسعه دهندگان فعال - موافق هستند، طی چند روز مشخص خواهد شد.

---

Stay Ahead of AI

Get the latest AI news, analysis, and breakthroughs — all in one place.

Read more AI news →