گوگل روز سه شنبه Gemini 4 Argon را معرفی کرد، جدیدترین مدل مرزی خود که برای کارهای حرفه ای طولانی مدت در مهندسی نرم افزار، وظایف دانش سازمانی و دفاع از امنیت سایبری ساخته شده است. Koray Kavukcuoglu، معاون Google DeepMind و Chief AI Architect، در وبلاگ رسمی گوگل، گفت که این مدل در ابتدا از طریق برنامه Fairwind گوگل برای مجموعه ای از مدافعان سایبری قابل اعتماد ارائه می شود و پس از تقویت نرده های محافظ، دسترسی وسیع تری برای دنبال کردن دارد.

این اعلامیه در یکی از شلوغ‌ترین بخش‌های سال برای انتشار هوش مصنوعی مرزی منتشر می‌شود. [AI Buzz Wire] (https://aibuzzwire.news) برای پوشش مداوم راه‌اندازی مدل‌ها، مبارزات سیاست‌گذاری، و دورهای تأمین مالی، پیشرفت‌های مهم را در زمان وقوع ردیابی می‌کند.

عرضه مرحله ای که با احتیاط شکل گرفته است

برخلاف مدل های اصلی معمولی، اکثر کاربران امروز نمی توانند آرگون را امتحان کنند. گوگل گفت که درگیر فرآیند داوطلبانه دولت ایالات متحده برای دسترسی به مدل پیش از انتشار است و به تدریج در دسترس بودن را گسترش خواهد داد زیرا بازخورد آزمایش‌کنندگان اولیه به نرده‌های محافظ آن شکل می‌دهد. رویترز گزارش داد که پرچم‌دار پس از ماه‌ها تأخیر وارد بازار می‌شود و VentureBeat خاطرنشان کرد که استراتژی انتشار محدود همچنان به گوگل اجازه می‌دهد تا مجدداً برتری معیاری نسبت به OpenAI و Anthropic داشته باشد. بلومبرگ پیش از عرضه، شک و تردیدهای قابل اندازه گیری در مورد مدل جدید را در میان کارمندان خود گوگل گزارش داد.

وقتی دسترسی گسترده‌تر به دست آمد، گوگل اعلام کرد که با مشتریان API پولی و مشترکین Google AI Ultra شروع می‌شود.

کاری که گوگل می گوید آرگون می تواند انجام دهد

تغییر قابلیت سرفصل استقامت است. محدودیت توکن خروجی آرگون به 1 میلیون توکن پیشرو در صنعت افزایش یافته است که نسبت به 64 هزار توکن قبلی افزایش یافته است. گوگل استدلال می‌کند که به یک مدل فضای اصلی برای استدلال در میان صدها هزار توکن در یک مسیر واحد، به آن اجازه می‌دهد تا مشکلات سخت را در یک گذر حل کند نه اینکه کار را در جلسات تکه تکه کند.

گوگل نتایج معیار را برای حمایت از ادعای مرزی منتشر کرد:

  • DeepSWE نسخه 1.1: 77.9% - یک وضعیت جدید از هنر در معیار مهندسی نرم افزار دنیای واقعی
  • شاخص Vals: شماره 1 - عملکرد پیشرو در امور مالی، کدگذاری، حقوقی و مالیاتی با وزن دهی به تولید ناخالص داخلی ایالات متحده
  • AutomationBench: 51.3% — رتبه اول در معیار اجرای تجاری انتها به انتها Zapier
  • LVBench: 91.7% — بهترین حالت در درک ویدیوهای طولانی
  • CWE-bench v1: 68% - برای اولین بار در اصلاح آسیب پذیری های امنیتی

درون گردش کار خود گوگل

آرگون در حال حاضر به کار داخلی گوگل کمک می کند و این شرکت نمونه های غیرعادی ملموسی را ارائه کرده است. در محاسبات کوانتومی، این مدل منابع فضا-زمان را برای زیرروال های تنگنا بهینه کرد و در عرض چند دقیقه 40 درصد از خط پایه منتشر شده را شکست داد. با تجزیه و تحلیل تله متری پروفایل سازی در ناوگان، تیم هایی از عوامل Argon بهینه سازی های حافظه را در مراکز داده Google شناسایی و اعمال کردند که پس از راه اندازی بیش از 300 TiB آزاد کردند و در مجموع 500 TiB تا 1 PiB صرفه جویی کردند.

این مدل همچنین انتقال کد در مقیاس بزرگ از C/C++ به Rust را انجام می‌دهد و از ده‌ها هزار خط در کتابخانه‌های اصلی مانند re2 و libgav1 به بیش از 800000 خط در هسته Fuchsia Zircon مقیاس می‌دهد. برای libgav1، رمزگشای ویدیوی منبع باز گوگل، عوامل Argon 32000 خط کد SIMD را با Rust ایمن سازگار با کامپایلر جایگزین کردند و یک رمزگشای ایمن برای حافظه تولید کردند که 2.7 برابر سریعتر از پورت Rust قبلی با خروجی یکسان اجرا می شود.

دفاع از امنیت سایبری حرف اول را می زند

آرگون به صراحت برای کار دفاعی سایبری آموزش دیده بود: یافتن، اعتبارسنجی و اصلاح آسیب‌پذیری‌های نرم‌افزاری به‌طور مستقل. برای مدافعان مورد اعتماد و تیم های داخلی گوگل، این شرکت مدل را بدون حفاظ سایبری عرضه می کند تا مدافعان از توانایی کامل برخوردار شوند. در CWE-bench v1، که اصلاح آسیب‌پذیری را اندازه‌گیری می‌کند، آرگون با 68% در جایگاه اول قرار دارد، بر اساس عملکرد مرزی 3.8 Flash Cyber، و گوگل می‌گوید که آرگون در اکتشاف سطح حمله و تولید اثبات مفهوم در معیار تست نفوذ جعبه سیاه داخلی ویز از آن مدل بهتر عمل کرد.

شرکت امنیتی Wiz در حال حاضر از طریق ابتکار Scan for Good خود که از زیرساخت های عمومی حیاتی به صورت رایگان محافظت می کند از Argon استفاده می کند. در یک نمایش اولیه، گوگل می‌گوید این مدل آسیب‌پذیری مهمی را کشف کرده است که اطلاعات شخصی حساس را در سراسر نرم‌افزار مراقبت‌های بهداشتی مورد استفاده بیمارستان‌ها در سراسر جهان نشان می‌دهد - خطری که مدل‌های مرزی قبلی از دست داده بودند.

چهار لایه حفاظت از مرز

قبل از دسترسی گسترده، گوگل در حال تقویت پادمان ها در چهار زمینه است. در برابر استفاده نادرست، آرگون برای رد درخواست‌های حمله سایبری و CBRN طراحی شده است و در عین حال تحقیقات مشروع با استفاده دوگانه را حفظ می‌کند، با تکنیک‌های جدیدی که فعال‌سازی‌های داخلی مدل را برای شناسایی سوءاستفاده نظارت می‌کند. در برابر تزریق سریع، آموزش خصومت‌آمیز، انعطاف‌پذیرترین مدل آرگون گوگل را تا به حال تبدیل کرده است که در معیار تزریق سریع غیر مستقیم Grey Swan پیشتاز است.

برای ناهماهنگی، گوگل در حال استقرار اقدامات کاهشی است که زنجیره افکار و اقدامات آرگون را نظارت می کند و در صورت لزوم اجرای آن را متوقف می کند و هشدارهایی را به یک تیم اختصاصی واکنش به حادثه ارسال می کند. این شرکت همچنین محیط‌های آموزشی و ارزیابی جعبه‌شناختی خود را سخت‌تر کرد و آنها را قبل از اجراهای پرخطر مهر و موم کرد. به طور قابل‌توجه، گوگل از بقیه صنعت خواست تا شفافیت استدلال را حفظ کنند تا افکار مدل برای تشخیص ناهماهنگی مفید باقی بماند.

قیمت و در دسترس بودن

آرگون با قیمت اولیه 2 دلار به ازای هر میلیون توکن ورودی و 10 دلار در هر میلیون توکن خروجی، با توکن های ورودی کش با 95 درصد تخفیف از قیمت ورودی عرضه می شود. پس از دوره مقدماتی، قیمت به 4 دلار به ازای هر میلیون توکن ورودی و 20 دلار در هر میلیون توکن خروجی افزایش می‌یابد - آرگون را به شدت در برابر پیشنهادات مرزی رقیب قرار می‌دهد.

اولین صحنه، واقعیت جدیدی را برای نسخه‌های مرزی منعکس می‌کند: قابلیت اکنون در جدول است، و متمایزکننده کنترل را نشان می‌دهد. Google شرط می‌بندد که مدافعان سایبری، نرم‌افزارهای بیمارستانی و مهاجرت‌های Rust ویترین مناسبی هستند - و عرضه عمومی کندتر هزینه کمتری نسبت به یک حادثه ایمنی دیگر دارد. توسعه‌دهندگان و شرکت‌ها باید مراقب پنجره دسترسی API پولی و AI Ultra باشند، پنجره‌ای که گوگل می‌گوید به محض اینکه آزمایش گاردریل اجازه دهد باز خواهد شد.

---

از هوش مصنوعی جلوتر بمانید

آخرین اخبار، تحلیل ها و پیشرفت های هوش مصنوعی را دریافت کنید - همه در یک مکان.

بیشتر بخوانید اخبار هوش مصنوعی →