گوگل روز سه شنبه Gemini 4 Argon را معرفی کرد، جدیدترین مدل مرزی خود که برای کارهای حرفه ای طولانی مدت در مهندسی نرم افزار، وظایف دانش سازمانی و دفاع از امنیت سایبری ساخته شده است. Koray Kavukcuoglu، معاون Google DeepMind و Chief AI Architect، در وبلاگ رسمی گوگل، گفت که این مدل در ابتدا از طریق برنامه Fairwind گوگل برای مجموعه ای از مدافعان سایبری قابل اعتماد ارائه می شود و پس از تقویت نرده های محافظ، دسترسی وسیع تری برای دنبال کردن دارد.
این اعلامیه در یکی از شلوغترین بخشهای سال برای انتشار هوش مصنوعی مرزی منتشر میشود. [AI Buzz Wire] (https://aibuzzwire.news) برای پوشش مداوم راهاندازی مدلها، مبارزات سیاستگذاری، و دورهای تأمین مالی، پیشرفتهای مهم را در زمان وقوع ردیابی میکند.
عرضه مرحله ای که با احتیاط شکل گرفته است
برخلاف مدل های اصلی معمولی، اکثر کاربران امروز نمی توانند آرگون را امتحان کنند. گوگل گفت که درگیر فرآیند داوطلبانه دولت ایالات متحده برای دسترسی به مدل پیش از انتشار است و به تدریج در دسترس بودن را گسترش خواهد داد زیرا بازخورد آزمایشکنندگان اولیه به نردههای محافظ آن شکل میدهد. رویترز گزارش داد که پرچمدار پس از ماهها تأخیر وارد بازار میشود و VentureBeat خاطرنشان کرد که استراتژی انتشار محدود همچنان به گوگل اجازه میدهد تا مجدداً برتری معیاری نسبت به OpenAI و Anthropic داشته باشد. بلومبرگ پیش از عرضه، شک و تردیدهای قابل اندازه گیری در مورد مدل جدید را در میان کارمندان خود گوگل گزارش داد.
وقتی دسترسی گستردهتر به دست آمد، گوگل اعلام کرد که با مشتریان API پولی و مشترکین Google AI Ultra شروع میشود.
کاری که گوگل می گوید آرگون می تواند انجام دهد
تغییر قابلیت سرفصل استقامت است. محدودیت توکن خروجی آرگون به 1 میلیون توکن پیشرو در صنعت افزایش یافته است که نسبت به 64 هزار توکن قبلی افزایش یافته است. گوگل استدلال میکند که به یک مدل فضای اصلی برای استدلال در میان صدها هزار توکن در یک مسیر واحد، به آن اجازه میدهد تا مشکلات سخت را در یک گذر حل کند نه اینکه کار را در جلسات تکه تکه کند.
گوگل نتایج معیار را برای حمایت از ادعای مرزی منتشر کرد:
- DeepSWE نسخه 1.1: 77.9% - یک وضعیت جدید از هنر در معیار مهندسی نرم افزار دنیای واقعی
- شاخص Vals: شماره 1 - عملکرد پیشرو در امور مالی، کدگذاری، حقوقی و مالیاتی با وزن دهی به تولید ناخالص داخلی ایالات متحده
- AutomationBench: 51.3% — رتبه اول در معیار اجرای تجاری انتها به انتها Zapier
- LVBench: 91.7% — بهترین حالت در درک ویدیوهای طولانی
- CWE-bench v1: 68% - برای اولین بار در اصلاح آسیب پذیری های امنیتی
درون گردش کار خود گوگل
آرگون در حال حاضر به کار داخلی گوگل کمک می کند و این شرکت نمونه های غیرعادی ملموسی را ارائه کرده است. در محاسبات کوانتومی، این مدل منابع فضا-زمان را برای زیرروال های تنگنا بهینه کرد و در عرض چند دقیقه 40 درصد از خط پایه منتشر شده را شکست داد. با تجزیه و تحلیل تله متری پروفایل سازی در ناوگان، تیم هایی از عوامل Argon بهینه سازی های حافظه را در مراکز داده Google شناسایی و اعمال کردند که پس از راه اندازی بیش از 300 TiB آزاد کردند و در مجموع 500 TiB تا 1 PiB صرفه جویی کردند.
این مدل همچنین انتقال کد در مقیاس بزرگ از C/C++ به Rust را انجام میدهد و از دهها هزار خط در کتابخانههای اصلی مانند re2 و libgav1 به بیش از 800000 خط در هسته Fuchsia Zircon مقیاس میدهد. برای libgav1، رمزگشای ویدیوی منبع باز گوگل، عوامل Argon 32000 خط کد SIMD را با Rust ایمن سازگار با کامپایلر جایگزین کردند و یک رمزگشای ایمن برای حافظه تولید کردند که 2.7 برابر سریعتر از پورت Rust قبلی با خروجی یکسان اجرا می شود.
دفاع از امنیت سایبری حرف اول را می زند
آرگون به صراحت برای کار دفاعی سایبری آموزش دیده بود: یافتن، اعتبارسنجی و اصلاح آسیبپذیریهای نرمافزاری بهطور مستقل. برای مدافعان مورد اعتماد و تیم های داخلی گوگل، این شرکت مدل را بدون حفاظ سایبری عرضه می کند تا مدافعان از توانایی کامل برخوردار شوند. در CWE-bench v1، که اصلاح آسیبپذیری را اندازهگیری میکند، آرگون با 68% در جایگاه اول قرار دارد، بر اساس عملکرد مرزی 3.8 Flash Cyber، و گوگل میگوید که آرگون در اکتشاف سطح حمله و تولید اثبات مفهوم در معیار تست نفوذ جعبه سیاه داخلی ویز از آن مدل بهتر عمل کرد.
شرکت امنیتی Wiz در حال حاضر از طریق ابتکار Scan for Good خود که از زیرساخت های عمومی حیاتی به صورت رایگان محافظت می کند از Argon استفاده می کند. در یک نمایش اولیه، گوگل میگوید این مدل آسیبپذیری مهمی را کشف کرده است که اطلاعات شخصی حساس را در سراسر نرمافزار مراقبتهای بهداشتی مورد استفاده بیمارستانها در سراسر جهان نشان میدهد - خطری که مدلهای مرزی قبلی از دست داده بودند.
چهار لایه حفاظت از مرز
قبل از دسترسی گسترده، گوگل در حال تقویت پادمان ها در چهار زمینه است. در برابر استفاده نادرست، آرگون برای رد درخواستهای حمله سایبری و CBRN طراحی شده است و در عین حال تحقیقات مشروع با استفاده دوگانه را حفظ میکند، با تکنیکهای جدیدی که فعالسازیهای داخلی مدل را برای شناسایی سوءاستفاده نظارت میکند. در برابر تزریق سریع، آموزش خصومتآمیز، انعطافپذیرترین مدل آرگون گوگل را تا به حال تبدیل کرده است که در معیار تزریق سریع غیر مستقیم Grey Swan پیشتاز است.
برای ناهماهنگی، گوگل در حال استقرار اقدامات کاهشی است که زنجیره افکار و اقدامات آرگون را نظارت می کند و در صورت لزوم اجرای آن را متوقف می کند و هشدارهایی را به یک تیم اختصاصی واکنش به حادثه ارسال می کند. این شرکت همچنین محیطهای آموزشی و ارزیابی جعبهشناختی خود را سختتر کرد و آنها را قبل از اجراهای پرخطر مهر و موم کرد. به طور قابلتوجه، گوگل از بقیه صنعت خواست تا شفافیت استدلال را حفظ کنند تا افکار مدل برای تشخیص ناهماهنگی مفید باقی بماند.
قیمت و در دسترس بودن
آرگون با قیمت اولیه 2 دلار به ازای هر میلیون توکن ورودی و 10 دلار در هر میلیون توکن خروجی، با توکن های ورودی کش با 95 درصد تخفیف از قیمت ورودی عرضه می شود. پس از دوره مقدماتی، قیمت به 4 دلار به ازای هر میلیون توکن ورودی و 20 دلار در هر میلیون توکن خروجی افزایش مییابد - آرگون را به شدت در برابر پیشنهادات مرزی رقیب قرار میدهد.
اولین صحنه، واقعیت جدیدی را برای نسخههای مرزی منعکس میکند: قابلیت اکنون در جدول است، و متمایزکننده کنترل را نشان میدهد. Google شرط میبندد که مدافعان سایبری، نرمافزارهای بیمارستانی و مهاجرتهای Rust ویترین مناسبی هستند - و عرضه عمومی کندتر هزینه کمتری نسبت به یک حادثه ایمنی دیگر دارد. توسعهدهندگان و شرکتها باید مراقب پنجره دسترسی API پولی و AI Ultra باشند، پنجرهای که گوگل میگوید به محض اینکه آزمایش گاردریل اجازه دهد باز خواهد شد.
---
از هوش مصنوعی جلوتر بمانیدآخرین اخبار، تحلیل ها و پیشرفت های هوش مصنوعی را دریافت کنید - همه در یک مکان.
بیشتر بخوانید اخبار هوش مصنوعی →