آنتروپیک روز سه‌شنبه از گسترش گسترده تلاش‌های دسترسی به مدل متمرکز بر امنیت خود خبر داد و ابتکار دسترسی بررسی‌شده خود را به یک برنامه تأیید رسمی سایبری (CVP) با سه سطح مجزا برای متخصصان امنیت سایبری تغییر ساختار داد. این اقدام زمانی انجام شد که این شرکت فاش کرد که ابتکار Project Glasswing از ماه آوریل حداقل 129000 آسیب پذیری نرم افزاری تأیید شده را کشف کرده است.

برنامه بازسازی‌شده به تیم‌های امنیتی بررسی‌شده اجازه می‌دهد تا توانمندترین مدل‌های Anthropic را اجرا کنند - از جمله Claude Opus 5.5، Claude Sonnet 5.5 و Claude Mythos 5.1 - با پادمان‌های کاهش یافته و طبقه‌بندی‌کننده‌های مسدود، مجوزهایی که معمولاً برای کاربران عمومی در دسترس نیستند. به گفته آنتروپیک، هدف این است که قابلیت‌های هوش مصنوعی مرزی را در اختیار مدافعان قرار دهیم، قبل از اینکه بازیگران مخرب به همان ابزارها حمله کنند. For more context on this story, see our ongoing AI news.

سه سطح دسترسی، سه سناریو تهدید

برنامه جدید حول سه سطح دسترسی سازماندهی شده است که هر کدام برای نوع متفاوتی از کار امنیتی طراحی شده است:

  • دسترسی دفاعی عملیات دفاعی مانند پاسخ به حادثه، مهندسی معکوس بدافزار و تجزیه و تحلیل آسیب پذیری و اعتبار سنجی را پوشش می دهد.
  • Red Team Access تست نفوذ مجاز و تیم قرمز را به موارد استفاده دفاعی اضافه می کند و امکان حملات شبیه سازی شده علیه سیستم هایی را که سازمان ها مجوز آزمایش آنها را دارند، می دهد.
  • دسترسی تخصصی دارای کمترین موارد حفاظتی است و برای مجموعه محدودی از سازمان های تأیید شده که مجاز به آزمایش سیستم های ایمنی هوش مصنوعی هستند، محفوظ است.

سازمان‌ها و تیم‌های امنیتی فردی برای ردیفی که با کارشان مطابقت دارد درخواست می‌کنند، و Anthropic هر برنامه را قبل از دادن دسترسی بررسی می‌کند. این شرکت گفت که هر سه سطح شامل دسترسی به مدل های پرچمدار فعلی و همچنین مدل های جدید عرضه شده در آینده است.

پادمان‌ها هنوز نیش می‌زنند - انتخابی

Anthropic این اعلامیه را با داده های ارزیابی جفت کرد تا نشان دهد که سیستم لایه کار دفاعی خوش خیم را از قابلیت واقعا خطرناک جدا می کند. در ارزیابی CyScenarioBench در Claude Opus 5.5، این شرکت گزارش داد که پادمان ها 46 کار از 50 وظیفه را در لایه دسترسی دفاعی مسدود می کنند. در ردیف Red Team Access در همان مدل، هیچ یک از کارها مسدود نشد و مدل 34 مورد از 50 مورد را تکمیل کرد - همان نرخ تکمیل ثبت شده زمانی که هیچ حفاظتی به طور کلی اعمال نشده بود.

در مقابل، بدون دسترسی به CVP، به گفته آنتروپیک، هر کار در اولین اعلان مسدود شد.

این شرکت در اعلامیه خود گفت: «این ارزیابی‌ها به ما اطمینان می‌دهد که می‌توانیم قابلیت‌های سایبری پیشرفته را به‌طور ایمن در دسترس مجموعه وسیع‌تری از مدافعان قرار دهیم و تلاش‌های دفاعی را که با Project Glasswing آغاز کردیم، گسترش دهیم».

این طرح منعکس کننده این شرط است که اکثر کارهای امنیتی دفاعی - وصله‌سازی، تجزیه و تحلیل گزارش، تریاژ بدافزار - می‌توانند در زیر نرده‌های محافظ سخت پیش بروند، در حالی که آزمایش تهاجمی قانونی نیاز به راهروی گسترده‌تری دارد. همچنین نشان می‌دهد که صنعت امنیت از مدت‌ها قبل با ابزارهای دو منظوره کار می‌کرده است: پزشک را بررسی کنید، نه فقط ابزار را.

ردپای در حال گسترش Glasswing

گسترش برنامه کاملاً با Project Glasswing، ابتکار آنتروپیک برای اعمال مدل‌های خود در سخت‌سازی نرم‌افزارهای حیاتی مرتبط است. این شرکت گفت که Glasswing حداقل 129000 آسیب‌پذیری نرم‌افزاری تأیید شده را بین آوریل تا ژوئیه 2026 و 5500 آسیب‌پذیری تأیید شده اضافی بین آوریل و اکتبر از طریق تلاش‌های اسکن منبع باز کشف کرده است.

از میان آسیب‌پذیری‌های تأیید شده، بیش از 33000 تا کنون به‌عنوان بحرانی یا با شدت بالا رتبه‌بندی شده‌اند - رقمی که Anthropic آن را به احتمال زیاد کم‌شمار قابل‌توجهی توصیف می‌کند، زیرا از داده‌های نظرسنجی فقط از زیرمجموعه‌ای از شرکای Glasswing استفاده می‌کند. این شرکت تخمین می زند که تاثیر واقعی می تواند حداقل پنج برابر بیشتر باشد.

نمایی سنجیده از کشف آسیب‌پذیری مبتنی بر هوش مصنوعی

تجزیه و تحلیل مستقل نشان می‌دهد که سیل نقص‌های کشف‌شده توسط هوش مصنوعی مستقیماً به موج مشابهی از نقض‌های مورد بهره‌برداری تبدیل نمی‌شود. در تحلیلی که اواخر ماه گذشته منتشر شد، پاتریک گاریتی، محقق VulnCheck دریافت که تنها 2 آسیب‌پذیری از 300 آسیب‌پذیری کشف‌شده توسط Anthropic یا Project Glasswing - تقریباً 0.67 درصد - در طبیعت مورد سوء استفاده قرار گرفته‌اند.

دو نقص مورد سوء استفاده عبارتند از CVE-2026-26980، یک آسیب پذیری تزریق SQL در Ghost CMS، و CVE-2026-61500، یک نقص جعل جلسه در Rejetto HTTP File Server. این داده‌ها از تفاوتی پشتیبانی می‌کنند که محققان امنیتی بر آن تاکید کرده‌اند: هوش مصنوعی مانع کشف آسیب‌پذیری‌ها را کاهش می‌دهد، اما بسیاری از نقص‌هایی که نشان می‌دهد هرگز در رادارهای مهاجمان نبود.

این اعلامیه همچنین در بحبوحه بحث های گسترده تر در مورد کارهای امنیتی ایجاد شده توسط هوش مصنوعی است. تحقیقات 1Password و Veracode نشان داده است که وصله‌های آسیب‌پذیری نوشته‌شده با هوش مصنوعی می‌توانند خود نقص‌های جدیدی را ایجاد کنند و تأکید می‌کنند که اتوماسیون کمک می‌کند اما جایگزین تأیید انسانی نمی‌شود.

چه معنایی برای صنعت امنیت دارد

برای تیم‌های امنیتی، CVP انرژی فعال‌سازی را برای استفاده از مدل‌های مرزی در کارهای دفاعی واقعی کاهش می‌دهد. واکنش‌دهنده‌های حادثه مسیری را برای کمک به تجزیه و تحلیل بدافزار به دست می‌آورند. تسترهای نفوذ یک محیط کنترل شده برای حملات با کمک هوش مصنوعی دریافت می کنند. و مجموعه کوچکی از سازمان‌هایی که سیستم‌های ایمنی هوش مصنوعی را ممیزی می‌کنند، کمترین دسترسی را دارند.

برای آنتروپیک، این برنامه هم یک استراتژی ایمنی و هم یک استراتژی تجاری است. این موضوع موضع شرکت را مبنی بر اینکه قابلیت‌های قدرتمند سایبری باید عمداً در اختیار مدافعان بررسی‌شده قرار گیرد، نه اینکه کاملاً سرکوب شود، مشخص می‌شود - این تضاد با رقبایی است که با بررسی دقیق مدل‌هایی با کنترل‌های سایبری ضعیف‌تر مواجه شده‌اند. همچنین روابط آنتروپیک را با شرکت هایی که احتمالاً برای دسترسی به مدل مرزی پرداخت می کنند، عمیق تر می کند: دولت ها، اپراتورهای زیرساخت های حیاتی و فروشندگان بزرگ امنیتی.

این شرکت تغییرات قیمتی مرتبط با این برنامه را اعلام نکرد و درخواست‌ها از طریق کانال‌های دسترسی بررسی‌شده موجود Anthropic پردازش می‌شوند. با توجه به مقیاس چیزی که Glasswing قبلاً ظاهر شده است - و اعتراف خود شرکت مبنی بر اینکه اعداد احتمالاً واقعیت را کم‌تر نشان می‌دهند - صنعت امنیت مشاهده خواهد کرد که چه تعداد از این 129000 یافته قبل از اینکه مهاجمان ابتدا آنها را پیدا کنند، برطرف می‌شوند.

---

Stay Ahead of AI

Get the latest AI news, analysis, and breakthroughs — all in one place.

Read more AI news →