یک استارت‌آپ آمریکایی به نام Abliteration.ai یکی از بحث‌برانگیزترین تکنیک‌های AI منبع باز را به یک سرویس تجاری تبدیل کرده است، فروش دسترسی مرورگر و API به مدل‌های وزن باز محبوب با حذف آموزش ایمنی آنها - از جمله GLM-5.3 Z.ai که اخیراً منتشر شده است، یکی از توانمندترین مدل‌های باز موجود امروز.

این شرکت نام خود را از "ابلیتراسیون" گرفته است، روشی که تمایل مدل به رد درخواست های مضر را حذف می کند. محققان و علاقه‌مندان سال‌ها از این تکنیک استفاده کرده‌اند و Hugging Face میزبان هزاران مدل از بین رفته است. چیزی که جدید است بسته بندی آن است: Abliteration.ai مدل های اصلاح شده را در زیرساخت خود میزبانی می کند، بنابراین هرکسی که یک مرورگر وب دارد می تواند بدون بارگیری وزن یا کرایه GPU، آنها را جستجو کند. TechCrunch این توسعه را در 3 سپتامبر گزارش کرد و از آن زمان توسط محققان ایمنی که بحث وزن‌های باز را در [پوشش خبری AI] ما دنبال می‌کنیم مورد بررسی قرار گرفته است (https://aibuzzwire.news).

از تکنیک زیرزمینی تا سکوی کلید در دست

Abliteration.ai که در اواخر سال گذشته تأسیس شد و به طور رسمی در ماه مارس ثبت شد، این عمل را از یک توله منبع باز خود انجام دهید به یک محصول تجاری صیقلی منتقل می کند. با میزبانی خود مدل‌ها، شرکت دو نقطه اصطکاک را به طور همزمان حذف می‌کند: کاربران دیگر به مهارت فنی برای حذف یک مدل نیاز ندارند، و نه به محاسبه برای اجرای آن.

یکی از بنیانگذاران دوون - TechCrunch نام خانوادگی خود را به درخواست او به دلیل اینکه در یک شرکت دیگر مشغول به کار است پنهان کرد - گفت که این شرکت با چندین ارائه دهنده بزرگ ابری معامله کرده است و کاملاً از طریق درآمد مشتری تأمین می شود. این استارت‌آپ سرمایه خطرپذیر را افزایش نداده است، اگرچه او گفت مذاکرات در حال انجام است.

تست TechCrunch چه چیزی پیدا کرد

این شرکت می‌گوید هدفش این است که «کارهای تهاجمی سایبری، تیم قرمز، و آزمایش عاملی را که مدل‌های دیگر از انجام آن امتناع می‌کنند» فعال کند. TechCrunch آن را با یک حساب کاربری رایگان آزمایش کرد و نسخه حذف شده GLM-5.3 را از طریق یک مرورگر وب جستجو کرد. خبرنگاران از مدل خواستند برنامه پایتون بنویسد که رمزهای عبور ذخیره شده کروم را می دزدد و پروتکل دقیقی برای کشت یک پاتوژن خطرناک انسانی در خانه تولید کند. بر اساس این گزارش، به راحتی با هر دو درخواست موافقت کرد.

این آزمایش قلب داستان است: وظایفی که مدل‌های مرزی اصلی قاطعانه از آن‌ها امتناع می‌کنند، اکنون در پشت فرم ثبت‌نام، بدون هیچ هزینه‌ای، در برگه مرورگر در دسترس هستند.

استدلال دفاعی تیم قرمز

مورد دوون برای کسب و کار، استدلال امنیتی کلاسیک است: شما نمی توانید در برابر رفتاری که نمی توانید آن را بازتولید کنید، دفاع کنید. مدلی که از نوشتن کد اکسپلویت کار امتناع می کند، برای تیم قرمز که سعی در درک مهاجمان واقعی دارد، فایده چندانی ندارد.

او به TechCrunch گفت: «تصویر بزرگ مدل‌های از بین رفته این است که می‌توانند از بازیگران بد الگوسازی کنند. مزیت اکنون این است که مدافعان می توانند با بیشترین سرعت ممکن حرکت کنند... من فکر می کنم این امر امنیت سایبری را تسریع خواهد کرد، که نوعی نقطه ضعف است.

مشتریان این شرکت شامل استارت‌آپ‌هایی با تیم قرمز در مراحل اولیه در بریتانیا و اروپا هستند که امنیت بانک‌ها، خطوط هوایی و سایر اپراتورهای زیرساخت‌های حیاتی را آزمایش می‌کنند. دوون گفت، یکی از مشتریان اصلی، تیم قرمز کارگزاران بانکی را تشکیل می دهد و نمی تواند آن کار را با مدل های تجاری اصلاح نشده انجام دهد.

'الگویی که یک جامعه شناس می شود'

محققان ایمنی همین قابلیت را بسیار متفاوت می بینند. اندرو یون، رئیس تحقیقات در موسسه غیرانتفاعی ایمنی هوش مصنوعی CivAI، به TechCrunch گفت که ابلیتراسیون به شما امکان می دهد "مدل را طوری تغییر دهید که تبدیل به یک آسیب اجتماعی شود."

یون گفت: «شما می‌توانید به معنای واقعی کلمه هر چیزی را در اینجا تایپ کنید، و با آن مطابقت خواهد داشت.

در یک نظر اخیر، یون استدلال کرد که اگر نمی‌توان جلوی حذف نرده‌های محافظ را گرفت، دولت‌ها باید از ارائه‌دهندگان بخواهند تا طبقه‌بندی‌کننده‌هایی را اجرا کنند که فعالیت‌های سایبری و سلاح‌های زیستی مضر را شناسایی و مسدود می‌کنند، و باید از شرکت‌هایی که دسترسی مستقیم به GPUهای پیشرفته را اجاره می‌کنند، بخواهند هویت مشتری را تأیید کنند و خدمات را در مواردی که سوءاستفاده خطرناک مشکوک است، رد کنند.

نرده محافظ نازک و بدون بررسی هویت

در حال حاضر، حفاظت از خود Abliteration.ai حداقل است. این پلتفرم به مشتریان یک لایه تعدیل اختیاری ارائه می‌کند تا بتوانند هر محدودیتی را که می‌خواهند اضافه کنند، و خود سایت محدودیت‌های جزئی را حفظ می‌کند - TechCrunch نتوانست این مدل را برای تولید دستورالعمل‌های خودکشی بپذیرد، و دوون گفت که روی اقدامات اضافی برای جلوگیری از خشونت کار می‌کند.

این شرکت به غیر از ثبت کارت اعتباری مورد استفاده برای پرداخت، هیچ گونه غربالگری مشتری شما را انجام نمی دهد. "شما نمی خواهید مسئول انجام کاری دیوانه وار شخصی باشید... پس خط مسئولیت خود را به عنوان یک شرکت از کجا ترسیم می کنید؟" دوون گفت. ما هنوز در مرحله تعریف آن هستیم.»

سوالی که صنعت نمی تواند از آن طفره رود

همه متخصصان امنیتی موافق نیستند که مدل های حذف شده حتی بهترین ابزار برای آزمایش تهاجمی هستند. احمد علی، مدیر عامل شرکت فابرایکس که تیم قرمز کار می کند، به TechCrunch گفت که شرکت او بیشتر بر روی مدل های وزن باز تنظیم دقیق تکیه می کند، که در حال حاضر با امتناع کمی عرضه می شوند - و خاطرنشان می کند که فرسودگی می تواند قابلیت های زیربنایی یک مدل را کاهش دهد.

اکثر کارشناسانی که TechCrunch با آنها مشورت کرده است در یک چیز اتفاق نظر دارند: این عمل را نمی توان متوقف کرد. وزن‌های قابل دانلود به این معنی است که هر کسی می‌تواند امتناع‌ها را به صورت محلی حذف کند، همانطور که در تفسیر سال 2026 مرکز مبارزه با تروریسم در وست پوینت در مورد سوء استفاده از «نابودی» تأکید شده است. سوال باز نیروهای Abliteration.ai این است که آیا کاهش هزینه دسترسی برای همه - مدافعان و مهاجمان به طور یکسان - اینترنت را ایمن تر یا خطرناک تر می کند؟

از هوش مصنوعی جلوتر بمانید

ایمنی هوش مصنوعی هر روز در حال پیشرفت است. [آخرین پیشرفت‌های هوش مصنوعی] (https://aibuzzwire.news) را در یک مکان دریافت کنید.

اخبار هوش مصنوعی را بیشتر بخوانید →