یک استارتآپ آمریکایی به نام Abliteration.ai یکی از بحثبرانگیزترین تکنیکهای AI منبع باز را به یک سرویس تجاری تبدیل کرده است، فروش دسترسی مرورگر و API به مدلهای وزن باز محبوب با حذف آموزش ایمنی آنها - از جمله GLM-5.3 Z.ai که اخیراً منتشر شده است، یکی از توانمندترین مدلهای باز موجود امروز.
این شرکت نام خود را از "ابلیتراسیون" گرفته است، روشی که تمایل مدل به رد درخواست های مضر را حذف می کند. محققان و علاقهمندان سالها از این تکنیک استفاده کردهاند و Hugging Face میزبان هزاران مدل از بین رفته است. چیزی که جدید است بسته بندی آن است: Abliteration.ai مدل های اصلاح شده را در زیرساخت خود میزبانی می کند، بنابراین هرکسی که یک مرورگر وب دارد می تواند بدون بارگیری وزن یا کرایه GPU، آنها را جستجو کند. TechCrunch این توسعه را در 3 سپتامبر گزارش کرد و از آن زمان توسط محققان ایمنی که بحث وزنهای باز را در [پوشش خبری AI] ما دنبال میکنیم مورد بررسی قرار گرفته است (https://aibuzzwire.news).
از تکنیک زیرزمینی تا سکوی کلید در دست
Abliteration.ai که در اواخر سال گذشته تأسیس شد و به طور رسمی در ماه مارس ثبت شد، این عمل را از یک توله منبع باز خود انجام دهید به یک محصول تجاری صیقلی منتقل می کند. با میزبانی خود مدلها، شرکت دو نقطه اصطکاک را به طور همزمان حذف میکند: کاربران دیگر به مهارت فنی برای حذف یک مدل نیاز ندارند، و نه به محاسبه برای اجرای آن.
یکی از بنیانگذاران دوون - TechCrunch نام خانوادگی خود را به درخواست او به دلیل اینکه در یک شرکت دیگر مشغول به کار است پنهان کرد - گفت که این شرکت با چندین ارائه دهنده بزرگ ابری معامله کرده است و کاملاً از طریق درآمد مشتری تأمین می شود. این استارتآپ سرمایه خطرپذیر را افزایش نداده است، اگرچه او گفت مذاکرات در حال انجام است.
تست TechCrunch چه چیزی پیدا کرد
این شرکت میگوید هدفش این است که «کارهای تهاجمی سایبری، تیم قرمز، و آزمایش عاملی را که مدلهای دیگر از انجام آن امتناع میکنند» فعال کند. TechCrunch آن را با یک حساب کاربری رایگان آزمایش کرد و نسخه حذف شده GLM-5.3 را از طریق یک مرورگر وب جستجو کرد. خبرنگاران از مدل خواستند برنامه پایتون بنویسد که رمزهای عبور ذخیره شده کروم را می دزدد و پروتکل دقیقی برای کشت یک پاتوژن خطرناک انسانی در خانه تولید کند. بر اساس این گزارش، به راحتی با هر دو درخواست موافقت کرد.
این آزمایش قلب داستان است: وظایفی که مدلهای مرزی اصلی قاطعانه از آنها امتناع میکنند، اکنون در پشت فرم ثبتنام، بدون هیچ هزینهای، در برگه مرورگر در دسترس هستند.
استدلال دفاعی تیم قرمز
مورد دوون برای کسب و کار، استدلال امنیتی کلاسیک است: شما نمی توانید در برابر رفتاری که نمی توانید آن را بازتولید کنید، دفاع کنید. مدلی که از نوشتن کد اکسپلویت کار امتناع می کند، برای تیم قرمز که سعی در درک مهاجمان واقعی دارد، فایده چندانی ندارد.
او به TechCrunch گفت: «تصویر بزرگ مدلهای از بین رفته این است که میتوانند از بازیگران بد الگوسازی کنند. مزیت اکنون این است که مدافعان می توانند با بیشترین سرعت ممکن حرکت کنند... من فکر می کنم این امر امنیت سایبری را تسریع خواهد کرد، که نوعی نقطه ضعف است.
مشتریان این شرکت شامل استارتآپهایی با تیم قرمز در مراحل اولیه در بریتانیا و اروپا هستند که امنیت بانکها، خطوط هوایی و سایر اپراتورهای زیرساختهای حیاتی را آزمایش میکنند. دوون گفت، یکی از مشتریان اصلی، تیم قرمز کارگزاران بانکی را تشکیل می دهد و نمی تواند آن کار را با مدل های تجاری اصلاح نشده انجام دهد.
'الگویی که یک جامعه شناس می شود'
محققان ایمنی همین قابلیت را بسیار متفاوت می بینند. اندرو یون، رئیس تحقیقات در موسسه غیرانتفاعی ایمنی هوش مصنوعی CivAI، به TechCrunch گفت که ابلیتراسیون به شما امکان می دهد "مدل را طوری تغییر دهید که تبدیل به یک آسیب اجتماعی شود."
یون گفت: «شما میتوانید به معنای واقعی کلمه هر چیزی را در اینجا تایپ کنید، و با آن مطابقت خواهد داشت.
در یک نظر اخیر، یون استدلال کرد که اگر نمیتوان جلوی حذف نردههای محافظ را گرفت، دولتها باید از ارائهدهندگان بخواهند تا طبقهبندیکنندههایی را اجرا کنند که فعالیتهای سایبری و سلاحهای زیستی مضر را شناسایی و مسدود میکنند، و باید از شرکتهایی که دسترسی مستقیم به GPUهای پیشرفته را اجاره میکنند، بخواهند هویت مشتری را تأیید کنند و خدمات را در مواردی که سوءاستفاده خطرناک مشکوک است، رد کنند.
نرده محافظ نازک و بدون بررسی هویت
در حال حاضر، حفاظت از خود Abliteration.ai حداقل است. این پلتفرم به مشتریان یک لایه تعدیل اختیاری ارائه میکند تا بتوانند هر محدودیتی را که میخواهند اضافه کنند، و خود سایت محدودیتهای جزئی را حفظ میکند - TechCrunch نتوانست این مدل را برای تولید دستورالعملهای خودکشی بپذیرد، و دوون گفت که روی اقدامات اضافی برای جلوگیری از خشونت کار میکند.
این شرکت به غیر از ثبت کارت اعتباری مورد استفاده برای پرداخت، هیچ گونه غربالگری مشتری شما را انجام نمی دهد. "شما نمی خواهید مسئول انجام کاری دیوانه وار شخصی باشید... پس خط مسئولیت خود را به عنوان یک شرکت از کجا ترسیم می کنید؟" دوون گفت. ما هنوز در مرحله تعریف آن هستیم.»
سوالی که صنعت نمی تواند از آن طفره رود
همه متخصصان امنیتی موافق نیستند که مدل های حذف شده حتی بهترین ابزار برای آزمایش تهاجمی هستند. احمد علی، مدیر عامل شرکت فابرایکس که تیم قرمز کار می کند، به TechCrunch گفت که شرکت او بیشتر بر روی مدل های وزن باز تنظیم دقیق تکیه می کند، که در حال حاضر با امتناع کمی عرضه می شوند - و خاطرنشان می کند که فرسودگی می تواند قابلیت های زیربنایی یک مدل را کاهش دهد.
اکثر کارشناسانی که TechCrunch با آنها مشورت کرده است در یک چیز اتفاق نظر دارند: این عمل را نمی توان متوقف کرد. وزنهای قابل دانلود به این معنی است که هر کسی میتواند امتناعها را به صورت محلی حذف کند، همانطور که در تفسیر سال 2026 مرکز مبارزه با تروریسم در وست پوینت در مورد سوء استفاده از «نابودی» تأکید شده است. سوال باز نیروهای Abliteration.ai این است که آیا کاهش هزینه دسترسی برای همه - مدافعان و مهاجمان به طور یکسان - اینترنت را ایمن تر یا خطرناک تر می کند؟
از هوش مصنوعی جلوتر بمانید
ایمنی هوش مصنوعی هر روز در حال پیشرفت است. [آخرین پیشرفتهای هوش مصنوعی] (https://aibuzzwire.news) را در یک مکان دریافت کنید.
اخبار هوش مصنوعی را بیشتر بخوانید →