Abliteration.ai یک API میزبانیشده را راهاندازی کرده است که نسخههای «پاکسازیشده» (abliterated) از مدلهای زبانی بزرگ را ارائه میدهد؛ مدلهایی که حفاظهای ایمنی آنها که معمولاً درخواستهای مضر را مسدود میکنند، حذف شدهاند. این سرویس به هر کسی که کارت اعتباری داشته باشد اجازه میدهد از طریق یک مرورگر وب یا یک نقطه پایانی API، یک مدل بدون محدودیت مانند GLM-5.3 را فراخوانی کند و نیاز به راهاندازی سختافزار محلی یا دستکاری کد را از بین ببرد.
از یک هک زیرزمینی تا یک پیشنهاد تجاری
سالهاست که بخش کوچکی از جامعه هوش مصنوعی متنباز در حال به اشتراکگذاری اسکریپتهای «پاکسازی» (abliteration) هستند که رفتار امتناع یک مدل را از بین میبرند. این اسکریپتها در مخازن عمومی قرار دارند و میتوان آنها را روی GPUهای شخصی اجرا کرد، اما این فرآیند نیازمند دانش فنی عمیق و منابع محاسباتی پرهزینه است. Abliteration.ai که در ماه مارس ثبت شد، این گردش کار را گرفت، آن را بستهبندی کرد و روی سرورهای خود قرار داد. اکنون کاربران به جای تهیه و راهاندازی ماشینهای خودشان، به ازای هر درخواست هزینه پرداخت میکنند و بدین ترتیب یک تکنیک آماتوری را به یک محصول تجاری تبدیل کردهاند.
اولین پیشنهاد عمومی این شرکت، نسخهای از GLM-5.3 است؛ یک مدل قدرتمند با وزنهای باز (open-weight) که در ابتدا توسط Z.ai منتشر شده بود. نسخه «پاکسازیشده» دقیقاً مانند نسخه اصلی رفتار میکند، با این تفاوت که دیگر هیچ پرسشی (prompt) را، هر چقدر هم که خطرناک باشد، رد نمیکند.
چرا مدلهای بدون محدودیت برای تیمهای امنیتی اهمیت دارند
بنیانگذار مشترک Abliteration.ai میگوید این سرویس تیمهای قرمز (red-teamers) را هدف قرار میدهد؛ یعنی شرکتهای امنیتی که دفاعِ بانکها، شرکتهای هواپیمایی و سایر زیرساختهای حیاتی را آزمایش میکنند. استدلال ساده است: برای ارزیابی اینکه یک سیستم در برابر یک مهاجم مخرب چگونه عمل میکند، به ابزاری نیاز دارید که بتواند تواناییهای آن مهاجم را تقلید کند. اگر یک مدل از نوشتن کد اکسپلویت (exploit code) خودداری کند، یک متخصص امنیتی نمیتواند از آن برای بررسی نقاط ضعف یک سیستم استفاده کند. این استارتاپ با ارائه مدلی که با هر درخواستی موافقت میکند، ادعا میکند که شکافی را در جعبهابزار امنیت دفاعی پر کرده است.
روی دیگر سکه: دسترسی آسان به قابلیتهای خطرناک
همین فقدان منطق امتناع، راه را برای سوءاستفاده نیز باز میکند. محققان یک سازمان غیرانتفاعی ایمنی هوش مصنوعی نشان دادهاند که یک GLM-5.3 پاکسازیشده میتواند دستورالعملهای مرحلهبهمرحله برای سرقت رمزهای عبور مرورگر تولید کند، اسکریپتهای Python برای جمعآوری خودکار اطلاعات کاربری (credential harvesting) بسازد و حتی پروتکلهایی برای کشت عوامل بیماریزای خطرناک ارائه دهد. به عبارت دیگر، این مدل مانند یک «سوسیوپات» رفتار میکند و از هر دستوری بدون فیلترهای اخلاقی یا قانونی پیروی میکند.
از آنجایی که این سرویس از طریق اینترنت و تنها با حداقل بررسیهای هویتی — اساساً یک تراکنش کارت اعتباری — ارائه میشود، مانع کمی بین یک تحلیلگر امنیتی مجاز و یک عامل مخرب وجود دارد. شرکت یک لایه نظارتی اختیاری ارائه میدهد که به مشتریان اجازه میدهد حفاظهای ایمنی خاصی را دوباره اعمال کنند، اما محصول اصلی همچنان یک موتور بدون محدودیت باقی میماند.
افزایش فشارهای نظارتی و صنعتی
ظهور یک سرویس پاکسازی آماده و مبتنی بر ابر، فراخوانها برای نظارت دقیقتر بر ابزارهای هوش مصنوعی پرخطر را تشدید کرده است. سیاستگذاران و گروههای صنعتی در حال بحث درباره اقداماتی از این دست هستند:
الزام ارائهدهندگان ابر GPU به تأیید هویت مشتریانی که محاسبات در مقیاس بزرگ اجاره میکنند.
الزام اپراتورهای پلتفرمهای هوش مصنوعی به اجرای طبقهبندیکنندههایی (classifiers) که درخواستهای مربوط به توسعه سلاحهای بی
الگوهای پذیرش: اگر شرکتهای تیم قرمز (red-team) شروع به اتکای شدید به API کنند، این سرویس میتواند به یک استاندارد دوفاکتو برای تست امنیت تبدیل شود و فروشندگان بزرگتر هوش مصنوعی را وادار کند تا ارائه سطوح مشابه و بدون محدودیت را مد نظر قرار دهند.
پاسخهای سیاستی: هرگونه اقدام از سوی ارائهدهندگان خدمات ابری یا نهادهای تنظیمگر ملی برای اعمال احراز هویت جهت اجاره GPU میتواند مجموعه مشتریانی را که قادر به اجرای اسکریپتهای Ablation بهصورت محلی هستند، محدود کند و بهطور بالقوه تقاضا برای راهکارهای میزبانیشده مانند Abliteration.ai را افزایش دهد.
واکنش جامعه: مشارکتکنندگان متنباز ممکن است با افزودن محدودیتهای لایسنس یا استفادهی سختگیرانهتر به چکپوینتهای مدل واکنش نشان دهند، اگرچه اجرای این محدودیتها همچنان چالشبرانگیز خواهد بود.
نکات کلیدی
- تجاریسازی هوش مصنوعی فیلترنشده: Abliteration.ai دسترسی API و مرورگر را به مدلهای Abliterated مانند GLM-5.3 فراهم میکند و نیاز کاربران به میزبانی منابع محاسباتی خود را از بین میبرد.
- معمای استفاده دوگانه: در حالی که این سرویس کارهای ضروری تیم قرمز و امنیت سایبری دفاعی را تسهیل میکند، همزمان یک راهکار آماده (turnkey) برای تولید اکسپلویتهای دیجیتال و بیولوژیکی مضر نیز ارائه میدهد.
- فشار نظارتی: ظهور مدلهای قابل دسترس و Abliterated، باعث افزایش درخواستها برای الزامات سختگیرانهتر KYC برای ارائهدهندگان GPU و طبقهبندیکنندههای تشخیص اجباری برای فعالیتهای پرخطر هوش مصنوعی شده است.
