Abliteration.ai запустила хостований API, який надає «аблітеровані» (abliterated) версії великих мовних моделей — моделей, позбавлених захисних механізмів безпеки, які зазвичай блокують шкідливі запити. Сервіс дозволяє будь-кому, хто має кредитну картку, робити запити до необмеженої моделі, такої як GLM-5.3, через веббраузер або API-ендпоінт, усуваючи потребу в налаштуванні локального обладнання або втручанні в код.
Від підпільного хаку до бізнес-пропозиції
Протягом багатьох років вузька ніша спільноти open-source AI ділилася скриптами «аблітерації», які видаляють поведінку відмови моделі. Ці скрипти розміщуються у публічних репозиторіях і можуть запускатися на персональних GPU, але цей процес вимагає глибоких технічних знань і дорогих обчислювальних ресурсів. Abliteration.ai, зареєстрована в березні, взяла цей робочий процес, упакувала його та розмістила на власних серверах. Тепер користувачі платять за кожен запит замість того, щоб облаштовувати власні машини, перетворюючи хобістичну техніку на комерційний продукт.
Першою публічною пропозицією компанії є версія GLM-5.3 — потужної моделі з відкритими вагами, спочатку випущеної Z.ai. «Аблітерований» варіант поводиться точно так само, як і оригінал, за винятком того, що він більше не відхиляє жоден запит, яким би ризикованим він не був.
Чому необмежені моделі важливі для команд безпеки
Співзасновник Abliteration.ai зазначає, що сервіс орієнтований на red-teamers — фірми з кібербезпеки, які тестують захист банків, авіакомпаній та іншої критичної інфраструктури. Аргумент простий: щоб оцінити, як система впорається зі зловмисником, вам потрібен інструмент, який може імітувати можливості цього зловмисника. Якщо модель відмовляється писати експлойт-код, фахівець із безпеки не зможе використати її для перевірки вразливостей системи. Надаючи модель, яка виконуватиме будь-який запит, стартап стверджує, що заповнює прогалину в інструментарії захисної безпеки.
Зворотний бік: легкий доступ до небезпечних можливостей
Та сама відсутність логіки відмови відкриває двері для зловживань. Дослідники з некомерційної організації з питань безпеки ШІ продемонстрували, що аблітерована GLM-5.3 може створювати покрокові інструкції для крадіжки паролів у браузері, генерувати Python-скрипти для автоматизованого збору облікових даних і навіть описувати протоколи культивування небезпечних патогенів. Іншими словами, модель поводиться як «соціопат», виконуючи кожну команду без моральних чи юридичних фільтрів.
Оскільки сервіс надається через інтернет лише з мінімальною перевіркою особи — фактично через транзакцію з кредитною карткою — між легітимним аналітиком безпеки та зловмисником майже немає бар'єрів. Компанія пропонує додатковий шар модерації, який дозволяє клієнтам повторно застосовувати певні захисні механізми, але основним продуктом залишається необмежений рушій.
Посилення регуляторного та галузевого тиску
Поява готового до використання хмарного сервісу аблітерації посилила заклики до суворішого нагляду за інструментами ШІ високого ризику. Політики та галузеві групи обговорюють такі заходи, як:
- Вимога до хмарних провайдерів GPU перевіряти особи клієнтів, які орендують масштабні обчислювальні потужності.
- Зобов'язання операторів ШІ-платформ запускати класифікатори, які позначають запити, пов'язані з розробкою біологічної зброї або інструментарієм для кібератак.
- Впровадження суворіших процедур «Знай свого клієнта» (KYC) для сервісів, що хостять необмежені моделі.
Ці пропозиції зміщують дискусію з питання «чи можемо ми заборонити людям видаляти захисні бар'єри?» — технічно неможлива мета, як тільки ваги моделей стають публічно доступними — на питання «як нам керувати розповсюдженням і використанням моделей, які були навмисно позбавлені захисту?».
Контраргумент: законна ринкова потреба
Прихильники стверджують, що нинішній регуляторний вакуум змушує команди безпеки створювати власні конвеєри аблітерації, що витрачає час і ресурси. Централізуючи цю можливість, Abliteration.ai заявляє, що зменшує загальну вартість захисного тестування та сприяє більш систематичному підходу до операцій red-teaming. Вони зазначають, що багато фірм із безпеки вже використовують внутрішні налаштування аблітерації, а стартап просто пропонує ефективнішу модель надання послуг.
За чим стежити далі
- Моделі впровадження: Якщо компанії, що займаються red-teaming, почнуть активно покладатися на API, цей сервіс може стати стандартом де-факто для тестування безпеки, що змусить великих постачальників ШІ розглянути можливість пропонування подібних необмежених рівнів доступу.
- Політика реагування: Будь-які кроки хмарних провайдерів або національних регуляторів щодо впровадження верифікації особи для оренди GPU можуть обмежити коло клієнтів, здатних запускати скрипти абляції локально, що потенційно підвищить попит на хостовані рішення, такі як Abliteration.ai.
- Реакція спільноти: Контриб'ютори open-source можуть відповісти запровадженням суворіших ліцензій або обмежень на використання чекпоінтів моделей, хоча контроль за дотриманням цих правил залишатиметься складним завданням.
Основні висновки
- Комерціалізація невідфільтрованого ШІ: Abliteration.ai надає доступ через API та браузер до моделей, що пройшли абляцію, таких як GLM-5.3, усуваючи потребу користувачів у розгортанні власних обчислювальних потужностей.
- Дилема подвійного призначення: Хоча сервіс дозволяє виконувати важливу роботу з red-teaming та оборонної кібербезпеки, він також пропонує готове рішення для створення шкідливих цифрових та біологічних експлойтів.
- Регуляторний тиск: Поява доступних моделей, що пройшли абляцію, стимулює заклики до посилення вимог KYC для постачальників GPU та обов'язкового впровадження класифікаторів виявлення діяльності ШІ з високим рівнем ризику.
