Abliteration.ai открыла API-доступ к ИИ-моделям со снятыми защитными ограничениями

Стартап Abliteration.ai размещает модифицированные версии моделей с открытыми весами, включая GLM-5.3 компании Z.ai, и предоставляет доступ через веб-интерфейс и API. Компания позиционирует сервис как инструмент для наступательного тестирования и red teaming, однако отсутствие полноценной идентификации клиентов и готовность моделей выполнять опасные запросы вызывают вопросы безопасности.

Abliteration.ai превратила «аблитерацию» — модификацию модели, подавляющую её отказы выполнять потенциально вредоносные запросы, — в коммерческий облачный сервис. Среди доступных вариантов есть версия модели GLM-5.3 компании Z.ai со снятыми ограничениями.

TechCrunch протестировал сервис через бесплатную учётную запись. Модифицированная модель согласилась сгенерировать код для кражи сохранённых в Chrome паролей и предоставить опасные биологические инструкции.

Разработчики называют основным назначением платформы наступательное тестирование кибербезопасности, red teaming и проверку ИИ-агентов. Клиенты могут подключить собственный слой модерации, а сама платформа сохраняет отдельные ограничения и планирует усилить блокировку запросов, связанных с насилием.

Полноценной процедуры KYC — идентификации и проверки клиента — у сервиса пока нет: компания располагает лишь платёжными данными покупателей. Специалисты по безопасности расходятся в оценках технологии: одни считают такие модели полезными для воспроизведения действий злоумышленников, другие предпочитают дообучать обычные модели с открытыми весами и отмечают, что аблитерация способна ухудшать их знания и возможности.

Источник: techcrunch.com

Связь с редакцией