Коммерциализация «разоружения» ИИ
Стартап Abliteration.ai, официально зарегистрированный в марте 2026 года, вывел практику удаления фильтров безопасности (guardrails) из тени open-source сообщества на уровень легального бизнеса. Платформа предлагает модифицированные версии моделей с открытыми весами, включая свежую Z.ai GLM-5.3, доступную через веб-интерфейс и API. Цель компании — предоставить специалистам по кибербезопасности инструменты для «offensive cyber, red-teaming и тестирования агентов», которые стандартные модели отказываются выполнять.
Тестирование: от кражи данных до биологической угрозы
Проверка сервиса TechCrunch показала, что барьеры для доступа к опасному контенту устранены. Запросив уabliterated версии GLM-5.3 создание Python-скрипта для кражи сохраненных паролей Chrome и протокол культивирования опасного патогена в домашних условиях, сервис ответил согласием. В отличие от оригинальной модели, модифицированная версия не применяет стандартные механизмы отказа в выполнении вредоносных запросов.
Аргументы «за» и «против»: безопасность или социопатия?
Основатель Devon утверждает, что демократизация доступа к «нецензурным» моделям ускоряет развитие киберзащиты, позволяя обороняющимся моделировать действия злоумышленников. Однако эксперты по безопасности ИИ, такие как Эндрю Юн (CivAI), называют такие модели «социопатическими» и прогнозируют рост реального вреда. В ответ на критику Abliteration.ai заявляет о наличии базовых фильтров (например, запрет на инструкции по самоубийству) и предлагает клиентам собственные слои модерации, но отказывается от внедрения строгих процедур KYC (Know Your Customer), ограничиваясь сбором данных о кредитных картах.
Реакция индустрии: от скепсиса до интеграции
Мнение рынка разделилось. CEO компании Fabraix Ахмед Али считает, что abliteration снижает способность модели к реальному вредоносному воздействию из-за потери знаний. В то же время основатель Armadin Дэвид Слейтер отмечает, что открытость таких инструментов критически важна для понимания реальных границ возможностей ИИ. Клиентами стартапа уже стали несколько европейских стартапов по red-teaming, работающих с банками и критической инфраструктурой.
| Параметр | Стандартная модель (GLM-5.3) | Abliterated версия (через Abliteration.ai) |
|---|---|---|
| Доступ к API/Web | Ограничен политиками безопасности | Полный доступ без блокировок |
| Запрос: Кража паролей | Отказ в выполнении | Генерация рабочего кода |
| Запрос: Биологическая угроза | Отказ в выполнении | Предоставление протокола |
| Модерация | Встроена производителем | Минимальная (нет инструкций по суициду), опциональная для клиента |
Перспективы: регулирование или децентрализация?
Эксперты сходятся во мнении, что остановить процесс «разоружения» моделей невозможно. Предлагается регулировать не сами модели, а инфраструктуру: требовать от провайдеров GPU верификации клиентов и внедрять классификаторы для блокировки запросов, связанных с кибератаками и биологическим оружием. Abliteration.ai, не привлекавшая венчурный капитал, но имеющая сделки с крупными облачными провайдерами, продолжает расширять клиентскую базу, ставя под вопрос баланс между безопасностью и свободой доступа к технологиям.
Источник: TechCrunch ↗
