Abliteration AI продаёт модель, которая почти не умеет отказывать Стартап…
Abliteration AI продаёт модель, которая почти не умеет отказывать
Стартап Abliteration AI решил поставить снятие защитных механизмов с open-source моделей на коммерческие рельсы.
Компания хостит GLM-5.3 от Z.ai с вырезанными гардрейлами и даёт доступ через браузер и API. Цена — $5 за 1 млн токенов на вход и выход по единому тарифу. Есть и бесплатный план.
Сама идея не новая. Abliteration ищет в модели активации, связанные с отказами, и удаляет их из весов, почти не трогая остальное. Сообщество делает такие сборки годами, а на Hugging Face уже лежат тысячи «разлоченных» моделей.
Новизна здесь в другом: раньше нужно было самому качать веса и поднимать инференс, теперь достаточно просто завести аккаунт. То есть опасный эксперимент из гаражного open-source превращается в обычный SaaS с тарифами.
По заявлениям компании, модель показывает:
— 84,5% pass@1 в CyberGym
— 41,8% в Terminal-Bench 4.0
— 105 задач из 869 за два часа в ExploitGym
— 86,2% в AgentHarm при нуле отказов
Но сравнения стоит читать осторожно: конкурентов тестировали на разных харнессах и бюджетах, а сама компания помечает результаты как индикативные.
Отдельно смешно и тревожно выглядит AgentHarm. Этот бенчмарк измеряет готовность модели выполнять вредоносные агентные запросы. То есть высокий результат там — одновременно «достижение» и довольно честная рекламная вывеска.
Abliteration также продаёт приватность как фичу: по умолчанию промпты и ответы не хранятся. Компания утверждает, что данные обрабатываются и сразу выбрасываются, поэтому их нельзя слить, продать, использовать для обучения или запросить по ордеру.
Сайт:
https://abliteration.ai/
GitHub-фреймворк по теме:
https://github.com/p-e-w/heretic
Похожие записи
Оцените материал:
Присоединяйтесь и подпишитесь на рассылку самых свежих новостей по Email
Получайте свежие новости и идеи на почту. Без спама — только самое интересное.
Нажимая «Подписаться», вы соглашаетесь с политикой конфиденциальности.
