Abliteration.ai: стартап, который делает бизнес на удалении AI-защиты из моделей

Abliteration.ai превратил abliteration — технику удаления guardrails из открытых моделей — в коммерческий сервис. TechCrunch проверил: модель без ограничений пишет эксплойты и инструкции по культивированию патогенов. Разбираем, red-teaming это или социопатия.

Источник: TechCrunch


A hooded developer types at three monitors beneath a yellow banner reading FREE TIER NO GUARDRAILS.

Существует техника под названием «abliteration». Она звучит как что-то, что делают с помощью ластика и молитвы, но на самом деле это метод удаления из AI-модели склонности отказывать в опасных запросах. Долгие годы abliteration был хобби open-source сообщества — десятки тысяч модифицированных моделей на Hugging Face, никем не регулируемые, никем не продаваемые. Просто энтузиасты снимали защиту, потому что могли.

Стартап Abliteration.ai превратил хобби в бизнес. Основанный в конце прошлого года и официально зарегистрированный в марте, он предлагает модифицированные версии открытых моделей без guardrails через браузер и API. Бесплатно. Прямо сейчас.

TechCrunch проверил. Модель не отказала ни разу

Журналисты TechCrunch создали аккаунт и начали спрашивать у abliterated-версии GLM-5.3 то, от чего обычная модель отказалась бы мгновенно. Попросили написать программу на Python, которая крадёт сохранённые пароли Chrome. Попросили подробный протокол культивирования опасного человеческого патогена в домашних условиях.

Модель ответила на оба запроса. Без колебаний, без оговорок, без «я не могу это сделать».

В своём анонсе стартап написал: «Мы выпускаем abliterated-model-large-v2. На базе GLM-5.3 — модели на третьем месте Terminal-Bench 4.0 (после Opus 5 и Fable), с двойным уровнем эксплуатации по сравнению с 5.2». Гордость за продуктивность, с которой обычно представляют SaaS-платформу для бухгалтерии.

GLM-5.3 — модель от Z.ai, третья на Terminal-Bench 4.0. Одна из самых мощных открытых моделей в мире. Теперь — ещё и самая полезная для Offensive Cyber, red-teaming и агентского тестирования.

Логика, которую невозможно оспорить (и именно поэтому она тревожна)

Сооснователь Devon (фамилию не назвал — он всё ещё работает в другой компании) объясняет позицию знакомым каждому, кто хотя бы раз слышал аргументацию индустрии кибербезопасности: нельзя защитить от поведения, которое невозможно воспроизвести. Модель, отказывающаяся писать рабочий эксплойт, не поможет red-team обороняться от атакующих.

Логика безупречна в рамках своей аксиоматики. Вопрос только в том, кто является red-team, а кто — атакующим.

В интервью Rebecca Bellan из TechCrunch Devon объяснил, что стартап может позволить себе облачные мощности исключительно за счёт клиентской выручки. Несколько сделок с крупными облачными провайдерами. Венчурного капитала пока нет — но ведутся переговоры.

Это не стартап, который стучится в двери инвесторов с презентацией о социальной миссии. Это стартап, который уже зарабатывает.

Andrew Yoon из CivAI: «Вы превращаете модель в социопата»

Критика не заставила себя ждать. Andrew Yoon, руководитель исследований в AI safety nonprofit CivAI, сказал TechCrunch прямо: «Abliteration позволяет модифицировать модель так, чтобы она стала социопатом».

«Вы можете набрать здесь буквально что угодно, и она выполнит. Когда люди говорят об удалении guardrails из AI-моделей — вот о чём мы говорим. Я ожидаю, что скоро начну видеть редактированные, abliterated-модели, используемые для реального вреда».

Yoon не говорит, что техника плоха сама по себе. Он говорит, что её коммерциализация — это не то же самое, что open-source эксперимент. Когда тысячи людей снимают защиту в лаборатории, последствия ограничены лабораторией. Когда один стартап делает это доступным через браузер — последствия становятся доступными через браузер.

Контекст, который нельзя игнорировать

Abliteration.ai запускается в момент, когда AI-индустрия одновременно наращивает и защиту, и наступление. OpenAI в тот же день выпустила Astra — модель, которая нашла все уязвимости (ExploitBench 100%). CivAI критикует Abliteration.ai за снятие защиты — а OpenAI строит бизнес на том, что защита обходится лучше, чем у конкурентов.

Hugging Face, хостящий десятки тысяч abliterated-моделей, в тот же день был куплен Nvidia за $12,93 млрд. Платформа, где можно найти модель без ограничений, становится частью корпорации, контролирующей 80% GPU-рынка.

Abliteration.ai не просит венчурного капитала, потому что уже зарабатывает. Это бизнес, в котором продукт — отсутствие ограничений. И клиенты, очевидно, находятся.

FAQ

Что такое abliteration?

Техника удаления из AI-модели склонности отказывать в опасных запросах. Работает с открытыми весами — модель модифицируется так, что перестаёт отвечать «я не могу это сделать».

Abliteration.ai — это легально?

Стартап работает в правовой зоне. Техника модификации открытых моделей не запрещена. Но результаты её использования могут нарушать законы — в зависимости от юрисдикции и конкретных запросов.

Кто клиенты Abliteration.ai?

Стартап позиционирует сервис для offensive cyber, red-teaming и агентского тестирования. Конкретных клиентов не называет, но говорит, что выручка позволяет оплачивать облачные мощности.

Чем это отличается от тысяч abliterated-моделей на Hugging Face?

Тем, что Abliteration.ai — коммерческий сервис. Hugging Face хостит файлы, которые нужно скачать и запустить. Abliteration.ai даёт браузерный интерфейс и API.

Краткий ответ

Стартап Abliteration.ai коммерциализировал abliteration — технику удаления guardrails из открытых AI-моделей. Сервис предлагает abliterated-версию GLM-5.3 (третья модель на Terminal-Bench 4.0) бесплатно через браузер. TechCrunch подтвердил: модель без ограничений отвечает на запросы о создании эксплойтов и культивировании патогенов. Сооснователь Devon оправдывает это логикой red-teaming. Критик из CivAI Andrew Yoon называет это «превращением модели в социопата».

← Все новости