Русскоязычный хакер за три месяца превратил взломанный Claude в коммерческую платформу для пентеста

изображение: grok
Русскоязычный участник даркнет-форума под псевдонимом Trim за три месяца прошел путь от публикации методов обхода защит Claude до запуска коммерческого сервиса AI Pentest Checker. По данным аналитиков Cato CTRL, основой платформы стали приемы взлома встроенных ограничений ИИ, которые сам автор ранее подробно расписал в открытом посте.
Для российских пользователей и компаний подобные разработки создают прямую угрозу, поскольку автоматизированный поиск уязвимостей заметно упрощает подготовку целевых атак.
Первое появление Trim на форуме зафиксировано 31 марта. Именно тогда исследовательское подразделение Cato Networks обратило внимание на объемный материал, посвященный способам обхода встроенных ограничений Claude Opus. Публикация содержала шесть подробно расписанных методик, позволяющих заставить модель выполнять действия, которые обычно блокируются системой защиты.
Интересно, что уже первая публикация Trim собрала подробные технические комментарии других участников форума, подтвердивших работоспособность описанных методов.
Через неполные три месяца тот же пользователь вернулся с готовым программным продуктом под названием AI Pentest Checker. Автор позиционировал разработку как платформу для автоматизированного анализа защищенности веб-ресурсов. В основу нового сервиса легли те самые приемы обхода защит, которые ранее были разобраны в его же собственной весенней публикации.
Trim сообщил, что приобрел API-ключ Claude на теневом рынке через продавца в Telegram за четыре доллара. Вокруг полученного доступа была выстроена вся инфраструктура нового инструмента. Аналитики Cato Networks считают подобную схему одним из первых признаков формирования нового направления подпольного рынка, где преступники начинают массово встраивать коммерческие модели искусственного интеллекта в собственные сервисы.
Мартовская публикация Trim описывала сразу несколько приемов обхода встроенных ограничений Claude:
- Context Warming — постепенное формирование доверительного контекста через безобидные профессиональные вопросы, создающие образ аудитора инфобеза;
- Ghost Reset — удаление текущей сессии с последующим объяснением отказа якобы возникшими проблемами соединения;
- смягчение формулировок при повторном запросе после отказа модели;
- маскировка вредоносных запросов под учебные задачи для студентов профильных вузов;
- перевод разговора на альтернативные модели при жестком отказе Claude;
- использование ролевых сценариев с легендой сертифицированного пентестера.
По утверждению самого Trim, прием Ghost Reset позволял добиться нужного результата примерно в 9 случаях из 10. Если Claude продолжал придерживаться встроенных ограничений, автор советовал переключаться на Kimi AI, GLM-5 через сервис modal.com или MiniMax 2.5.
Июньская публикация оказалась значительно масштабнее весенней. AI Pentest Checker представлял собой полноценную платформу для автоматизированного поиска уязвимостей веб-приложений. Согласно описанию Trim, Claude Opus 4.8 использовался для анализа наиболее серьезных проблем безопасности, тогда как GLM-5 отвечала за подготовку итоговых отчетов о найденных недостатках.
Вокруг языковых моделей была выстроена привычная инфраструктура из классических инструментов тестирования безопасности:
- Nuclei — сканер уязвимостей на базе шаблонов;
- ffuf — быстрый фаззер для поиска скрытых директорий;
- katana — краулер для картирования веб-приложений;
- gitleaks — детектор утекших секретов в репозиториях.
Всего в систему вошли 14 популярных утилит. Автор утверждал, что полный анализ указанного домена с автоматическим созданием PDF-отчета занимает менее 10 минут. Для российских специалистов по инфобезу подобная скорость анализа означает, что киберпреступники получают возможность массово прощупывать инфраструктуру десятков и сотен организаций за короткое время.
Стоит обратить внимание на то, что основой механизма обхода стал ранее утекший системный промпт Fable 5, связанный с одной из моделей Anthropic.
Именно системный промпт определяет скрытые правила поведения искусственного интеллекта, задает рамки допустимых действий и управляет встроенными защитными механизмами. Специалисты Cato CTRL пояснили, что знание внутренней структуры подобных инструкций дает злоумышленнику серьезное преимущество. Вместо случайных попыток подобрать удачную формулировку он строит запросы с учетом конкретной логики работы защитных механизмов, обходя отдельные проверки значительно эффективнее.
Для продвижения нового проекта Trim запустил привычную для подпольных сервисов схему:
- бесплатные ключи доступа первым 50 участникам бета-тестирования;
- поиск партнеров для дальнейшего распространения платформы;
- открытый набор соучастников для коммерческого развития сервиса;
- продвижение через профильные разделы русскоязычных теневых форумов.
Появление AI Pentest Checker показывает, насколько стремительно генеративный искусственный интеллект встраивается в арсенал киберпреступников. Раньше подобные публикации ограничивались отдельными экспериментами и обсуждением методов обхода защит, теперь между появлением технической инструкции и запуском готового коммерческого продукта проходят считанные месяцы. Для российских компаний и рядовых пользователей это означает рост числа автоматизированных инструментов, способных ускорить поиск слабых мест в корпоративной инфраструктуре и повысить эффективность подготовки реальных кибератак.
Ранее сообщалось, что специалисты AI Now Institute Хейди Хлааф и Боян Миланов описали способ удалённого выполнения произвольного кода через агентные ИИ-инструменты Claude Code и Codex. По данным исследователей, атака возможна на стандартных версиях этих помощников без использования плагинов, MCP-серверов или сторонних расширений. Для компрометации достаточно убедить пользователя попросить ИИ проверить сторонний репозиторий, после чего возникает риск выполнения нежелательных команд на рабочем компьютере. Эксперты отмечали, что выявленная особенность представляет интерес и для российских разработчиков и специалистов по информационной безопасности, уже использующих подобные инструменты в повседневной работе.
По мнению экспертов CISOCLUB, появление AI Pentest Checker наглядно демонстрирует смещение подпольного рынка в сторону готовых продуктов на базе коммерческих ИИ-моделей. Российским организациям стоит пересмотреть подходы к мониторингу подозрительной активности, поскольку скорость автоматизированного сканирования кратно возрастает. Отдельного внимания заслуживает практика продажи украденных API-ключей за символические суммы, что снижает порог входа для начинающих преступников.
Службам безопасности пора выстраивать защиту с учетом того, что противник использует те же инструменты искусственного интеллекта, что и легальные исследователи. Разработчикам крупных ИИ-моделей необходимо оперативно закрывать обнаруживаемые методики обхода защит, поскольку жизненный цикл таких приемов измеряется уже не годами, а неделями. Российским пользователям редакция советует внимательнее относиться к запросам, связанным с проверкой учетных данных и подозрительным обращениям к корпоративным ресурсам.



