Anthropic откроет проверенным специалистам по безопасности Claude с ослабленными ограничениями

Изображение: OpenAI
Anthropic откроет прошедшим проверку специалистам по кибербезопасности Claude, который реже блокирует анализ вредоносных программ и поиск уязвимостей, сообщает Help Net Security.
Обычные модели Claude отказываются от большей части такой работы, включая учебные атаки, потому что те же навыки пригодились бы и злоумышленникам. Теперь вместо простого «можно или нельзя» у программы три уровня доступа, и чем меньше ограничений, тем строже проверяют заявителя.
Первый уровень рассчитан на расследование инцидентов, разбор вредоносных программ и проверку уязвимостей. Подать заявку могут службы безопасности компаний, государственных организаций и университетов, операторы критической инфраструктуры, разработчики открытого ПО, а также независимые исследователи, которые раньше сообщали об уязвимостях. Ответ компания обещает за несколько дней.
Второй уровень добавляет разрешённые тесты на проникновение и имитацию атак. Он открыт только организациям и только для систем, которые им разрешено проверять, а заявку рассматривают несколько недель. Запуск программ-вымогателей и действия, способные причинить физический вред или вызвать массовые сбои, блокируются и здесь.
Третий уровень, с наименьшими ограничениями, предназначен для узкого круга организаций, которые проверяют системы управления полётами, энергосети, сети связи и системы межбанковских платежей. Каждого такого заявителя Anthropic проверяет вместе с правительством США.
Как работают ограничения, компания показала на своём наборе из 10 задач, в которых модель должна спланировать и провести многоэтапную атаку, по пять попыток на задачу. Без допуска Claude Opus 5.5 блокировался на первом же запросе во всех 50 попытках. На первом уровне блокировку встретили 46 попыток, а на втором ограничений не было вовсе, и модель довела до конца 34 атаки из 50.
По данным Anthropic, участники её прежней программы поиска уязвимостей с помощью Claude с апреля по июль 2026 года нашли в своих системах не меньше 129 тыс. подтверждённых уязвимостей, ещё 5,5 тыс. компания нашла сама в открытом ПО. Больше 33 тыс. из них получили высокую или критическую оценку опасности. Компания оговаривается, что сведения прислали не все участники, поэтому подсчёт неполный.



