Дешёвая Claude Haiku 5.5 лучше справляется с поиском уязвимостей и написанием эксплойтов, чем ее предшественница

Изображение: grok
Anthropic выпустила Claude Haiku 5.5, самую быструю и дешёвую модель новой линейки. Для запросов до 100 тысяч токенов цены упали на 90%, а защита от prompt injection и вредоносных просьб стала заметно крепче, чем у Haiku 4.5, зато навыки поиска уязвимостей тоже подросли.
Haiku 5.5 заточена под быстрые повторяющиеся задачи, защита у неё строже, чем у Haiku 4.5, но мягче, чем у Sonnet 5.5 и Opus 5.5. Anthropic предупредила, что внутренние тесты не отражают обычный доступ, ведь значительную часть прогонов проводили с отключёнными защитными слоями.
Для проверки наступательных навыков Anthropic выключила киберограничения, вот что получилось:
- в испытании на известных уязвимостях движка V8 Haiku 5.5 добилась произвольного выполнения кода в четырёх случаях из 410 запусков;
- в тесте на многоэтапные кибератаки предрелизная версия закрыла 3,3% заданий против 46,1% у Sonnet 5.5 и 67,6% у Opus 5.5;
- на наборе ExploitGym модель обошла прежнюю Sonnet 5, но осталась позади моделей Claude 5.5.
Четыре попадания из 410 звучат скромно, но для бюджетки это уже заявка на самостоятельную эксплуатацию реальных багов.
Интересно, что 3,3% на многоэтапных атаках для самой дешёвой модели линейки смотрятся серьёзно, хотя до Opus 5.5 ей далеко.
Модель помогает с оборонительными задачами и разбором результатов пентестов, а сам пентестинг и другие действия, которые проще пустить в дело при атаке, ограничения режут. Профи с широкими запросами могут получить сниженные ограничения через Cyber Verification Program.
Anthropic не работает с Россией напрямую, поэтому российские разработчики ходят к Claude через посредников и сторонние обёртки, а защиту этого слоя от скрытых команд оценить сложно.
Anthropic прогнала Haiku 5.5 по опасным темам от оружия и экстремизма до слежки и вмешательства в выборы. На почти финальном системном промпте Claude.ai модель дала безопасный ответ на 99,71% вредоносных запросов и ошибочно отказала лишь в 0,82% безобидных, тогда как у Haiku 4.5 ложных отказов набиралось 3,05%.
В Claude Code и режиме управления компьютером отказов на вредоносные просьбы стало заметно больше:
- в Claude Code Haiku 5.5 отказалась выполнять 84,3% просьб создать вредоносное ПО, помочь с DDoS-атаками или написать программы для слежки без согласия людей против 66,6% у Haiku 4.5;
- в режиме управления компьютером отказов набралось около 82,6% против 58,9% у предшественницы;
- на этом тесте показатель оказался выше, чем у Sonnet 5.5 и Opus 5.5.
Уточняется, что в части тестов с оружием через API без системного промпта результаты ухудшились, а в разговорах о самоповреждении и расстройствах пищевого поведения нашлись слабые места.
Prompt injection работает по простой схеме, злоумышленник прячет инструкции внутри письма, веб-страницы, документа или кода, которые ИИ должен обработать. Человек видит обычный текст, а модель одновременно получает скрытую команду вроде «забудь прежние указания и сделай, что хочет атакующий».
Если модель просто отвечает на вопросы, цена ошибки ограничивается кривым ответом. Когда агент читает почту, запускает программы и водит браузером, успешная инъекция превращается в реальные действия. Российским командам, которые навешивают агентов на корпоративную почту и CRM, стоит держать этот риск в голове, ведь скрытая команда в письме от «клиента» способна дойти до исполнения без единого предупреждения.
Anthropic называет Haiku 5.5 самой устойчивой к prompt injection среди Haiku. В адаптивных атаках, когда злоумышленник меняет тактику после анализа ответов модели, она показала устойчивость на уровне более мощных моделей компании. На тесте Gray Swan модель всё же уступила Sonnet 5.5 и Opus 5.5, а основная часть оставшейся уязвимости пришлась на работу с графическим интерфейсом.
Anthropic пересмотрела прайс и подкрутила инструменты, главное из изменений:
- для запросов до 100 тысяч токенов цены на входные и выходные токены снизились на 90% относительно Haiku 4.5;
- появился регулируемый параметр усилий между быстрым дешёвым выполнением и глубокой обработкой;
- модель Haiku 5.5 можно запускать кодинговым субагентом для Sonnet 5.5 и Opus 5.5, чтобы тяжёлые модели не жгли ресурсы на рутину.
Аарон Винх, Staff Software Engineer в Asana, рассказал, что компания прогнала модель на задачах для AI Teammates, от разбора ошибок до поиска просроченных задач. По словам Аарона Винха, время выполнения сократилось более чем на 30%, а скорость инференса на один ход агента выросла до двух с половиной раз.
Стоимость чтения кэшированных данных для Sonnet 5.5 снизили вдвое, и Anthropic рассчитывает, что большинство задач ИИ-агентов подешевеет примерно на 20%. На время запуска компания раздаёт и другие бонусы:
- подписчики Max получат ежемесячные API-кредиты на $100 или $200 в зависимости от тарифа, а Team-подписчикам достанется до $500 на всех пользователей;
- в Python и TypeScript SDK добавили поддержку управления компьютером и браузером в бета-режиме;
- модель Haiku 5.5 уже доступна в Amazon Web Services, Google Cloud, Microsoft Azure и через Claude Platform.
Эксперты CISOCLUB отметили, что главный итог релиза скрыт не в рекордах бенчмарков, а в том, что дешёвая и быстрая модель превращается в рабочую лошадку агентных систем. Чем ниже цена вызова, тем охотнее бизнес раскидывает агентов по почте, трекерам и браузерам, и тем шире поверхность для атак скрытыми командами. Результаты Gray Swan показывают, что графические интерфейсы остаются слабым местом, и отдавать агенту рабочий стол целиком пока рано. Четыре случая выполнения кода из 410 попыток говорят, что порог входа для атакующих снижается, а защитникам придётся ограничивать права агентов и изолировать окружения. Разработчикам на API стоит закладывать собственные защитные механизмы, ведь Anthropic сама признала слабые места в чувствительных разговорах.
Ранее сообщалось, что Anthropic 7 октября представила Claude Haiku 5.5 — компактную ИИ-модель для массовых задач, где особенно важны скорость работы и низкая стоимость. По оценке компании, использование новой модели в среднем обходится примерно на 75% дешевле по сравнению с Haiku 4.5. Как сообщает The New Stack, при запросах объёмом менее 100 тыс. токенов API-тариф составляет $0,10 за миллион входных токенов и $0,50 за миллион выходных, а для более длинных запросов — $0,50 и $2,50 соответственно.



