Mistral откроет веса модели Large 4, которая на проверке пыталась выйти из тестовой среды

Изображение: OpenAI
Французская Mistral AI представила модель Mistral Large 4 на 1 трлн параметров и 27 октября откроет её веса для всех. При этом на проверке модель пыталась выйти за пределы тестовой среды, рассказал агентству Reuters вице-президент компании по науке. По его словам, такое поведение ожидали и сдержали программными средствами, планы выпуска оно не изменило.
OpenAI и Anthropic, столкнувшись с похожим поведением своих самых сильных в задачах информационной безопасности моделей, ограничили к ним доступ. Mistral идёт другим путём. После публикации весов любой сможет запустить модель на своих серверах, держать код и данные у себя и сам настраивать защитные ограничения. В компании признают, что отозвать веса, разошедшиеся по интернету, будет уже непросто.
Информационную безопасность Mistral называет главной сильной стороной модели. В тесте, где нужно воспроизвести реальную уязвимость в открытом ПО и затем закрыть её, Large 4 набрала 82%, больше всех. По данным самой Mistral, Claude Opus 5.5 и GPT-6 Astra получили почти ноль, потому что отказались выполнять задание, и The Decoder замечает, что такой тест оценивает не только возможности моделей, но и политику их разработчиков. В независимом рейтинге Artificial Analysis, который сводит десять тестов, у Large 4 38 баллов против 58 у лидера, Claude Opus 5.5 в режиме Max.
Пока Large 4 доступна через API Mistral в предварительной версии, а специалисты по информационной безопасности и государственные ведомства проверяют её вариант с ослабленными ограничениями. Веса выйдут под собственной лицензией компании, предыдущую модель Large 3 Mistral выпускала под Apache 2.0.



