Mistral Large 4 уступила китайским моделям в независимых тестах

Изображение: OpenAI
Новая ИИ-модель Mistral Large 4 уступила как минимум пяти китайским моделям с открытыми весами в общем рейтинге независимой компании Artificial Analysis, сообщает Tom’s Hardware.
Large 4 набрала 38 баллов. Например, сопоставимая по общему числу параметров MiMo-V2.6-Pro от Xiaomi получила 46 баллов. При этом среди моделей, созданных за пределами США и Китая, Large 4 заняла первое место в рейтинге.
Сильнее всего Large 4 выступила в одном из испытаний по информационной безопасности, где набрала 82%. Однако это лишь один из трёх тестов, которые входят в профильный индекс Artificial Analysis: общий результат модели составил 50 баллов, на уровне GLM-5.3-Flash. По оценке исследователей, после публикации весов Large 4 войдёт в тройку лучших моделей с открытыми весами в этом индексе.
Выполнение одного задания в тестах для общего рейтинга при стандартных тарифах стоило $1,13 для Large 4 против $0,25 для GLM-5.3-Flash. Высокие расходы связаны в том числе с объёмом ответов: для прохождения тестов Large 4 потребовалось 200 млн выходных токенов при медианном значении 81 млн.
Mistral выпустила предварительную версию Large 4 с триллионом параметров. Сейчас она доступна через API, а веса компания планирует опубликовать к концу октября. После этого модель можно будет запускать в частном облаке или на собственном оборудовании.
Large 4 принимает текст и изображения, а ответы выдаёт в текстовом виде. Размер контекстного окна составляет 512 тыс. токенов.



