6 октября 2026 года Mistral AI открыла публичный preview Mistral Large 4 — самой большой модели компании. Это MoE на 1 трлн параметров, из которых на каждый токен активны 49 млрд; модель принимает текст и изображения и совмещает обычный режим с рассуждением. Неофициально её называют ML4, а в анонсе — «le Chonk». Веса Mistral обещает опубликовать до конца октября, а до этого модель доступна через API в Mistral Studio.
Что нового
- Масштаб. У предшественницы Mistral Large 3 было 675 млрд параметров и 41 млрд активных. Large 4 обучили с нуля на 3 800 GPU NVIDIA Grace Blackwell в собственных европейских дата-центрах Mistral.
- Кибербезопасность. По словам Mistral, в Artificial Analysis Cyber Index модель входит в пятёрку лучших в мире. На тесте CyberGym-E2E, где нужно воспроизвести реальную уязвимость и закрыть её, она набирает 82% — больше всех моделей; Claude Opus 5.5 и GPT-6 Astra получают около нуля, потому что отказываются выполнять задание. На Cybench — 93%.
- Агентная работа. 61,7% на DeepSWE v1.1, 59,4% на SWE-Atlas QnA, 28,3% на Terminal-Bench 4.0 и 59,9% на AutomationBench.
- Изображения. В одном запросе теперь можно передать до 100 изображений вместо 8. На тесте визуальной привязки Dense 200 модель набрала 42% против 41% у GPT-6 Astra.
- Языки. Модель обучали на данных больше чем на 160 языках, включая все официальные языки ЕС.
Цены и контекст
| Параметр | Стандартная цена | Первые две недели |
|---|---|---|
| Вход, за 1M токенов | $1.36 | $0.68 |
| Кэшированный вход, за 1M токенов | $0.14 | $0.07 |
| Выход, за 1M токенов | $4.18 | $2.09 |
Модель вызывается как mistral-large-4 или mistral-large-4-0, на OpenRouter — mistralai/mistral-large-4-0. Artificial Analysis и OpenRouter указывают контекст 512K токенов, хотя на странице модели в документации Mistral написано 1M. Large 4 почти втрое дороже Large 3 ($0.50 / $1.50).
Бенчмарки
| Тест | Mistral Large 4 |
|---|---|
| DeepSWE v1.1 | 61.7% |
| SWE-Atlas QnA | 59.4% |
| Terminal-Bench 4.0 | 28.3% |
| AA-Briefcase | 1393 Elo |
| Cybench | 93% |
| Artificial Analysis Intelligence Index | 38 |
| Artificial Analysis Cyber Index | 50 |
Intelligence Index в 38 баллов — уровень GPT-6 Luna и DeepSeek V4.1 Flash, и это лучший результат среди моделей, созданных за пределами США и Китая. В слепой оценке качества кода с Surge AI модель заняла второе место из пяти (3,74 из 5) — после Claude Opus 5 и выше Kimi K3, GLM-5.3 и GLM-5.2. Mistral продолжает обучение с подкреплением и ждёт заметного роста качества в ближайшие недели.
Открытые веса
До публикации весов Mistral тестирует модель вместе со специалистами по кибербезопасности, партнёрами и государственными органами. После релиза ML4 можно будет развернуть в частном облаке или на собственных серверах. Лицензию компания пока не объявила; вместе с весами она обещает подробности об архитектуре, дополнительные бенчмарки и описание пост-обучения.
Где посмотреть все характеристики
Цены, контекст, бенчмарки и сравнение с конкурентами собраны в карточке Mistral Large 4 в каталоге нейросетей. Полный список актуальных моделей — в каталоге ИИ-моделей Gruzdevv.ru.
Источник: официальный анонс Mistral AI.

Комментарии(0)
Оставьте комментарий
Войдите, чтобы присоединиться к обсуждению