
От Mistral
Devstral Medium — это высокопроизводительная модель генерации кода и агентного рассуждения, разработанная совместно Mistral AI и All Hands AI. Позиционируясь как шаг вперед по сравнению с Devstral Small, он достигает...
Devstral Medium сильнее всего выглядит в категории «рассуждения». Индекс 80/100 рассчитан по процентильным позициям в 3 сопоставимых тестах; уверенность — средняя. Это навигационная оценка, а не замена тесту на ваших задачах.
3 сопоставимых теста · уверенность: средняя
2 сопоставимых теста · уверенность: средняя
Позиция рассчитана только среди моделей, для которых в каталоге указан результат того же теста. Это помогает сравнивать карточки, но не заменяет проверку модели на вашей задаче.
| Бенчмарк | Результат | Место | Доказательство |
|---|---|---|---|
| Arena Elo (LMSYS) | 1452 | 103 из 384 | Источник не указан |
| MMLU (Общие знания) | 89.3% | 91 из 391 | Источник не указан |
| HumanEval (Кодинг) | 88.8% | 149 из 391 | Источник не указан |
| MATH (Математика) | 95.1% | 38 из 391 | Источник не указан |
| GPQA (Экспертные знания) | 69.9% | 103 из 390 | Источник не указан |
| SWE-bench (Разработка) | 51% | 239 из 381 | Источник не указан |
Devstral Medium — это высокопроизводительная языковая модель, специально разработанная для программирования и агентных рассуждений совместными усилиями Mistral AI и All Hands AI. Представленная в июле 2025 года, она является развитием идей Devstral Small, предлагая значительно более глубокое понимание архитектуры ПО и сложных инженерных взаимосвязей.
В отличие от универсальных моделей, Devstral Medium прошла узкоспециализированное обучение на огромных массивах профессионального кода, логов ошибок и технической документации. Она обладает "инженерным складом ума", что позволяет ей предлагать более идиоматичные и безопасные решения в разработке ПО.
Модель была оптимизирована для работы в составе ИИ-агентов. Она отлично справляется с пошаговым планированием задач, автономным поиском ошибок в нескольких файлах одновременно и принятием решений на основе результатов тестирования.
Поддержка контекстного окна в 128 000+ токенов позволяет модели удерживать в памяти архитектурные схемы целых проектов. Это критически важно для корректного рефакторинга и понимания того, как локальные изменения в коде повлияют на работоспособность всей системы.
| Бенчмарк | Результат Devstral Medium | Категория |
|---|---|---|
| Arena Elo | 1452 | Лидер инженерных моделей |
| MMLU | 89.3% | Общие знания |
| HumanEval | 88.8% | Написание кода |
| MATH | 95.1% | Математика и логика |
| GPQA | 69.9% | Научные вопросы |
| SWE_bench | 51.0% | Решение инженерных задач |
Devstral Medium доступна через API по цене $0.40 за 1M входных токенов. Это крайне выгодное предложение для специализированной инженерной модели такого уровня, позволяющее значительно повысить продуктивность команд разработки при разумных затратах.
Статья подготовлена для Gruzdevv.ru. Все данные актуальны на май 2026 года.
Цены приведены за 1 млн токенов и могут меняться. Доступность российских провайдеров проверяется на их стороне.
$0.40 / $2.00 за 1M токенов
Сервисы, инструменты, материалы и обсуждения, связанные с моделью.
Откройте результаты по названию модели и проверьте актуальную интеграцию.
Точных связей пока нет. Искать по разработчику.
Задайте вопрос сообществу — карточка модели будет прикреплена автоматически.