
От Mistral
Voxtral Small — это усовершенствованная версия Mistral Small 3, включающая в себя самые современные возможности аудиовхода, сохраняя при этом лучшую в своем классе производительность текста. Он превосходно справляется с транскрипцией речи, переводом и пониманием звука. Ввод звука...
Voxtral Small 24B 2507 сильнее всего выглядит в категории «рассуждения». Индекс 73/100 рассчитан по процентильным позициям в 3 сопоставимых тестах; уверенность — средняя. Это навигационная оценка, а не замена тесту на ваших задачах.
3 сопоставимых теста · уверенность: средняя
2 сопоставимых теста · уверенность: средняя
Позиция рассчитана только среди моделей, для которых в каталоге указан результат того же теста. Это помогает сравнивать карточки, но не заменяет проверку модели на вашей задаче.
| Бенчмарк | Результат | Место | Доказательство |
|---|---|---|---|
| Arena Elo (LMSYS) | 1453 | 100 из 384 | Источник не указан |
| MMLU (Общие знания) | 89.4% | 88 из 391 | Источник не указан |
| HumanEval (Кодинг) | 81.3% | 295 из 391 | Источник не указан |
| MATH (Математика) | 86.3% | 174 из 391 | Источник не указан |
| GPQA (Экспертные знания) | 71.5% | 59 из 390 | Источник не указан |
| SWE-bench (Разработка) | 45.7% | 324 из 381 | Источник не указан |
Voxtral Small 24B 2507 — это специализированная мультимодальная модель от Mistral AI, объединяющая в себе мощь текстового интеллекта Mistral Small 3 с передовыми возможностями обработки аудио. Представленная в октябре 2025 года, эта модель стала ответом на растущую потребность рынка в инструментах, способных напрямую «слышать» и понимать человеческую речь без промежуточных этапов преобразования.
В отличие от классических систем, использующих связку ASR (речь-в-текст) + LLM, Voxtral Small напрямую принимает аудиосигнал. Это позволяет модели улавливать не только слова, но и интонацию, эмоции и нюансы речи, что значительно повышает качество транскрибации и понимания контекста.
Благодаря глубокой интеграции аудио и текста, модель демонстрирует выдающиеся результаты в задачах перевода речи в реальном времени. Она способна мгновенно переводить аудио на одном языке в качественный текст на другом, сохраняя при этом смысл и эмоциональный окрас сообщения.
Voxtral Small может анализировать длинные аудиозаписи, выявлять в них ключевые моменты, определять количество спикеров и предоставлять краткие суммаризации обсуждений, что делает её идеальным инструментом для бизнеса.
| Бенчмарк | Результат Voxtral Small | Категория |
|---|---|---|
| Arena Elo | 1453 | Лидер аудио-текстовых моделей |
| MMLU | 89.4% | Общие знания |
| HumanEval | 81.3% | Написание кода |
| MATH | 86.3% | Математические рассуждения |
| GPQA | 71.5% | Научные тесты |
| SWE_bench | 45.7% | Решение инженерных задач |
Voxtral Small 24B доступна через API по цене $0.10 за 1M входных токенов. Это крайне выгодное предложение для разработчиков, внедряющих функции голосового управления и аудио-аналитики в свои приложения.
Статья подготовлена для Gruzdevv.ru. Все данные актуальны на май 2026 года.
Цены приведены за 1 млн токенов и могут меняться. Доступность российских провайдеров проверяется на их стороне.
$0.10 / $0.30 за 1M токенов
Сервисы, инструменты, материалы и обсуждения, связанные с моделью.
Откройте результаты по названию модели и проверьте актуальную интеграцию.
Точных связей пока нет. Искать по разработчику.
Задайте вопрос сообществу — карточка модели будет прикреплена автоматически.