Текущая2025-10-30

От Mistral
Voxtral Small — это усовершенствованная версия Mistral Small 3, включающая в себя самые современные возможности аудиовхода, сохраняя при этом лучшую в своем классе производительность текста. Он превосходно справляется с транскрипцией речи, переводом и пониманием звука. Ввод звука...
Для Voxtral Small 24B 2507 пока нет совпавших результатов в подключённых публичных лидербордах. Исходные значения карточки не используются для G‑Score.
Показатели G‑Код, G‑Рассуждения, G‑Агенты и G‑Зрение рассчитаны по массовым таблицам LiveBench, Artificial Analysis и LMArena. Наведите или нажмите на значок рядом с оценкой, чтобы увидеть исходный лидерборд, вариант модели, значение и размер выборки.
Уверенность данных
низкая
Покрытие
0 тестов · 0 направлений
Происхождение
нет данных лидербордов
Место исходного бенчмарка показывается только при закреплённом source record и среди других карточек с источником. Эти старые значения не участвуют в G-Score лидербордов.
| Бенчмарк | Результат | Место | Доказательство |
|---|---|---|---|
| GPQA (Экспертные знания) | 71.5% | н/д | Источник не указан |
| MATH (Математика) | 86.3% | н/д | Источник не указан |
| MMLU (Общие знания) | 89.4% | н/д | Источник не указан |
| Arena Elo (LMSYS) | 1453 | н/д | Источник не указан |
| HumanEval (Кодинг) | 81.3% | н/д | Источник не указан |
| SWE-bench (Разработка) | 45.7% | н/д | Источник не указан |
Voxtral Small 24B 2507 — это специализированная мультимодальная модель от Mistral AI, объединяющая в себе мощь текстового интеллекта Mistral Small 3 с передовыми возможностями обработки аудио. Представленная в октябре 2025 года, эта модель стала ответом на растущую потребность рынка в инструментах, способных напрямую «слышать» и понимать человеческую речь без промежуточных этапов преобразования.
В отличие от классических систем, использующих связку ASR (речь-в-текст) + LLM, Voxtral Small напрямую принимает аудиосигнал. Это позволяет модели улавливать не только слова, но и интонацию, эмоции и нюансы речи, что значительно повышает качество транскрибации и понимания контекста.
Благодаря глубокой интеграции аудио и текста, модель демонстрирует выдающиеся результаты в задачах перевода речи в реальном времени. Она способна мгновенно переводить аудио на одном языке в качественный текст на другом, сохраняя при этом смысл и эмоциональный окрас сообщения.
Voxtral Small может анализировать длинные аудиозаписи, выявлять в них ключевые моменты, определять количество спикеров и предоставлять краткие суммаризации обсуждений, что делает её идеальным инструментом для бизнеса.
| Бенчмарк | Результат Voxtral Small | Категория |
|---|---|---|
| Arena Elo | 1453 | Лидер аудио-текстовых моделей |
| MMLU | 89.4% | Общие знания |
| HumanEval | 81.3% | Написание кода |
| MATH | 86.3% | Математические рассуждения |
| GPQA | 71.5% | Научные тесты |
| SWE_bench | 45.7% | Решение инженерных задач |
Voxtral Small 24B доступна через API по цене $0.10 за 1M входных токенов. Это крайне выгодное предложение для разработчиков, внедряющих функции голосового управления и аудио-аналитики в свои приложения.
Статья подготовлена для Gruzdevv.ru. Все данные актуальны на май 2026 года.
Цены приведены за 1 млн токенов и могут меняться. Доступность российских провайдеров проверяется на их стороне.
История семейства
Последовательность собрана по датам релиза моделей Mistral в каталоге. Она показывает соседние поколения, но не приписывает им совместимость или наследование архитектуры без отдельного источника.
Сервисы, инструменты, материалы и обсуждения, связанные с моделью.
Откройте результаты по названию модели и проверьте актуальную интеграцию.
Точных связей пока нет. Искать по разработчику.
Задайте вопрос сообществу — карточка модели будет прикреплена автоматически.