Текущая2025-09-23

От Qwen
Qwen3-VL-235B-A22B Instruct — это мультимодальная модель с открытым весом, которая объединяет четкое создание текста с визуальным пониманием изображений и видео. Модель Instruct ориентирована на общее использование языка видения (VQA, анализ документов, диаграммы/таблицы...
Qwen3 VL 235B A22B Instruct сильнее всего выглядит в категории «зрение». Профиль рассчитан по процентилям LiveBench, Artificial Analysis и LMArena; пропуски не считаются нулём.
Показатели G‑Код, G‑Рассуждения, G‑Агенты и G‑Зрение рассчитаны по массовым таблицам LiveBench, Artificial Analysis и LMArena. Наведите или нажмите на значок рядом с оценкой, чтобы увидеть исходный лидерборд, вариант модели, значение и размер выборки.
Уверенность данных
средняя
Покрытие
1 тест · 1 направление
Происхождение
lmarenaVision
1 тест · уверенность: средняя
Место исходного бенчмарка показывается только при закреплённом source record и среди других карточек с источником. Эти старые значения не участвуют в G-Score лидербордов.
| Бенчмарк | Результат | Место | Доказательство |
|---|---|---|---|
| Arena Elo (LMSYS) | 1456 | н/д | Источник не указан |
| MMLU (Общие знания) | 89.7% | н/д | Источник не указан |
| HumanEval (Кодинг) | 94% | н/д | Источник не указан |
| MATH (Математика) | 82.8% | н/д | Источник не указан |
| GPQA (Экспертные знания) | 71.7% | н/д | Источник не указан |
| SWE-bench (Разработка) | 55.9% | н/д | Источник не указан |
Qwen3 VL 235B A22B Instruct — это передовая мультимодальная модель с открытыми весами, объединяющая в себе мощь глубокого текстового интеллекта и продвинутые способности визуального восприятия. С архитектурой, использующей активацию 22 миллиардов параметров из общих 235, модель предлагает исключительную производительность в анализе изображений и видео при сохранении высокой скорости работы.
В отличие от многих моделей, использующих внешние модули «зрения», Qwen3 VL изначально обучена работе с мультимодальными данными. Она одинаково эффективно справляется с описанием статичных картинок, парсингом сложных документов и анализом динамических сцен на видео.
Модель была специально оптимизирована для извлечения информации из визуально представленных данных. Qwen3 VL идеально подходит для автоматизации обработки счетов, чеков, графиков и технических чертежей, преобразуя визуальную информацию в структурированный текст.
Поддержка огромного окна контекста позволяет модели анализировать не просто отдельные кадры, а длинные видеозаписи или целые пакеты документов в рамках одного запроса, сохраняя связность и глубокое понимание всех деталей.
| Бенчмарк | Результат Qwen3 VL | Категория |
|---|---|---|
| Arena Elo | 1456 | Лидер среди мультимодальных открытых весов |
| MMLU | 89.7% | Общие знания |
| HumanEval | 94.0% | Генерация кода (премиум уровень) |
| MATH | 82.8% | Математические вычисления |
| GPQA | 71.7% | Научные тесты |
| SWE_bench | 55.9% | Решение инженерных задач |
Qwen3 VL 235B A22B Instruct доступна через API по крайне выгодной цене: $0.20 за 1M входных токенов. Это делает её одним из самых доступных и мощных инструментов для бизнеса, внедряющего технологии компьютерного зрения и глубокого анализа данных.
Статья подготовлена для Gruzdevv.ru. Все данные актуальны на май 2026 года.
Цены приведены за 1 млн токенов и могут меняться. Доступность российских провайдеров проверяется на их стороне.
История семейства
Последовательность собрана по датам релиза моделей Qwen в каталоге. Она показывает соседние поколения, но не приписывает им совместимость или наследование архитектуры без отдельного источника.
Сервисы, инструменты, материалы и обсуждения, связанные с моделью.
Откройте результаты по названию модели и проверьте актуальную интеграцию.
Точных связей пока нет. Искать по разработчику.
Задайте вопрос сообществу — карточка модели будет прикреплена автоматически.