
От Qwen
Qwen3.7-Plus — мультимодальная агентная модель Qwen, объединяющая текст, изображения и видео в одном контексте до 1 млн токенов. Она рассчитана на GUI- и CLI-автоматизацию, visual coding, OCR, поиск с визуальным контекстом и обычные корпоративные сценарии. Официальная таблица охватывает код, MCP, reasoning, длинный контекст, мультиязычность, визуальные агенты, документы и видео.
Qwen3.7-Plus сильнее всего выглядит в категории «рассуждения». Индекс 50/100 рассчитан по процентильным позициям в 3 сопоставимых тестах; уверенность — средняя. Это навигационная оценка, а не замена тесту на ваших задачах.
3 сопоставимых теста · уверенность: средняя
1 сопоставимых теста · уверенность: низкая
2 сопоставимых теста · уверенность: средняя
2 сопоставимых теста · уверенность: средняя
Позиция рассчитана только среди моделей, для которых в каталоге указан результат того же теста. Это помогает сравнивать карточки, но не заменяет проверку модели на вашей задаче.
| Бенчмарк | Результат | Место | Доказательство |
|---|---|---|---|
| Terminal-Bench 2.0 | 70.3% | 1 из 2 | Результат разработчика |
| SWE-bench Verified | 77.7% | 2 из 2 | Результат разработчика |
| SWE Bench Pro | 57.6% | 6 из 7 | Результат разработчика |
| SWE-Bench Multilingual | 75.8% | 3 из 3 | Результат разработчика |
| NL2Repo | 41.1% | 2 из 2 | Результат разработчика |
| SciCode | 51.3% | 2 из 2 | Результат разработчика |
| QwenWebDev (Elo, внутренний) | 1536 | 2 из 2 | Внутренний тест разработчика |
| QwenSVG (Elo, внутренний) | 1588 | 2 из 2 | Внутренний тест разработчика |
| QwenClawBench | 61.8% | 2 из 2 | Результат разработчика |
| CoWorkBench (внутренний) | 65.1% | 2 из 2 | Внутренний тест разработчика |
| ClawEval | 62.7% | 2 из 2 | Результат разработчика |
| SkillsBench | 54.9% | 2 из 2 | Результат разработчика |
| BFCL v4 (Tool Calling) | 72.9% | 2 из 2 | Результат разработчика |
| MCP-Mark | 58.7% | 2 из 2 | Результат разработчика |
| MCP Atlas | 73.2% | 3 из 3 | Результат разработчика |
| VITA-Bench | 45.6% | 2 из 2 | Результат разработчика |
| Deep-Planning | 62.3% | 1 из 1 | Результат разработчика |
| SpreadsheetBench v1 | 86.3% | 2 из 2 | Результат разработчика |
| KernelBench L3 (задач ускорено) | 98% | 1 из 2 | Результат разработчика |
| QwenWorldBench (внутренний) | 62.1% | 1 из 2 | Внутренний тест разработчика |
| GPQA (Экспертные знания) | 90.3% | 6 из 390 | Результат разработчика |
| Humanity's Last Exam | 34.7% | 3 из 3 | Результат разработчика |
| LiveCodeBench | 89.6% | 2 из 2 | Результат разработчика |
| HMMT 2026 Feb | 92.9% | 2 из 2 | Результат разработчика |
| IMOAnswerBench | 86% | 2 из 2 | Результат разработчика |
| CritPT | 6% | 2 из 2 | Результат разработчика |
| Apex | 22.7% | 2 из 2 | Результат разработчика |
| MMLU-Pro | 88.5% | 2 из 2 | Результат разработчика |
| MMLU-Redux | 94.5% | 2 из 2 | Результат разработчика |
| SuperGPQA (Сложные вопросы) | 71.4% | 2 из 3 | Результат разработчика |
| IFEval | 94.6% | 1 из 2 | Результат разработчика |
| IFBench | 79.1% | 1 из 2 | Результат разработчика |
| MRCR-v2 128K | 91.7% | 1 из 2 | Результат разработчика |
| WMT24++ | 84.6% | 2 из 2 | Результат разработчика |
| MAXIFE | 88.8% | 2 из 2 | Результат разработчика |
| MMMLU | 89% | 2 из 2 | Результат разработчика |
| MMLU-ProX | 85.4% | 2 из 2 | Результат разработчика |
| NOVA-63 | 58.8% | 2 из 2 | Результат разработчика |
| INCLUDE | 83% | 2 из 2 | Результат разработчика |
| Global PIQA | 90.3% | 2 из 2 | Результат разработчика |
| PolyMATH | 84% | 2 из 2 | Результат разработчика |
| MMMU Pro (Мультимодальность) | 79% | 4 из 5 | Результат разработчика |
| MathVision | 90.3% | 2 из 2 | Результат разработчика |
| BabyVision с Python | 70.4% | 2 из 2 | Результат разработчика |
| CharXiv RQ | 85.9% | 1 из 2 | Результат разработчика |
| HiPhO | 84.1% | 1 из 1 | Результат разработчика |
| ERQA | 69.8% | 1 из 1 | Результат разработчика |
| VisFactor | 42.8% | 1 из 1 | Результат разработчика |
| MedXpertQA-MM | 71% | 1 из 1 | Результат разработчика |
| ScreenSpot Pro | 79% | 1 из 1 | Результат разработчика |
| OSWorld-Verified | 73.3% | 3 из 3 | Результат разработчика |
| AndroidWorld | 81% | 1 из 1 | Результат разработчика |
| QwenVision2Code (Elo, внутренний) | 1772 | 1 из 1 | Внутренний тест разработчика |
| ClawEval-MM | 55.7% | 1 из 1 | Результат разработчика |
| SimpleVQA | 81.7% | 1 из 1 | Результат разработчика |
| WorldVQA ForceAnswer | 61.1% | 1 из 2 | Результат разработчика |
| MMSearchPlus | 41.4% | 1 из 1 | Результат разработчика |
| BC-VL | 51.1% | 1 из 1 | Результат разработчика |
| MMBC | 46.3% | 1 из 1 | Результат разработчика |
| RealWorldQA | 86.9% | 1 из 1 | Результат разработчика |
| CountQA | 77% | 1 из 1 | Результат разработчика |
| OmniDocBench 1.5 | 91.4% | 1 из 1 | Результат разработчика |
| OCR-Bench-v2 EN | 70.7% | 1 из 1 | Результат разработчика |
| OCR-Bench-v2 ZH | 67.1% | 1 из 1 | Результат разработчика |
| ODinW13 | 51.1% | 1 из 1 | Результат разработчика |
| LingoQA | 83.4% | 1 из 1 | Результат разработчика |
| Ego3D-Bench | 5.9% | 1 из 1 | Результат разработчика |
| SURDS | 77.2% | 1 из 1 | Результат разработчика |
| VLADBench | 77.2% | 1 из 1 | Результат разработчика |
| VideoMME | 88% | 1 из 1 | Результат разработчика |
| VideoMMMU | 85.4% | 1 из 1 | Результат разработчика |
| MLVU | 87.4% | 1 из 1 | Результат разработчика |
| TVBench | 78.2% | 1 из 1 | Результат разработчика |
| LVBench | 76.2% | 1 из 1 | Результат разработчика |
Происхождение результатов
Структурированные значения перенесены из полных текстовой и мультимодальной таблиц Qwen Team; варианты с code interpreter в обзоре отмечены отдельно.
Вариант: Qwen3.7-Plus, developer evaluation settings from text and multimodal tables · получено 2026-07-22
Qwen3.7-Plus — мультимодальная агентная модель Qwen, представленная 1 июня 2026 года. Она принимает текст, изображения и видео, возвращает текст и поддерживает контекст до 1 млн токенов. Главный сценарий — гибридный агент, который может одновременно рассуждать, писать код, работать в терминале и понимать графический интерфейс.
Максимальный вывод составляет 65 536 токенов. Поддерживаются function calling, встроенные web search и code execution, structured output и сохранение thinking-контента между ходами. Для изображений заявлено до 2048 входов в запросе, для видео — до 64 файлов общей длительностью до двух часов.
Модель проприетарная, поэтому локальный запуск и скачивание весов недоступны. Число параметров Qwen не раскрывает.
| Тест | Результат | Тест | Результат |
|---|---|---|---|
| Terminal-Bench 2.0 Terminus | 70,3% | SWE-bench Verified | 77,7% |
| SWE-Pro | 57,6% | SWE-Multilingual | 75,8% |
| NL2Repo | 41,1% | SciCode | 51,3% |
| QwenWebDev | 1536 Elo | QwenSVG | 1588 Elo |
| QwenClawBench | 61,8% | CoWorkBench | 65,1% |
| ClawEval | 62,7% | SkillsBench | 54,9% |
| BFCL v4 | 72,9% | MCP-Mark | 58,7% |
| MCP-Atlas | 73,2% | VITA-Bench | 45,6% |
| Deep-Planning | 62,3% | SpreadsheetBench v1 | 86,3% |
| KernelBench L3 | 2,06× / 98% | QwenWorldBench | 62,1% |
| Тест | Результат | Тест | Результат |
|---|---|---|---|
| GPQA Diamond | 90,3% | HLE | 34,7% |
| LiveCodeBench | 89,6% | HMMT 2026 Feb | 92,9% |
| IMOAnswerBench | 86,0% | CritPT | 6,0% |
| Apex | 22,7% | MMLU-Pro | 88,5% |
| MMLU-Redux | 94,5% | SuperGPQA | 71,4% |
| IFEval | 94,6% | IFBench | 79,1% |
| MRCR-v2 128K | 91,7% | WMT24++ | 84,6% |
| MAXIFE | 88,8% | MMMLU | 89,0% |
| MMLU-ProX | 85,4% | NOVA-63 | 58,8% |
| INCLUDE | 83,0% | Global PIQA | 90,3% |
| PolyMATH | 84,0% |
| Тест | Результат | Тест | Результат |
|---|---|---|---|
| MMMU-Pro | 79,0% | MathVision | 90,3% |
| BabyVision | 70,4% с code interpreter / 64,7% без него | CharXiv RQ | 85,9% / 84,4% |
| HiPhO | 84,1% | ERQA | 69,8% |
| VisFactor | 42,8% | MedXpertQA-MM | 71,0% |
| ScreenSpot Pro | 79,0% | OSWorld-Verified | 73,3% |
| AndroidWorld | 81,0% | QwenVision2Code | 1772 Elo |
| ClawEval-MM | 55,7% |
| Тест | Результат | Тест | Результат |
|---|---|---|---|
| SimpleVQA | 81,7% | WorldVQA | 61,1% |
| MMSearchPlus | 41,4% | BC-VL | 51,1% |
| MMBC | 46,3% | RealWorldQA | 86,9% |
| CountQA | 77,0% | OmniDocBench 1.5 | 91,4% |
| OCR-Bench-v2 EN | 70,7% | OCR-Bench-v2 ZH | 67,1% |
| ODinW13 | 51,1% |
| Тест | Результат | Тест | Результат |
|---|---|---|---|
| LingoQA | 83,4% | Ego3D-Bench | 5,9% |
| SURDS | 77,2% | VLADBench | 77,2% |
| VideoMME с субтитрами | 88,0% | VideoMMMU | 85,4% |
| MLVU | 87,4% | TVBench | 78,2% |
| LVBench | 76,2% |
Все результаты взяты из таблиц разработчика. QwenWebDev, QwenSVG, CoWorkBench и некоторые другие наборы являются внутренними; BabyVision и CharXiv опубликованы в двух режимах. Отсутствующие значения в сравнительной таблице Qwen помечала --, и мы не заменяем их оценками.
В международном API запросы до 256K токенов стоят $0,40 за 1 млн входных и $1,60 за 1 млн выходных токенов. При длине от 256K до 1M цена возрастает до $1,20 и $4,80 соответственно. Thinking и non-thinking output тарифицируются одинаково, но reasoning может увеличить фактическое число выходных токенов.
По цене и мультимодальности Plus выглядит практичнее Max для документов, скриншотов, видео и повседневной автоматизации. Max остаётся более сильным кандидатом для наиболее сложных текстовых coding-задач и reasoning.
Qwen3.7-Plus не имеет открытых весов. Большинство цифр получено командой разработчика, а часть тестов использует собственные harness, judge-модели или code interpreter. Перед внедрением стоит отдельно проверить качество русского языка, устойчивость function calling и стоимость длинных запросов на реальной истории агента.
Наиболее убедительно модель выглядит в визуальном управлении интерфейсами, OCR/документах, длинном контексте и сочетании GUI с CLI. Для простого текстового чата её большой набор агентных функций может быть избыточным.
Источники: официальный релиз Qwen3.7-Plus, зеркало с полными таблицами Alibaba Cloud, спецификации visual models, официальные цены.
Цены приведены за 1 млн токенов и могут меняться. Доступность российских провайдеров проверяется на их стороне.
$0.40 / $1.60 за 1M токенов до 256K; $1.20 / $4.80 при 256K–1M
Сервисы, инструменты, материалы и обсуждения, связанные с моделью.
Откройте результаты по названию модели и проверьте актуальную интеграцию.
Точных связей пока нет. Искать по разработчику.
Задайте вопрос сообществу — карточка модели будет прикреплена автоматически.