К списку моделей
Q(

Qwen3.8-2.4T-A95B

G-Score: н/д

От Qwen (Alibaba Cloud)

Open Weights
FAMQwen
CTX262K нативно / до 1.01M
PAR2.4T всего / 95B активных (MoE)
Релиз: 2026-08-09
FlagshipMoETextReasoningAgenticCode

Краткое описание

MoE-модель Qwen с открытыми весами: 2,4 трлн параметров всего и 95 млрд активных. Нативный контекст — 262 144 токена, с YaRN — до 1 010 000; thinking нельзя отключить. Веса доступны по Qwen3.8-Max License, а указанные цены относятся к стороннему API OpenRouter.

G-Score и профиль

G-Score: н/д

Для Qwen3.8-2.4T-A95B пока нет совпавших результатов в подключённых публичных лидербордах. Исходные значения карточки не используются для G‑Score.

Показатели G‑Код, G‑Рассуждения, G‑Агенты и G‑Зрение рассчитаны по массовым таблицам LiveBench, Artificial Analysis и LMArena. Наведите или нажмите на значок рядом с оценкой, чтобы увидеть исходный лидерборд, вариант модели, значение и размер выборки.

Уверенность данных

низкая

Покрытие

0 тестов · 0 направлений

Происхождение

нет данных лидербордов

Как рассчитан профиль →

Подробный обзор модели

Qwen3.8-2.4T-A95B — MoE-модель Qwen с открытыми весами для сложных текстовых, программных и агентных задач. Она активирует 95 млрд из 2,4 трлн параметров, работает только с текстом и всегда формирует рассуждение перед итоговым ответом. Модель можно развернуть на своей инфраструктуре или вызвать через сторонний API, но ее не следует путать с управляемой Qwen3.8-Max.

Релиз открытых весов

Официальный репозиторий Qwen получил первый публичный набор файлов 9 августа 2026 года. Именно эту дату стоит считать релизом открытых весов Qwen3.8-2.4T-A95B. Маркировка 12 августа на странице OpenRouter относится к появлению модели у стороннего API-агрегатора, а не к исходной публикации Qwen.

Модель использует архитектуру Mixture of Experts: общий размер составляет 2,4 трлн параметров, но при обработке токена активируются 95 млрд. На каждом шаге работает только часть сети, однако это не превращает Qwen3.8-2.4T-A95B в модель для обычного персонального компьютера.

Контекст и режим рассуждения

Нативное контекстное окно в официальной model card составляет 262 144 токена. Через YaRN его можно расширить до 1 010 000 токенов. Фактический предел в облачном API зависит от провайдера: например, OpenRouter на 21 августа 2026 года показывал окно 1 048 576 токенов и максимум 131 072 выходных токена.

Qwen3.8-2.4T-A95B принимает и возвращает только текст. Изображения и видео на входе не поддерживаются. Thinking нельзя выключить: каждый ответ начинается с блока рассуждений <think>…</think>, после которого следует финальный текст. Параметр reasoning_effort меняет глубину вычислений между уровнями low, medium и xhigh, но не переводит модель в режим без рассуждения.

Такое устройство подходит для задач, где важны многошаговый анализ, программирование, работа с инструментами и длинные последовательности действий. Для коротких запросов обязательный thinking может увеличивать задержку и расход выходных токенов.

Чем открытые веса отличаются от Qwen3.8-Max

Qwen3.8-Max — управляемый вариант на основе Qwen3.8-2.4T-A95B, но с дополнительными возможностями. Hosted-модель принимает изображения, поддерживает ответы без thinking, использует контекст 1 млн токенов по умолчанию и предоставляет официальные встроенные инструменты.

Открытая Qwen3.8-2.4T-A95B дает другой уровень контроля: команда сама выбирает инфраструктуру, политику хранения данных и конфигурацию инференса. При этом она получает text-only модель с обязательными рассуждениями и самостоятельно отвечает за производительность, доступность и расходы. Возможности hosted Qwen3.8-Max нельзя автоматически переносить на self-hosted-развертывание открытых весов.

Локальное развёртывание и требования

Qwen указывает совместимость с Transformers, vLLM, SGLang, TokenSpeed и Docker Model Runner. Репозиторий BF16-весов занимает около 4,89 ТБ, поэтому загрузка файлов — лишь первая часть инфраструктурной задачи. Для запуска нужны значительные ресурсы хранения и вычислений, а при обслуживании длинного контекста возрастает расход памяти.

Официальная карточка не задает универсальную минимальную конфигурацию GPU. Она зависит от формата весов, квантизации, длины контекста, числа одновременных запросов и выбранного движка. Поэтому оценивать оборудование следует на собственном профиле нагрузки, а не по одному числу параметров.

Лицензия Qwen3.8-Max License

Веса опубликованы не под Apache 2.0, а под собственной Qwen3.8-Max License. Она разрешает использование, модификацию, распространение, хостинг и дообучение, но вводит отдельные условия для крупных коммерческих продуктов.

Если продукт или сервис превышает 100 млн активных пользователей в месяц либо $20 млн ежемесячной выручки, требуется заметно указывать название модели. Для Model as a Service и AI Work Assistant с совокупной выручкой свыше $50 млн за любые последовательные 12 месяцев нужна отдельная коммерческая лицензия Qwen. Перед коммерческим запуском следует прочитать полный текст лицензии: краткое описание карточки не заменяет юридическую проверку.

API и стоимость

Сами веса не имеют цены за токен: расходы self-hosted-развертывания определяют оборудование, аренда ускорителей, хранение, трафик и эксплуатация. В официальной model card упомянут управляемый Qwen Cloud, но публичная ставка именно для Qwen3.8-2.4T-A95B в исследованном источнике не указана.

На 21 августа 2026 года OpenRouter показывал для qwen/qwen3.8-2.4t-a95b базовую цену от $2 за 1 млн входных токенов и $6 за 1 млн выходных токенов. Чтение кэша у части провайдеров начиналось от $0,20 за 1 млн токенов. Это тариф стороннего маршрутизатора: конкретная цена, доступность и список провайдеров могут меняться.

Что показывают тесты Qwen

Таблица в официальном репозитории открытых весов подписывает результаты как Qwen3.8-Max: 86,6 балла в Terminal Bench 2.1, 67,7 в SWE-bench Pro, 56,6 в DeepSWE 1.1, 74,8 в CoWorkBench, 92,6 в GPQA Diamond и 43,6 в Humanity's Last Exam. Эти значения сообщил разработчик для управляемого варианта. Они не подтверждают производительность любой локальной конфигурации Qwen3.8-2.4T-A95B и не заменяют тестирование на собственной инфраструктуре.

Qwen3.8-2.4T-A95B стоит рассматривать, когда команде нужны контролируемое развертывание, длинный контекст и сильный акцент на reasoning, код и агентов. Для мультимодального ввода, ответов без thinking и готовых встроенных инструментов практичнее управляемая Qwen3.8-Max.

Где запустить модель

Цены приведены за 1 млн токенов и могут меняться. Доступность российских провайдеров проверяется на их стороне.

Обновляем провайдеров и цены…

Стоимость API

Веса: Qwen3.8-Max License; self-hosted — расходы владельца. OpenRouter — от $2 / $6 за 1M input/output, cache read от $0.20 (21.08.2026)

Рассчитать сценарий →

Профиль модели

Для диаграммы пока недостаточно сопоставимых тестов.

Бенчмарки

Сопоставимые числовые результаты пока не опубликованы. В каталоге они отмечены знаком «?», без оценочных значений.

Экосистема Qwen3.8-2.4T-A95B

Сервисы, инструменты, материалы и обсуждения, связанные с моделью.

MCP и инструменты

Весь каталог

Точных связей пока нет. Искать по разработчику.

Статьи и термины

Все статьи

Обсуждения о Qwen3.8-2.4T-A95B

Задайте вопрос сообществу — карточка модели будет прикреплена автоматически.

Создать обсуждение