Текущая2025-07-09

От xAI
Grok 4 — новейшая модель рассуждения xAI (1.7 трлн параметров). Использует многоагентную архитектуру для решения задач аспирантского уровня. Контекст 256K, цена $3.00/$15.00 за 1 млн токенов. Лидер в экспертных бенчмарках.
Grok 4 сильнее всего выглядит в категории «зрение». Профиль рассчитан по процентилям LiveBench, Artificial Analysis и LMArena; пропуски не считаются нулём.
Показатели G‑Код, G‑Рассуждения, G‑Агенты и G‑Зрение рассчитаны по массовым таблицам LiveBench, Artificial Analysis и LMArena. Наведите или нажмите на значок рядом с оценкой, чтобы увидеть исходный лидерборд, вариант модели, значение и размер выборки.
Уверенность данных
средняя
Покрытие
1 тест · 1 направление
Происхождение
lmarenaVision
1 тест · уверенность: средняя
Место исходного бенчмарка показывается только при закреплённом source record и среди других карточек с источником. Эти старые значения не участвуют в G-Score лидербордов.
| Бенчмарк | Результат | Место | Доказательство |
|---|---|---|---|
| GPQA (Экспертные знания) | 59% | н/д | Источник не указан |
| MATH (Математика) | 72.6% | н/д | Источник не указан |
| MMLU (Общие знания) | 82.8% | н/д | Источник не указан |
| Arena Elo (LMSYS) | 1374 | н/д | Источник не указан |
| HumanEval (Кодинг) | 81.6% | н/д | Источник не указан |
| SWE-bench (Разработка) | 54% | н/д | Источник не указан |
Цены приведены за 1 млн токенов и могут меняться. Доступность российских провайдеров проверяется на их стороне.
История семейства
Последовательность собрана по датам релиза моделей xAI в каталоге. Она показывает соседние поколения, но не приписывает им совместимость или наследование архитектуры без отдельного источника.
Сервисы, инструменты, материалы и обсуждения, связанные с моделью.
Откройте результаты по названию модели и проверьте актуальную интеграцию.
Точных связей пока нет. Искать по разработчику.
Задайте вопрос сообществу — карточка модели будет прикреплена автоматически.