К списку моделей
Логотип xAI, разработчика Grok 4.5

Grok 4.5

G-Score58.5/100высокая#15 из 37Методология G-Score

От xAI

Proprietary
FAMGrok
CTXне раскрыт
PARНе раскрыто
Релиз: 2026-07-16
FlagshipCodingReasoningAgenticTextGeneral

Краткое описание

Grok 4.5 — проприетарная frontier-модель xAI для программирования, агентных задач и knowledge work. В xAI API у неё контекст 500K и цена $2/$6 за 1 млн токенов. В Cursor эта же совместно обученная модель использует ID grok-4.5, но имеет контекст 256K; вариант Grok 4.5 (Fast) является режимом доставки Cursor, а не отдельной моделью xAI.

G-Score и профиль

G-Score58.5/100высокая#15 из 37Методология G-Score

Grok 4.5 сильнее всего выглядит в категориях «зрение и агенты». Профиль рассчитан по процентилям LiveBench, Artificial Analysis и LMArena; пропуски не считаются нулём.

Показатели G‑Код, G‑Рассуждения, G‑Агенты и G‑Зрение рассчитаны по массовым таблицам LiveBench, Artificial Analysis и LMArena. Наведите или нажмите на значок рядом с оценкой, чтобы увидеть исходный лидерборд, вариант модели, значение и размер выборки.

Уверенность данных

высокая

Покрытие

10 тестов · 9 направлений

Происхождение

livebench + artificialAnalysis + lmarenaVision

G‑Зрение90/100

1 тест · уверенность: средняя

G‑Агенты86/100

1 тест · уверенность: низкая

G‑Общее качество75/100

2 теста · уверенность: средняя

G‑Следование инструкциям72/100

1 тест · уверенность: низкая

G‑Язык69/100

1 тест · уверенность: низкая

G‑Рассуждения64/100

1 тест · уверенность: низкая

G‑Математика59/100

1 тест · уверенность: низкая

G‑Работа с данными45/100

1 тест · уверенность: низкая

G‑Код3/100

1 тест · уверенность: низкая

Как рассчитан профиль →

Место модели в каталоге

Место исходного бенчмарка показывается только при закреплённом source record и среди других карточек с источником. Эти старые значения не участвуют в G-Score лидербордов.

БенчмаркРезультатМестоДоказательство
DeepSWE 1.062%н/дИсточник не указан
DeepSWE 1.153%н/дИсточник не указан
SWE Marathon29%н/дИсточник не указан
SWE Bench Pro64.7%н/дИсточник не указан
Terminal-Bench 2.183.3%н/дИсточник не указан

Подробный обзор модели

Grok 4.5 - frontier-модель xAI для кода, агентных задач и knowledge work. Это не универсальная "новая версия чата" в узком смысле: в релизе xAI делает главный акцент на инженерных задачах, длинных агентных прогонах, работе с инструментами и эффективности по токенам.

xAI представила модель 16 июля 2026 года. В API она вызывается как grok-4.5, имеет контекст 500K и стоит $2 за 1 млн input-токенов и $6 за 1 млн output-токенов. Официальная документация указывает Responses API, Chat Completions, function calling, web search, X search и code execution.

Связанная новость на сайте: xAI выпустила Grok 4.5 для кода, агентов и knowledge work.

Что изменилось в Grok 4.5

По описанию xAI, Grok 4.5 обучали на наборах данных по коду, науке, инженерии и математике. Отдельный акцент сделан на reinforcement learning для многошаговых software engineering задач: модель должна не просто писать фрагменты кода, а работать с задачей как агент - исследовать проблему, использовать инструменты, проверять гипотезы и доводить результат до рабочего состояния.

В релизе xAI также заявляет, что Grok 4.5 обучалась совместно с Cursor. Cursor использует тот же Model ID grok-4.5, но указывает для своей поверхности контекст 256K. Вариант Grok 4.5 (Fast) — это отдельный режим доставки и тарификации Cursor, а не вторая модель xAI.

Бенчмарки

В карточку добавлены только опубликованные xAI результаты:

BenchmarkGrok 4.5Что измеряет
DeepSWE 1.062,0%pass@1 на агентных SWE-задачах
DeepSWE 1.153,0%вариант DeepSWE в mini-swe-agent harness
SWE Marathon29,0%resolution rate на длинных SWE-задачах
Terminal Bench 2.183,3%работа в терминале и контейнерной среде
SWE Bench Pro64,7%resolve rate на усложненном SWE-наборе

Эти цифры не делают модель абсолютным лидером во всех строках. В таблице xAI Fable и GPT 5.5 выше на части DeepSWE/Terminal Bench, а Fable и Opus 4.8 выше на SWE Bench Pro. Сильная сторона Grok 4.5 по заявке xAI - сочетание качества, скорости и стоимости, а не первое место в каждом отдельном benchmark.

Скорость и цена

xAI пишет, что Grok 4.5 обслуживается примерно на 80 TPS и дает около 2x token efficiency относительно сопоставимых leading models на тех же задачах. В примере SWE Bench Pro компания указывает средний output 15 954 токена на задачу против 67 020 у Opus 4.8 max.

API-цена опубликована отдельно: $2 за 1 млн input-токенов и $6 за 1 млн output-токенов. На старте xAI обещает ограниченное бесплатное использование в Grok Build и Cursor, но для продакшен-расчетов лучше считать именно API-тариф, а не промо-доступ.

Где доступна модель

Grok 4.5 доступна в xAI API, Grok Build и Cursor на всех планах. Документация также перечисляет Office add-ins и модельные шлюзы OpenRouter, Vercel, Cloudflare, Snowflake и Databricks Mosaic.

Есть географическое ограничение: на момент релиза xAI пишет, что Grok 4.5 еще не доступна пользователям EU в продуктах SpaceXAI и API console; доступность ожидается в середине июля 2026 года.

Кому смотреть

Grok 4.5 стоит тестировать командам, которым важны агентные сценарии разработки: исправление багов в реальном репозитории, терминальные задачи, генерация приложений из короткого prompt, работа с документами и интеграция в IDE. Для коротких дешевых автодополнений модель может быть избыточной; для таких задач в каталоге есть более легкие coding-модели.

Отдельно стоит проверить поведение на собственных задачах. Результаты xAI полезны как ориентир, но они не заменяют eval на вашем стекe, тестах и review-процессе.

Источники: анонс xAI, документация xAI по Grok 4.5.

Где запустить модель

Цены приведены за 1 млн токенов и могут меняться. Доступность российских провайдеров проверяется на их стороне.

Обновляем провайдеров и цены…

Стоимость API

$2.00 / $6.00 за 1M токенов в xAI API; тарифы Cursor и Cursor Fast считаются отдельно

Рассчитать сценарий →

Профиль модели

SWE Pro64.7%DeepSWE 1.062%DeepSWE 1.153%Marathon29%T-Bench83.3%

Бенчмарки

DeepSWE 1.062%
DeepSWE 1.153%
SWE Marathon29%
SWE Bench Pro64.7%
Terminal-Bench 2.183.3%

История семейства

Линейка Grok

Последовательность собрана по датам релиза моделей xAI в каталоге. Она показывает соседние поколения, но не приписывает им совместимость или наследование архитектуры без отдельного источника.

Экосистема Grok 4.5

Сервисы, инструменты, материалы и обсуждения, связанные с моделью.

Обсуждения о Grok 4.5

Задайте вопрос сообществу — карточка модели будет прикреплена автоматически.

Создать обсуждение