Текущая2026-07-16

От xAI
Grok 4.5 — проприетарная frontier-модель xAI для программирования, агентных задач и knowledge work. В xAI API у неё контекст 500K и цена $2/$6 за 1 млн токенов. В Cursor эта же совместно обученная модель использует ID grok-4.5, но имеет контекст 256K; вариант Grok 4.5 (Fast) является режимом доставки Cursor, а не отдельной моделью xAI.
Grok 4.5 сильнее всего выглядит в категориях «зрение и агенты». Профиль рассчитан по процентилям LiveBench, Artificial Analysis и LMArena; пропуски не считаются нулём.
Показатели G‑Код, G‑Рассуждения, G‑Агенты и G‑Зрение рассчитаны по массовым таблицам LiveBench, Artificial Analysis и LMArena. Наведите или нажмите на значок рядом с оценкой, чтобы увидеть исходный лидерборд, вариант модели, значение и размер выборки.
Уверенность данных
высокая
Покрытие
10 тестов · 9 направлений
Происхождение
livebench + artificialAnalysis + lmarenaVision
1 тест · уверенность: средняя
1 тест · уверенность: низкая
2 теста · уверенность: средняя
1 тест · уверенность: низкая
1 тест · уверенность: низкая
1 тест · уверенность: низкая
1 тест · уверенность: низкая
1 тест · уверенность: низкая
1 тест · уверенность: низкая
Место исходного бенчмарка показывается только при закреплённом source record и среди других карточек с источником. Эти старые значения не участвуют в G-Score лидербордов.
| Бенчмарк | Результат | Место | Доказательство |
|---|---|---|---|
| DeepSWE 1.0 | 62% | н/д | Источник не указан |
| DeepSWE 1.1 | 53% | н/д | Источник не указан |
| SWE Marathon | 29% | н/д | Источник не указан |
| SWE Bench Pro | 64.7% | н/д | Источник не указан |
| Terminal-Bench 2.1 | 83.3% | н/д | Источник не указан |
Grok 4.5 - frontier-модель xAI для кода, агентных задач и knowledge work. Это не универсальная "новая версия чата" в узком смысле: в релизе xAI делает главный акцент на инженерных задачах, длинных агентных прогонах, работе с инструментами и эффективности по токенам.
xAI представила модель 16 июля 2026 года. В API она вызывается как grok-4.5, имеет контекст 500K и стоит $2 за 1 млн input-токенов и $6 за 1 млн output-токенов. Официальная документация указывает Responses API, Chat Completions, function calling, web search, X search и code execution.
Связанная новость на сайте: xAI выпустила Grok 4.5 для кода, агентов и knowledge work.
По описанию xAI, Grok 4.5 обучали на наборах данных по коду, науке, инженерии и математике. Отдельный акцент сделан на reinforcement learning для многошаговых software engineering задач: модель должна не просто писать фрагменты кода, а работать с задачей как агент - исследовать проблему, использовать инструменты, проверять гипотезы и доводить результат до рабочего состояния.
В релизе xAI также заявляет, что Grok 4.5 обучалась совместно с Cursor. Cursor использует тот же Model ID grok-4.5, но указывает для своей поверхности контекст 256K. Вариант Grok 4.5 (Fast) — это отдельный режим доставки и тарификации Cursor, а не вторая модель xAI.
В карточку добавлены только опубликованные xAI результаты:
| Benchmark | Grok 4.5 | Что измеряет |
|---|---|---|
| DeepSWE 1.0 | 62,0% | pass@1 на агентных SWE-задачах |
| DeepSWE 1.1 | 53,0% | вариант DeepSWE в mini-swe-agent harness |
| SWE Marathon | 29,0% | resolution rate на длинных SWE-задачах |
| Terminal Bench 2.1 | 83,3% | работа в терминале и контейнерной среде |
| SWE Bench Pro | 64,7% | resolve rate на усложненном SWE-наборе |
Эти цифры не делают модель абсолютным лидером во всех строках. В таблице xAI Fable и GPT 5.5 выше на части DeepSWE/Terminal Bench, а Fable и Opus 4.8 выше на SWE Bench Pro. Сильная сторона Grok 4.5 по заявке xAI - сочетание качества, скорости и стоимости, а не первое место в каждом отдельном benchmark.
xAI пишет, что Grok 4.5 обслуживается примерно на 80 TPS и дает около 2x token efficiency относительно сопоставимых leading models на тех же задачах. В примере SWE Bench Pro компания указывает средний output 15 954 токена на задачу против 67 020 у Opus 4.8 max.
API-цена опубликована отдельно: $2 за 1 млн input-токенов и $6 за 1 млн output-токенов. На старте xAI обещает ограниченное бесплатное использование в Grok Build и Cursor, но для продакшен-расчетов лучше считать именно API-тариф, а не промо-доступ.
Grok 4.5 доступна в xAI API, Grok Build и Cursor на всех планах. Документация также перечисляет Office add-ins и модельные шлюзы OpenRouter, Vercel, Cloudflare, Snowflake и Databricks Mosaic.
Есть географическое ограничение: на момент релиза xAI пишет, что Grok 4.5 еще не доступна пользователям EU в продуктах SpaceXAI и API console; доступность ожидается в середине июля 2026 года.
Grok 4.5 стоит тестировать командам, которым важны агентные сценарии разработки: исправление багов в реальном репозитории, терминальные задачи, генерация приложений из короткого prompt, работа с документами и интеграция в IDE. Для коротких дешевых автодополнений модель может быть избыточной; для таких задач в каталоге есть более легкие coding-модели.
Отдельно стоит проверить поведение на собственных задачах. Результаты xAI полезны как ориентир, но они не заменяют eval на вашем стекe, тестах и review-процессе.
Источники: анонс xAI, документация xAI по Grok 4.5.
Цены приведены за 1 млн токенов и могут меняться. Доступность российских провайдеров проверяется на их стороне.
$2.00 / $6.00 за 1M токенов в xAI API; тарифы Cursor и Cursor Fast считаются отдельно
Рассчитать сценарий →История семейства
Последовательность собрана по датам релиза моделей xAI в каталоге. Она показывает соседние поколения, но не приписывает им совместимость или наследование архитектуры без отдельного источника.
Сервисы, инструменты, материалы и обсуждения, связанные с моделью.
Точных связей пока нет. Искать по разработчику.
Задайте вопрос сообществу — карточка модели будет прикреплена автоматически.