30 сентября 2026 года Google анонсировала Gemini 4 Argon — новую флагманскую модель для длинных многошаговых задач в разработке ПО, финансах, юриспруденции и киберзащите. Модель открывает поколение Gemini 4. Пока Argon получили только участники программы Fairwind — доверенные специалисты по киберзащите; разработчикам, компаниям и обычным пользователям Google обещает открыть модель «как можно скорее», но дат не называет.
Что нового
- Вывод до 1M токенов. У прошлых моделей Gemini лимит вывода составлял 64K. Контекстное окно — тоже 1M токенов.
- Агентный кодинг. 77,9% на DeepSWE v1.1 — новый рекорд теста. Внутри Google модель переносит C/C++-код на Rust, вплоть до ядра Zircon в Fuchsia объёмом более 800 тысяч строк.
- Знаниевая работа. Первое место на Vals Index (68,9%), AutomationBench от Zapier (51,3%), Vals Finance Agent v2 (65,4%) и Harvey Legal Agent (19,6%).
- Киберзащита. Argon сам находит, проверяет и исправляет уязвимости. Доверенным защитникам модель выдаётся без кибер-ограничений; на CWE-bench v1 она делит первое место с GPT-6 Astra.
- Мультимодальность. 91,7% на LVBench (понимание длинных видео) и 71,6% на Chartography — лучшие значения в сравнении.
Цены
| Параметр | Вводная цена | После вводного периода |
|---|---|---|
| Вход, за 1M токенов | $2.00 | $4.00 |
| Выход, за 1M токенов | $10.00 | $20.00 |
| Кэшированный вход | скидка 95% от цены входа | |
Вводная цена совпадает с GPT-6.1 Sol и Claude Sonnet 5.5 и в пять раз ниже, чем у GPT-6 Astra ($10 / $50). Срок вводного периода Google не называет.
Бенчмарки
| Тест | Gemini 4 Argon | GPT-6 Astra | Claude Opus 5.5 |
|---|---|---|---|
| DeepSWE v1.1 | 77.9% | 74.1% | 74.2% |
| FrontierSWE v2 | 55.0% | 65.5% | 62.3% |
| Terminal-Bench 4.0 | 57.4% | 58.2% | 66.4% |
| Vals Index | 68.9% | 63.1% | 67.0% |
| AutomationBench | 51.3% | 41.4% | 42.5% |
| Harvey Legal Agent | 19.6% | 5.4% | 3.8% |
| GraphWalks BFS, 256K–1M | 84.2% | 71.8% | 66.8% |
| LVBench | 91.7% | 87.5% | 83.7% |
| CWE-bench v1 | 68.0% | 68.0% | 67.0% |
Цифры — из таблицы Google DeepMind; результаты конкурентов взяты из их отчётов и публичных лидербордов. В агентном кодинге в терминале Argon пока уступает: на FrontierSWE v2 и Terminal-Bench 4.0 впереди GPT-6 Astra и Opus 5.5. Независимая оценка Artificial Analysis даёт модели 53 балла Intelligence Index — столько же, сколько у GPT-6 Astra, и на 12 баллов больше, чем у Gemini 3.8 Flash. По данным Artificial Analysis, Argon реже других лидеров выдумывает ответы: доля галлюцинаций на AA-Omniscience — 15%.
Безопасность и доступ
Перед широким запуском Google усиливает защиту от использования модели для кибер- и CBRN-атак, от косвенных prompt injection и от выхода агента за рамки задачи, а также изолирует среды обучения и тестирования. Компания участвует в добровольной программе правительства США по предварительному доступу к моделям. После тестировщиков Argon первыми получат платные клиенты Gemini API и подписчики Google AI Ultra.
Где посмотреть все характеристики
Цены, лимиты, полная таблица бенчмарков и сравнение с конкурентами — в карточке Gemini 4 Argon в каталоге нейросетей. Полный список актуальных моделей — в каталоге ИИ-моделей Gruzdevv.ru.
Источник: официальный анонс Google.

Комментарии(0)
Оставьте комментарий
Войдите, чтобы присоединиться к обсуждению