
От Google
Gemini 3.6 Flash — производственная мультимодальная модель Google для программирования, пространственного анализа и многошаговых агентов. Она принимает текст, изображения, видео, аудио и PDF, поддерживает контекст 1 048 576 токенов и вывод до 65 536 токенов. В официальных тестах разработчика модель получила 49% в DeepSWE, 63,9% в MLE-Bench, 83% в OSWorld-Verified и 1421 Elo в GDPval-AA v2.
Gemini 3.6 Flash сильнее всего выглядит в категории «агенты». Индекс 75/100 рассчитан по процентильным позициям в 2 сопоставимых тестах; уверенность — средняя. Это навигационная оценка, а не замена тесту на ваших задачах.
2 сопоставимых теста · уверенность: средняя
Позиция рассчитана только среди моделей, для которых в каталоге указан результат того же теста. Это помогает сравнивать карточки, но не заменяет проверку модели на вашей задаче.
| Бенчмарк | Результат | Место | Доказательство |
|---|---|---|---|
| DeepSWE | 49% | 1 из 1 | Результат разработчика |
| MLE-Bench (ML-инженерия) | 63.9% | 1 из 1 | Результат разработчика |
| OSWorld-Verified | 83% | 1 из 3 | Результат разработчика |
| GDPval-AA v2 (Elo) | 1421 | 2 из 3 | Результат разработчика |
Происхождение результатов
Значения перенесены из официального анонса Google. Сравнительные результаты зависят от указанного в публикации harness и режима модели.
Вариант: gemini-3.6-flash, production release · получено 2026-07-22
Gemini 3.6 Flash — новая производственная модель Google, выпущенная 21 июля 2026 года. В ней компания сделала ставку не на один рекордный академический балл, а на практические сценарии: работу с кодовой базой, машинное обучение, управление интерфейсами и многошаговые агентные задачи. Модель уже имеет стабильный идентификатор gemini-3.6-flash, то есть это не preview-анонс.
API принимает текст, изображения, видео, аудио и PDF, а возвращает текст. Контекстное окно составляет 1 048 576 токенов, максимальный ответ — 65 536 токенов. Поддерживаются function calling, structured output, code execution, поиск по файлам, URL context, Google Search и Maps grounding, а также Computer Use в preview-режиме.
Уровень thinking по умолчанию — medium. Это важное отличие от Lite-моделей: Flash рассчитан на задачи, где модели нужно не только быстро извлечь данные, но и спланировать несколько действий, проверить код или сопоставить визуальные элементы.
Google раскрыла четыре результата для нового релиза. Это данные разработчика, поэтому их лучше использовать для выбора короткого списка, а затем перепроверять модель на своих промптах и инструментах.
| Бенчмарк | Gemini 3.6 Flash | Gemini 3.5 Flash | Что проверяет |
|---|---|---|---|
| DeepSWE | 49,0% | 37,0% | Исправление задач в реальных репозиториях |
| MLE-Bench | 63,9% | 49,7% | Практические задачи machine learning engineering |
| OSWorld-Verified | 83,0% | 78,4% | Управление приложениями и рабочим столом |
| GDPval-AA v2 | 1421 Elo | 1349 Elo | Экономически значимые профессиональные задачи |
Отдельно Google сообщает, что в измерениях Artificial Analysis модель расходовала на 17% меньше выходных токенов, чем Gemini 3.5 Flash. Это не показатель качества, но полезная характеристика для агентных циклов, где длинные рассуждения быстро увеличивают счёт.
Базовый тариф — $1,50 за 1 млн входных и $7,50 за 1 млн выходных токенов. По сравнению с Gemini 3.5 Flash вывод подешевел, однако 3.6 Flash всё равно значительно дороже Flash-Lite. Для массовой классификации, простого JSON и маршрутизации запросов Lite обычно выгоднее; для кода, визуальных задач и агентов доплата за 3.6 Flash выглядит оправданной.
При расчёте бюджета учитывайте не только цену входа. У reasoning-модели существенную часть стоимости могут создавать выходные и служебные токены, повторные вызовы инструментов и длинная история диалога. Контекстное кэширование особенно полезно, если один большой документ или репозиторий переиспользуется в серии запросов.
Google не раскрывает число параметров и архитектурные детали, поэтому в каталоге это поле честно отмечено как «не раскрыто». Опубликованные результаты получены разработчиком и относятся к конкретным harness и настройкам. Кроме того, Computer Use пока остаётся preview-функцией: перед выдачей модели реальных прав на клики, отправку форм или изменение данных нужен отдельный слой подтверждений и ограничений.
Источники: официальный анонс Google, карточка Gemini 3.6 Flash в Gemini API.
Цены приведены за 1 млн токенов и могут меняться. Доступность российских провайдеров проверяется на их стороне.
$1.50 / $7.50 за 1M токенов
Для диаграммы пока недостаточно сопоставимых тестов.
Сервисы, инструменты, материалы и обсуждения, связанные с моделью.
Задайте вопрос сообществу — карточка модели будет прикреплена автоматически.