Текущая2026-08-13

От Google
Стабильная мультимодальная модель Google для кода, агентных сценариев и многошаговых задач через Gemini API. Принимает текст, изображения, видео, аудио и PDF в контексте до 1 048 576 токенов, а возвращает текст длиной до 65 536 токенов. Поддерживает function calling, structured outputs, выполнение кода, поиск, работу с файлами и управляемые уровни thinking.
Для Gemini 3.7 Flash пока нет совпавших результатов в подключённых публичных лидербордах. Исходные значения карточки не используются для G‑Score.
Показатели G‑Код, G‑Рассуждения, G‑Агенты и G‑Зрение рассчитаны по массовым таблицам LiveBench, Artificial Analysis и LMArena. Наведите или нажмите на значок рядом с оценкой, чтобы увидеть исходный лидерборд, вариант модели, значение и размер выборки.
Уверенность данных
низкая
Покрытие
0 тестов · 0 направлений
Происхождение
нет данных лидербордов
Место исходного бенчмарка показывается только при закреплённом source record и среди других карточек с источником. Эти старые значения не участвуют в G-Score лидербордов.
| Бенчмарк | Результат | Место | Доказательство |
|---|---|---|---|
| FrontierCode | 43.6% | н/д | Источник не указан |
| DeepSWE 1.1 | 65.3% | н/д | Источник не указан |
| Terminal-Bench 2.1 | 85.8% | н/д | Источник не указан |
| Automation Bench | 30.4% | н/д | Источник не указан |
Gemini 3.7 Flash — стабильная проприетарная модель Google для программирования, агентных сценариев и многошаговых задач. Она вышла 13 августа 2026 года, доступна в Gemini API под идентификатором gemini-3.7-flash, принимает текст, изображения, видео, аудио и PDF, а возвращает только текст. До 31 декабря 2026 года Google установила вводную цену платного API: $0,75 за 1 млн входных и $3,75 за 1 млн выходных токенов.
Google выпустила Gemini 3.7 Flash как GA-модель, то есть стабильную версию для производственных интеграций, а не preview. Это отдельный релиз, появившийся через три недели после Gemini 3.6 Flash, а не переименование прежнего API-эндпоинта: новая модель использует ID gemini-3.7-flash.
По опубликованным Google результатам 3.7 Flash получила 43,6% против 34,4% у 3.6 Flash в FrontierCode 1.1 Main, 85,8% против 78,0% в Terminal-bench 2.1 и 30,4% против 17,0% на закрытом наборе AutomationBench. Это сравнение показывает разницу в конкретных тестах Google, но не гарантирует такой же прирост на любом проекте. До конца 2026 года для обеих моделей действует одинаковая вводная цена.
Google описывает 3.7 Flash как рабочую модель для кода и агентов. Такое позиционирование подтверждается набором доступных инструментов, но не означает гарантированного результата в любом проекте. Архитектуру и количество параметров компания не раскрывает. Открытые веса для локального развёртывания в официальных материалах не заявлены.
Модель принимает до 1 048 576 входных токенов и генерирует до 65 536 выходных токенов. Большое окно контекста позволяет передавать объёмные репозитории, документы и мультимедийные материалы, однако само по себе не гарантирует точного использования каждой детали длинного запроса.
На вход можно подавать:
Результат этого API-эндпоинта — только текст. Gemini 3.7 Flash не генерирует изображения или аудио и не поддерживает Live API, поэтому для потокового голосового диалога либо медиагенерации потребуется другая модель или отдельный сервис.
Gemini 3.7 Flash поддерживает уровни рассуждения low, medium и high; по умолчанию используется medium. Уровень влияет на баланс качества, задержки и расхода выходных токенов. Значение minimal для этой модели не поддерживается и приводит к ошибке запроса.
В Gemini API для модели заявлены:
Этот набор подходит для агентов, которые вызывают функции, ищут данные, работают с файлами и возвращают структурированный ответ. Computer Use остаётся предварительной возможностью, поэтому его не следует считать таким же стабильным компонентом, как GA-статус самой модели.
До 31 декабря 2026 года на платном уровне действует вводная ставка: $0,75 за 1 млн входных токенов и $3,75 за 1 млн выходных токенов. В выходную стоимость входят thinking tokens. С 1 января 2027 года заявлены ставки $1,50 за вход и $7,50 за выход. После окончания промопериода цену стоит проверить заново в документации Google.
Контекстный кэш оплачивается отдельно. До конца 2026 года чтение 1 млн кэшированных токенов стоит $0,075, а хранение — $0,50 за 1 млн токен-часов. С 1 января 2027 года ставки должны вырасти до $0,15 и $1,00 соответственно. Поэтому экономия зависит не только от доли повторно используемого контекста, но и от времени его хранения.
Batch API рассчитан на объёмные задачи без требования к немедленному ответу. Он работает асинхронно, имеет целевой срок выполнения до 24 часов и стоит 50% от стандартного интерактивного API. Из вводной ставки следуют $0,375 за 1 млн входных и $1,875 за 1 млн выходных токенов до 31 декабря 2026 года. При попадании в кэш внутри Batch применяются стандартные ставки context caching, а не дополнительная скидка на кэш.
На платном уровне первые 5 000 запросов Google Search в месяц, общие для моделей Gemini 3.x, бесплатны, затем Google указывает $14 за 1 000 запросов. Для Google Maps первые 5 000 prompts в месяц бесплатны, после чего действует цена $14 за 1 000 поисковых запросов Maps. Эти единицы тарификации различаются, поэтому расходы на grounding нужно считать отдельно от токенов.
Google также указывает бесплатный уровень, но не фиксирует его как безлимитный или постоянный. Запросы free tier могут использоваться для улучшения продуктов Google; для paid tier компания указывает обратное.
Кроме сравнительных результатов с Gemini 3.6 Flash, Google приводит для Gemini 3.7 Flash ещё две профильные метрики: DeepSWE v1.1 — 65,3%, HLE-Verified — 53,6%. Все показатели опубликованы разработчиком для конкретных конфигураций тестирования. Они помогают оценить профиль модели, но не заменяют пробный запуск на собственном коде, инструментах и типичных запросах команды.
Gemini 3.7 Flash подходит, когда нужны мультимодальный ввод, длинный контекст, вызов функций и управляемая глубина рассуждения через облачный API. Для фоновой обработки больших массивов данных можно использовать Batch, а для повторяющихся длинных префиксов — context caching.
Перед производственным запуском следует учесть четыре ограничения. Модель может галлюцинировать, а сложные запросы могут выполняться медленно или завершаться по тайм-ауту. Основная граница знаний указана как март 2026 года, но по отдельным областям сведения могут быть ограничены январём 2025 года. Модель не выдаёт изображения и аудио, не работает через Live API, а открытые веса для локального запуска Google не публиковала. Для актуальных или критичных фактов нужен внешний источник и проверка результата, даже если используется Search grounding.
Цены приведены за 1 млн токенов и могут меняться. Доступность российских провайдеров проверяется на их стороне.
$0.75 / $3.75 за 1M токенов на paid tier до 31.12.2026; $1.50 / $7.50 с 01.01.2027. Кэш, хранение, Batch и grounding оплачиваются по отдельным правилам.
Рассчитать сценарий →Для диаграммы пока недостаточно сопоставимых тестов.
История семейства
Последовательность собрана по датам релиза моделей Google в каталоге. Она показывает соседние поколения, но не приписывает им совместимость или наследование архитектуры без отдельного источника.
Сервисы, инструменты, материалы и обсуждения, связанные с моделью.
Откройте результаты по названию модели и проверьте актуальную интеграцию.
Задайте вопрос сообществу — карточка модели будет прикреплена автоматически.