Текущая2026-07-21

От Google
Gemini 3.5 Flash-Lite — самая быстрая и бюджетная модель линейки Gemini 3.5 для массового извлечения данных, маршрутизации запросов и subagent-сценариев. Она принимает текст, изображения, видео, аудио и PDF, имеет контекст 1 048 576 токенов и вывод до 65 536 токенов. Google приводит скорость около 350 выходных токенов в секунду и заметный рост в Terminal-Bench, длинном контексте и офисных агентных задачах.
Gemini 3.5 Flash-Lite сильнее всего выглядит в категории «зрение». Профиль рассчитан по процентилям LiveBench, Artificial Analysis и LMArena; пропуски не считаются нулём.
Показатели G‑Код, G‑Рассуждения, G‑Агенты и G‑Зрение рассчитаны по массовым таблицам LiveBench, Artificial Analysis и LMArena. Наведите или нажмите на значок рядом с оценкой, чтобы увидеть исходный лидерборд, вариант модели, значение и размер выборки.
Уверенность данных
высокая
Покрытие
10 тестов · 9 направлений
Происхождение
livebench + artificialAnalysis + lmarenaVision
1 тест · уверенность: средняя
1 тест · уверенность: низкая
2 теста · уверенность: средняя
1 тест · уверенность: низкая
1 тест · уверенность: низкая
1 тест · уверенность: низкая
1 тест · уверенность: низкая
1 тест · уверенность: низкая
1 тест · уверенность: низкая
Место исходного бенчмарка показывается только при закреплённом source record и среди других карточек с источником. Эти старые значения не участвуют в G-Score лидербордов.
| Бенчмарк | Результат | Место | Доказательство |
|---|---|---|---|
| GDM-MRCR v2 (Длинный контекст) | 72.2% | 1 из 1 | Результат разработчика |
| SWE Bench Pro | 54.2% | 7 из 8 | Результат разработчика |
| Terminal-Bench 2.1 | 54% | 2 из 2 | Результат разработчика |
| GDPval-AA v2 (Elo) | 1140 | 8 из 8 | Результат разработчика |
| OSWorld-Verified | 74% | 2 из 3 | Результат разработчика |
Происхождение результатов
Google сравнивает отдельные тесты с разными базовыми моделями; эти значения нельзя усреднять в единый балл.
Вариант: gemini-3.5-flash-lite, production release · получено 2026-07-22
Gemini 3.5 Flash-Lite вышла 21 июля 2026 года одновременно с Gemini 3.6 Flash. Важно не перепутать название: официальная бюджетная модель называется именно 3.5 Flash-Lite, а не «3.6 Lite». Это стабильный production-релиз с идентификатором gemini-3.5-flash-lite.
Google позиционирует модель для высокой пропускной способности: извлечения полей из документов, классификации, преобразования данных в JSON, фоновых subagent-задач и других сценариев, где важны скорость и цена. По данным Artificial Analysis, приведённым Google, скорость достигает примерно 350 выходных токенов в секунду.
Модель принимает текст, изображения, видео, аудио и PDF. Контекст — 1 048 576 токенов, максимальный вывод — 65 536 токенов. Уровень thinking по умолчанию установлен в minimal, что снижает задержку и лишние расходы на простых запросах.
| Бенчмарк | Gemini 3.5 Flash-Lite | База сравнения | Что изменилось |
|---|---|---|---|
| Terminal-Bench 2.1 | 54,0% | 31,0% у Gemini 3.1 Flash-Lite | Сильнее в терминальных агентных задачах |
| GDM-MRCR v2 | 72,2% | 60,1% у Gemini 3.1 Flash-Lite | Лучше удерживает сведения в длинном контексте |
| GDPval-AA v2 | 1140 Elo | 642 Elo у Gemini 3.1 Flash-Lite | Выше качество прикладной knowledge work |
| SWE-Bench Pro | 54,2% | 49,6% у Gemini 3 Flash | Лучше решает сложные задачи в репозиториях |
| OSWorld-Verified | 74,0% | 65,1% у Gemini 3 Flash | Лучше выполняет действия в desktop-среде |
Это результаты разработчика, причём для разных строк используются разные базовые модели. Их нельзя усреднять в один «общий процент». В каталоге каждый показатель хранится отдельно, а отсутствующие MMLU, HumanEval и MATH отмечены вопросительным знаком, а не придуманной оценкой.
API стоит $0,30 за 1 млн входных и $2,50 за 1 млн выходных токенов. Разница с Gemini 3.6 Flash составляет пять раз по входу и три раза по выходу. На миллионах коротких запросов это важнее небольшого преимущества флагмана в сложном reasoning.
Практичная схема — маршрутизировать простое извлечение, модерацию, суммаризацию и преобразование форматов в Flash-Lite, а запросы с кодом, неоднозначным визуальным контекстом или длинным планированием повышать до 3.6 Flash.
Карточка модели подтверждает caching, code execution, file search, function calling, Google Search grounding, structured output, thinking и URL context. На дату проверки model-specific документация указывает, что Computer Use не поддерживается, хотя обзор новых моделей описывает общий набор агентных возможностей семейства. Для продакшена мы опираемся на более конкретную карточку модели и не отмечаем Computer Use как гарантированную функцию Flash-Lite.
Плюсы:
Минусы:
minimal хуже подходит для наиболее сложной логики;Источники: официальный анонс Google, карточка Gemini 3.5 Flash-Lite.
Цены приведены за 1 млн токенов и могут меняться. Доступность российских провайдеров проверяется на их стороне.
История семейства
Последовательность собрана по датам релиза моделей Google в каталоге. Она показывает соседние поколения, но не приписывает им совместимость или наследование архитектуры без отдельного источника.
Сервисы, инструменты, материалы и обсуждения, связанные с моделью.
Задайте вопрос сообществу — карточка модели будет прикреплена автоматически.