
От Google
Gemini 3.5 Flash-Lite — самая быстрая и бюджетная модель линейки Gemini 3.5 для массового извлечения данных, маршрутизации запросов и subagent-сценариев. Она принимает текст, изображения, видео, аудио и PDF, имеет контекст 1 048 576 токенов и вывод до 65 536 токенов. Google приводит скорость около 350 выходных токенов в секунду и заметный рост в Terminal-Bench, длинном контексте и офисных агентных задачах.
Gemini 3.5 Flash-Lite сильнее всего выглядит в категории «агенты». Индекс 25/100 рассчитан по процентильным позициям в 2 сопоставимых тестах; уверенность — средняя. Это навигационная оценка, а не замена тесту на ваших задачах.
2 сопоставимых теста · уверенность: средняя
2 сопоставимых теста · уверенность: средняя
Позиция рассчитана только среди моделей, для которых в каталоге указан результат того же теста. Это помогает сравнивать карточки, но не заменяет проверку модели на вашей задаче.
| Бенчмарк | Результат | Место | Доказательство |
|---|---|---|---|
| Terminal-Bench 2.1 | 54% | 7 из 7 | Результат разработчика |
| GDM-MRCR v2 (Длинный контекст) | 72.2% | 1 из 1 | Результат разработчика |
| GDPval-AA v2 (Elo) | 1140 | 3 из 3 | Результат разработчика |
| SWE Bench Pro | 54.2% | 7 из 7 | Результат разработчика |
| OSWorld-Verified | 74% | 2 из 3 | Результат разработчика |
Происхождение результатов
Google сравнивает отдельные тесты с разными базовыми моделями; эти значения нельзя усреднять в единый балл.
Вариант: gemini-3.5-flash-lite, production release · получено 2026-07-22
Gemini 3.5 Flash-Lite вышла 21 июля 2026 года одновременно с Gemini 3.6 Flash. Важно не перепутать название: официальная бюджетная модель называется именно 3.5 Flash-Lite, а не «3.6 Lite». Это стабильный production-релиз с идентификатором gemini-3.5-flash-lite.
Google позиционирует модель для высокой пропускной способности: извлечения полей из документов, классификации, преобразования данных в JSON, фоновых subagent-задач и других сценариев, где важны скорость и цена. По данным Artificial Analysis, приведённым Google, скорость достигает примерно 350 выходных токенов в секунду.
Модель принимает текст, изображения, видео, аудио и PDF. Контекст — 1 048 576 токенов, максимальный вывод — 65 536 токенов. Уровень thinking по умолчанию установлен в minimal, что снижает задержку и лишние расходы на простых запросах.
| Бенчмарк | Gemini 3.5 Flash-Lite | База сравнения | Что изменилось |
|---|---|---|---|
| Terminal-Bench 2.1 | 54,0% | 31,0% у Gemini 3.1 Flash-Lite | Сильнее в терминальных агентных задачах |
| GDM-MRCR v2 | 72,2% | 60,1% у Gemini 3.1 Flash-Lite | Лучше удерживает сведения в длинном контексте |
| GDPval-AA v2 | 1140 Elo | 642 Elo у Gemini 3.1 Flash-Lite | Выше качество прикладной knowledge work |
| SWE-Bench Pro | 54,2% | 49,6% у Gemini 3 Flash | Лучше решает сложные задачи в репозиториях |
| OSWorld-Verified | 74,0% | 65,1% у Gemini 3 Flash | Лучше выполняет действия в desktop-среде |
Это результаты разработчика, причём для разных строк используются разные базовые модели. Их нельзя усреднять в один «общий процент». В каталоге каждый показатель хранится отдельно, а отсутствующие MMLU, HumanEval и MATH отмечены вопросительным знаком, а не придуманной оценкой.
API стоит $0,30 за 1 млн входных и $2,50 за 1 млн выходных токенов. Разница с Gemini 3.6 Flash составляет пять раз по входу и три раза по выходу. На миллионах коротких запросов это важнее небольшого преимущества флагмана в сложном reasoning.
Практичная схема — маршрутизировать простое извлечение, модерацию, суммаризацию и преобразование форматов в Flash-Lite, а запросы с кодом, неоднозначным визуальным контекстом или длинным планированием повышать до 3.6 Flash.
Карточка модели подтверждает caching, code execution, file search, function calling, Google Search grounding, structured output, thinking и URL context. На дату проверки model-specific документация указывает, что Computer Use не поддерживается, хотя обзор новых моделей описывает общий набор агентных возможностей семейства. Для продакшена мы опираемся на более конкретную карточку модели и не отмечаем Computer Use как гарантированную функцию Flash-Lite.
Плюсы:
Минусы:
minimal хуже подходит для наиболее сложной логики;Источники: официальный анонс Google, карточка Gemini 3.5 Flash-Lite.
Цены приведены за 1 млн токенов и могут меняться. Доступность российских провайдеров проверяется на их стороне.
$0.30 / $2.50 за 1M токенов
Сервисы, инструменты, материалы и обсуждения, связанные с моделью.
Задайте вопрос сообществу — карточка модели будет прикреплена автоматически.