Текущая2025-07-22

От Google
Gemini 2.5 Flash Lite — это самая доступная и быстрая модель в семействе Gemini 2.5. Она сочетает в себе контекстное окно в 1 млн токенов, высокую скорость генерации и минимальную стоимость, что делает её идеальной для агентских систем и обработки больших массивов данных.
Для Gemini 2.5 Flash Lite пока нет совпавших результатов в подключённых публичных лидербордах. Исходные значения карточки не используются для G‑Score.
Показатели G‑Код, G‑Рассуждения, G‑Агенты и G‑Зрение рассчитаны по массовым таблицам LiveBench, Artificial Analysis и LMArena. Наведите или нажмите на значок рядом с оценкой, чтобы увидеть исходный лидерборд, вариант модели, значение и размер выборки.
Уверенность данных
низкая
Покрытие
0 тестов · 0 направлений
Происхождение
нет данных лидербордов
Место исходного бенчмарка показывается только при закреплённом source record и среди других карточек с источником. Эти старые значения не участвуют в G-Score лидербордов.
| Бенчмарк | Результат | Место | Доказательство |
|---|---|---|---|
| GPQA (Экспертные знания) | 63.9% | н/д | Источник не указан |
| MATH (Математика) | 71.5% | н/д | Источник не указан |
| MMLU (Общие знания) | 84.1% | н/д | Источник не указан |
| Arena Elo (LMSYS) | 1389 | н/д | Источник не указан |
| HumanEval (Кодинг) | 92.4% | н/д | Источник не указан |
| SWE-bench (Разработка) | 64.4% | н/д | Источник не указан |
Gemini 2.5 Flash Lite — это самая доступная и быстрая модель в семействе Gemini 2.5 от Google DeepMind, представленная 22 июля 2025 года. Она спроектирована специально для рабочих процессов с высокой частотой запросов и чувствительностью к задержкам. Модель занимает нишу между базовыми легковесными решениями и мощными флагманами, предлагая уникальное сочетание огромного контекстного окна и минимальной стоимости эксплуатации.
Flash Lite построена на оптимизированной архитектуре, которая позволяет достигать субсекундного времени отклика (в среднем около 0.44с). Главной технической особенностью является поддержка контекстного окна объемом 1 миллион токенов. Это позволяет модели анализировать огромные массивы данных — от целых библиотек документации до часовых видеороликов — без потери контекста.
Модель является мультимодальной на входе: она нативно понимает текст, изображения, аудио и видео. На выходе Flash Lite генерирует только текст, но делает это с невероятной скоростью. Еще одно важное нововведение — встроенный режим Reasoning (Thinking), который можно активировать для решения более сложных логических задач, требующих глубокого анализа.
Несмотря на статус облегченной модели, Gemini 2.5 Flash Lite демонстрирует впечатляющие результаты в синтетических тестах, обходя многие более тяжелые модели предыдущих поколений.
Google позиционирует Flash Lite как наиболее выгодное решение для бизнеса и разработчиков. Ценовая политика агрессивна и направлена на вытеснение конкурентов в сегменте малых моделей:
Такая стоимость делает модель в разы дешевле, чем Claude 3 Haiku или GPT-4o mini, при сохранении конкурентоспособной точности. Модель доступна через Google AI Studio и Vertex AI, а также поддерживает функции Function Calling, Structured Output и интеграцию с Google Search для проверки фактов.
Благодаря своей скорости и дешевизне, Gemini 2.5 Flash Lite идеально подходит для следующих задач:
Плюсы:
Минусы:
Цены приведены за 1 млн токенов и могут меняться. Доступность российских провайдеров проверяется на их стороне.
История семейства
Последовательность собрана по датам релиза моделей Google в каталоге. Она показывает соседние поколения, но не приписывает им совместимость или наследование архитектуры без отдельного источника.

2025-06-05

2025-06-17

2025-06-17
Текущая2025-07-22

2025-09-25

2025-10-07

2025-11-20
Сервисы, инструменты, материалы и обсуждения, связанные с моделью.
Откройте результаты по названию модели и проверьте актуальную интеграцию.
Задайте вопрос сообществу — карточка модели будет прикреплена автоматически.