Текущая2026-07-31

От DeepSeek
DeepSeek V4 Flash — открытая модель для API, кода и агентных задач. Актуальная на 9 сентября версия DeepSeek-V4-Flash-0731 поддерживает контекст 1 млн токенов, thinking и non-thinking, JSON Output, инструменты, Responses API и Anthropic API. DeepSeek планирует выпустить V4.1 Flash около 10 сентября и изменить цены с 04:00 UTC; до релиза карточка не выдаёт V4.1 за уже доступную версию.
DeepSeek V4 Flash сильнее всего выглядит в категориях «работа с данными и общее качество». Профиль рассчитан по процентилям LiveBench, Artificial Analysis и LMArena; пропуски не считаются нулём.
Показатели G‑Код, G‑Рассуждения, G‑Агенты и G‑Зрение рассчитаны по массовым таблицам LiveBench, Artificial Analysis и LMArena. Наведите или нажмите на значок рядом с оценкой, чтобы увидеть исходный лидерборд, вариант модели, значение и размер выборки.
Уверенность данных
высокая
Покрытие
9 тестов · 8 направлений
Происхождение
livebench + artificialAnalysis
1 тест · уверенность: низкая
2 теста · уверенность: средняя
1 тест · уверенность: низкая
1 тест · уверенность: низкая
1 тест · уверенность: низкая
1 тест · уверенность: низкая
1 тест · уверенность: низкая
1 тест · уверенность: низкая
Место исходного бенчмарка показывается только при закреплённом source record и среди других карточек с источником. Эти старые значения не участвуют в G-Score лидербордов.
| Бенчмарк | Результат | Место | Доказательство |
|---|---|---|---|
| DeepSWE | 54.4% | 4 из 5 | Результат разработчика |
| NL2Repo | 54.2% | 5 из 8 | Результат разработчика |
| Terminal-Bench 2.1 | 82.7% | 8 из 9 | Результат разработчика |
| Toolathlon Verified | 70.3% | 8 из 8 | Результат разработчика |
| AutomationBench Public | 25.1% | 3 из 3 | Результат разработчика |
Происхождение результатов
31 июля 2026 года версия 0731 заменила preview под тем же API-именем deepseek-v4-flash. Только публичные code-agent тесты запускались при max effort, temperature 1.0, top_p 0.95 и DeepSeek Harness minimal mode. Terminal-Bench здесь версии 2.1; его нельзя напрямую сравнивать с Terminal-Bench 2.0 из таблицы V4 Pro.
Вариант: DeepSeek-V4-Flash-0731, max effort, DeepSeek Harness minimal mode · получено 2026-08-08
DeepSeek V4 Flash — открытая модель для API, агентных сценариев и работы с кодом. Актуальная версия DeepSeek-V4-Flash-0731 принимает до 1 млн токенов контекста, возвращает до 384 тысяч токенов и доступна по прежнему API-имени deepseek-v4-flash. На 21 августа 2026 года DeepSeek по-прежнему указывает для неё статус public beta, а не GA.
Обновление от 31 июля 2026 года: DeepSeek выпустила
DeepSeek-V4-Flash-0731в публичной бете и заменила ею preview-версию. Имя модели в API не изменилось —deepseek-v4-flash.
Анонс от 9 сентября 2026 года: DeepSeek планирует выпустить V4.1 Flash около 10 сентября. Новые цены вступят в силу 10 сентября в 04:00 UTC. До фактического релиза текущей API-версией в этой карточке остаётся Flash-0731.
Модель работает в режимах thinking и non-thinking. Thinking включён по умолчанию с уровнем effort high; также доступны low и max. Flash поддерживает JSON Output, вызов инструментов, Responses API, Anthropic API и префиксное продолжение чата в бета-режиме. FIM Completion работает только при отключённом thinking.
Контекстное окно составляет 1 млн токенов, максимальный вывод — 384 тысячи. Лимит параллельности в API равен 2500: это предел одновременных запросов, а не гарантированная скорость или количество токенов в секунду.
В thinking-режиме параметры temperature, top_p, presence_penalty и frequency_penalty игнорируются. При использовании инструментов клиент должен вернуть reasoning_content вместе с результатом вызова в следующем запросе, иначе API отвечает ошибкой 400.
До 10 сентября 2026 года, 04:00 UTC, действует тариф, введённый 16 августа. С указанного момента DeepSeek снижает все три ставки Flash. Стоимость зависит от времени запроса и от попадания входных данных в кэш; суммы указаны за 1 млн токенов.
| Операция | До 10.09, off-peak | С 10.09, off-peak | До 10.09, peak | С 10.09, peak |
|---|---|---|---|---|
| Ввод, cache hit | $0.007 | $0.003 | $0.014 | $0.006 |
| Ввод, cache miss | $0.22 | $0.15 | $0.44 | $0.30 |
| Вывод | $0.66 | $0.60 | $1.32 | $1.20 |
Вход из кэша дешевеет примерно на 57%, вход без кэша — на 32%, вывод — на 9%. Peak действует с 01:00 до 04:00 и с 06:00 до 10:00 UTC с понедельника по пятницу; всё остальное время считается off-peak. Числовые поля калькулятора переключаются только после вступления тарифа в силу, поэтому до 04:00 UTC 10 сентября базовыми остаются $0.22 за некэшированный ввод и $0.66 за вывод.
Новые условия получены из официального уведомления DeepSeek API пользователям. На момент проверки 9 сентября публичная страница цен ещё показывала прежние ставки.
DeepSeek публикует для версии Flash-0731 следующие результаты:
| Тест | Результат |
|---|---|
| Terminal Bench 2.1 | 82.7 |
| NL2Repo | 54.2 |
| CyberGym | 76.7 |
| DeepSWE | 54.4 |
| Toolathlon-Verified | 70.3 |
| Agents' Last Exam | 25.2 |
| AutomationBench Public | 25.1 |
Это данные разработчика, а не независимое сравнение. Для публичных тестов code-agent компания использовала DeepSeek Harness в minimal mode, effort max, temperature 1.0 и top_p 0.95. Результаты стоит сопоставлять с другими моделями только при одинаковой версии теста и близкой конфигурации агента.
DeepSeek V4 Flash имеет смысл рассматривать для приложений, которым нужны длинный контекст, работа с инструментами и высокий лимит параллельности. Возможности модели рассчитаны на программных агентов, анализ больших репозиториев, терминальные задачи и многошаговую автоматизацию.
Для продакшена нужно учитывать статус public beta и особенности thinking-режима. Если приложение использует FIM или управляет случайностью через sampling-параметры, режим следует выбирать явно: FIM доступен только без thinking, а sampling-параметры во время рассуждения не действуют.
Открытые веса DeepSeek-V4-Flash-0731 опубликованы под лицензией MIT. В метаданных официальной страницы модели на Hugging Face указан размер 304B, но актуальная документация не раскрывает число активных параметров. Поэтому прежнее описание «284 млрд всего и 13 млрд активных» не подходит для Flash-0731.
Цены приведены за 1 млн токенов и могут меняться. Доступность российских провайдеров проверяется на их стороне.
С 10.09.2026 04:00 UTC: off-peak $0.003 cache hit / $0.15 cache miss / $0.60 output; peak (01:00–04:00 и 06:00–10:00 UTC) $0.006 / $0.30 / $1.20 за 1M токенов
Рассчитать сценарий →Для диаграммы пока недостаточно сопоставимых тестов.
История семейства
Последовательность собрана по датам релиза моделей DeepSeek в каталоге. Она показывает соседние поколения, но не приписывает им совместимость или наследование архитектуры без отдельного источника.
Сервисы, инструменты, материалы и обсуждения, связанные с моделью.
Задайте вопрос сообществу — карточка модели будет прикреплена автоматически.