К списку моделей
Логотип DeepSeek, разработчика DeepSeek V4 Flash

DeepSeek V4 Flash

G-Score49/100высокая#23 из 37Методология G-Score

От DeepSeek

Open Source
FAMDeepSeek
CTX1M
PAR304B
Релиз: 2026-07-31
FlashAgenticCodeOpen-SourceReasoning

Краткое описание

DeepSeek V4 Flash — открытая модель для API, кода и агентных задач. Актуальная на 9 сентября версия DeepSeek-V4-Flash-0731 поддерживает контекст 1 млн токенов, thinking и non-thinking, JSON Output, инструменты, Responses API и Anthropic API. DeepSeek планирует выпустить V4.1 Flash около 10 сентября и изменить цены с 04:00 UTC; до релиза карточка не выдаёт V4.1 за уже доступную версию.

G-Score и профиль

G-Score49/100высокая#23 из 37Методология G-Score

DeepSeek V4 Flash сильнее всего выглядит в категориях «работа с данными и общее качество». Профиль рассчитан по процентилям LiveBench, Artificial Analysis и LMArena; пропуски не считаются нулём.

Показатели G‑Код, G‑Рассуждения, G‑Агенты и G‑Зрение рассчитаны по массовым таблицам LiveBench, Artificial Analysis и LMArena. Наведите или нажмите на значок рядом с оценкой, чтобы увидеть исходный лидерборд, вариант модели, значение и размер выборки.

Уверенность данных

высокая

Покрытие

9 тестов · 8 направлений

Происхождение

livebench + artificialAnalysis

G‑Работа с данными86/100

1 тест · уверенность: низкая

G‑Общее качество66/100

2 теста · уверенность: средняя

G‑Рассуждения59/100

1 тест · уверенность: низкая

G‑Следование инструкциям45/100

1 тест · уверенность: низкая

G‑Язык45/100

1 тест · уверенность: низкая

G‑Агенты40/100

1 тест · уверенность: низкая

G‑Математика34/100

1 тест · уверенность: низкая

G‑Код28/100

1 тест · уверенность: низкая

Как рассчитан профиль →

Место модели в каталоге

Место исходного бенчмарка показывается только при закреплённом source record и среди других карточек с источником. Эти старые значения не участвуют в G-Score лидербордов.

БенчмаркРезультатМестоДоказательство
DeepSWE54.4%4 из 5Результат разработчика
NL2Repo54.2%5 из 8Результат разработчика
Terminal-Bench 2.182.7%8 из 9Результат разработчика
Toolathlon Verified70.3%8 из 8Результат разработчика
AutomationBench Public25.1%3 из 3Результат разработчика

Происхождение результатов

31 июля 2026 года версия 0731 заменила preview под тем же API-именем deepseek-v4-flash. Только публичные code-agent тесты запускались при max effort, temperature 1.0, top_p 0.95 и DeepSeek Harness minimal mode. Terminal-Bench здесь версии 2.1; его нельзя напрямую сравнивать с Terminal-Bench 2.0 из таблицы V4 Pro.

Вариант: DeepSeek-V4-Flash-0731, max effort, DeepSeek Harness minimal mode · получено 2026-08-08

Подробный обзор модели

DeepSeek V4 Flash — открытая модель для API, агентных сценариев и работы с кодом. Актуальная версия DeepSeek-V4-Flash-0731 принимает до 1 млн токенов контекста, возвращает до 384 тысяч токенов и доступна по прежнему API-имени deepseek-v4-flash. На 21 августа 2026 года DeepSeek по-прежнему указывает для неё статус public beta, а не GA.

Обновление от 31 июля 2026 года: DeepSeek выпустила DeepSeek-V4-Flash-0731 в публичной бете и заменила ею preview-версию. Имя модели в API не изменилось — deepseek-v4-flash.

Анонс от 9 сентября 2026 года: DeepSeek планирует выпустить V4.1 Flash около 10 сентября. Новые цены вступят в силу 10 сентября в 04:00 UTC. До фактического релиза текущей API-версией в этой карточке остаётся Flash-0731.

Что умеет DeepSeek V4 Flash

Модель работает в режимах thinking и non-thinking. Thinking включён по умолчанию с уровнем effort high; также доступны low и max. Flash поддерживает JSON Output, вызов инструментов, Responses API, Anthropic API и префиксное продолжение чата в бета-режиме. FIM Completion работает только при отключённом thinking.

Контекстное окно составляет 1 млн токенов, максимальный вывод — 384 тысячи. Лимит параллельности в API равен 2500: это предел одновременных запросов, а не гарантированная скорость или количество токенов в секунду.

В thinking-режиме параметры temperature, top_p, presence_penalty и frequency_penalty игнорируются. При использовании инструментов клиент должен вернуть reasoning_content вместе с результатом вызова в следующем запросе, иначе API отвечает ошибкой 400.

Цена DeepSeek V4 Flash

До 10 сентября 2026 года, 04:00 UTC, действует тариф, введённый 16 августа. С указанного момента DeepSeek снижает все три ставки Flash. Стоимость зависит от времени запроса и от попадания входных данных в кэш; суммы указаны за 1 млн токенов.

ОперацияДо 10.09, off-peakС 10.09, off-peakДо 10.09, peakС 10.09, peak
Ввод, cache hit$0.007$0.003$0.014$0.006
Ввод, cache miss$0.22$0.15$0.44$0.30
Вывод$0.66$0.60$1.32$1.20

Вход из кэша дешевеет примерно на 57%, вход без кэша — на 32%, вывод — на 9%. Peak действует с 01:00 до 04:00 и с 06:00 до 10:00 UTC с понедельника по пятницу; всё остальное время считается off-peak. Числовые поля калькулятора переключаются только после вступления тарифа в силу, поэтому до 04:00 UTC 10 сентября базовыми остаются $0.22 за некэшированный ввод и $0.66 за вывод.

Новые условия получены из официального уведомления DeepSeek API пользователям. На момент проверки 9 сентября публичная страница цен ещё показывала прежние ставки.

Результаты в агентных тестах

DeepSeek публикует для версии Flash-0731 следующие результаты:

ТестРезультат
Terminal Bench 2.182.7
NL2Repo54.2
CyberGym76.7
DeepSWE54.4
Toolathlon-Verified70.3
Agents' Last Exam25.2
AutomationBench Public25.1

Это данные разработчика, а не независимое сравнение. Для публичных тестов code-agent компания использовала DeepSeek Harness в minimal mode, effort max, temperature 1.0 и top_p 0.95. Результаты стоит сопоставлять с другими моделями только при одинаковой версии теста и близкой конфигурации агента.

Кому подходит модель

DeepSeek V4 Flash имеет смысл рассматривать для приложений, которым нужны длинный контекст, работа с инструментами и высокий лимит параллельности. Возможности модели рассчитаны на программных агентов, анализ больших репозиториев, терминальные задачи и многошаговую автоматизацию.

Для продакшена нужно учитывать статус public beta и особенности thinking-режима. Если приложение использует FIM или управляет случайностью через sampling-параметры, режим следует выбирать явно: FIM доступен только без thinking, а sampling-параметры во время рассуждения не действуют.

Открытые веса DeepSeek-V4-Flash-0731 опубликованы под лицензией MIT. В метаданных официальной страницы модели на Hugging Face указан размер 304B, но актуальная документация не раскрывает число активных параметров. Поэтому прежнее описание «284 млрд всего и 13 млрд активных» не подходит для Flash-0731.

Где запустить модель

Цены приведены за 1 млн токенов и могут меняться. Доступность российских провайдеров проверяется на их стороне.

Обновляем провайдеров и цены…

Стоимость API

С 10.09.2026 04:00 UTC: off-peak $0.003 cache hit / $0.15 cache miss / $0.60 output; peak (01:00–04:00 и 06:00–10:00 UTC) $0.006 / $0.30 / $1.20 за 1M токенов

Рассчитать сценарий →

Профиль модели

Для диаграммы пока недостаточно сопоставимых тестов.

Бенчмарки

DeepSWE54.4%
NL2Repo54.2%
Terminal-Bench 2.182.7%
Toolathlon Verified70.3%
AutomationBench Public25.1%

История семейства

Линейка DeepSeek

Последовательность собрана по датам релиза моделей DeepSeek в каталоге. Она показывает соседние поколения, но не приписывает им совместимость или наследование архитектуры без отдельного источника.

Экосистема DeepSeek V4 Flash

Сервисы, инструменты, материалы и обсуждения, связанные с моделью.

Обсуждения о DeepSeek V4 Flash

Задайте вопрос сообществу — карточка модели будет прикреплена автоматически.

Создать обсуждение