DeepSeek V4.1 Flash vs V4 Flash и V4 Pro: цены и бенчмарки
Нейросети / ИИ

DeepSeek V4.1 Flash vs V4 Flash и V4 Pro: цены и бенчмарки

Сравниваем цены и официальные бенчмарки DeepSeek V4.1 Flash, V4 Flash 0731 и V4 Pro 0813 без неподтверждённых цифр.

Анастасия Петрова
Анастасия Петрова
Контент-менеджер AI-раздела4 мин

DeepSeek V4.1 Flash вышла с более низким тарифом, чем действовал у V4 Flash 0731, и, по заявлению разработчика, превзошла V4 Pro. Но численные бенчмарки новой модели пока не опубликованы: по подтверждённым результатам сравнить напрямую можно только V4 Flash 0731 и V4 Pro 0813.

Главные различия трёх моделей

КритерийV4 Flash 0731V4.1 FlashV4 Pro 0813
Дата версии31 июля 202610 сентября 202613 августа 2026
Публичная таблица бенчмарковЕстьПока нетЕсть
Контекст1 млн токеновНе раскрыт в уведомлении1 млн токенов
Открытые весаОпубликованы, MITНе объявленыОпубликованы, MIT
РольПредыдущее быстрое поколениеНовая дешёвая API-модельСильнейший из двух версий с опубликованными результатами
Что будет с APIОтдельная версия 0731Новый тариф действует с 10 сентябряС 14 сентября запросы к Pro планируется направлять на V4.1 Flash

Карточки моделей: DeepSeek V4 Flash, DeepSeek V4.1 Flash и DeepSeek V4 Pro. Важно не смешивать API-маршрутизацию с самими весами: локально развёрнутый checkpoint V4 Pro 0813 не превращается в V4.1 Flash.

Сравнение цен DeepSeek V4.1 Flash, V4 Flash и V4 Pro

Для V4 Flash 0731 ниже показан последний отдельный тариф до 10 сентября, для V4.1 Flash — новый тариф с 10 сентября, а для V4 Pro — тариф до переключения 14 сентября. Все суммы указаны за 1 млн токенов.

ОперацияV4 Flash 0731V4.1 FlashV4 Pro 0813
Off-peak, cache hit$0.007$0.003$0.022
Off-peak, cache miss$0.22$0.15$0.66
Off-peak, вывод$0.66$0.60$1.98
Peak, cache hit$0.014$0.006$0.044
Peak, cache miss$0.44$0.30$1.32
Peak, вывод$1.32$1.20$3.96

Относительно прежнего V4 Flash новая V4.1 Flash дешевле примерно на 57% при cache hit, на 32% при cache miss и на 9% по выходным токенам. По сравнению с тарифом V4 Pro экономия составляет около 86%, 77% и 70% соответственно. Проценты одинаковы для peak и off-peak, поскольку в часы пик все ставки удваиваются.

Peak действует по будням с 01:00 до 04:00 и с 06:00 до 10:00 UTC. После запланированного переключения Pro 14 сентября обращения к этому API-маршруту будут обслуживаться V4.1 Flash и тарифицироваться по цене Flash. Подробности изменения собраны в новости о релизе V4.1 Flash.

Сравнение официальных бенчмарков

DeepSeek опубликовала сопоставимые результаты для V4 Flash 0731 и V4 Pro 0813. Для V4.1 Flash компания сообщила о превосходстве над Pro по качеству, стоимости, скорости и общему времени выполнения задач, но не привела чисел и методики. Поэтому вместо оценочных значений в таблице стоят прочерки.

ТестV4 Flash 0731V4.1 FlashV4 Pro 0813
HLE без / с инструментами37.8 / 51.542.7 / 60.0
Terminal Bench 2.182.787.9
NL2Repo54.261.5
CyberGym76.783.3
DeepSWE54.462.7
Toolathlon-Verified70.374.1
Agents’ Last Exam25.225.7
AutomationBench Public25.131.8
DSBench-FullStack68.771.1
DSBench-Hard59.667.2

По опубликованным данным V4 Pro 0813 обходит V4 Flash 0731 во всех десяти строках. Это результаты самого разработчика: для code-agent задач использовался DeepSeek Harness в minimal mode, reasoning effort max, temperature=1.0 и top_p=0.95. DSBench-FullStack и DSBench-Hard обозначены DeepSeek как внутренние тесты.

Какую модель выбрать

Для прямого API и минимальной цены логичнее начинать с V4.1 Flash, но прогнать собственный набор задач: публичных чисел новой версии пока нет. Для воспроизводимого локального развёртывания подходят опубликованные веса V4 Flash 0731 или V4 Pro 0813. Для выбора по подтверждённым агентным результатам V4 Pro сильнее V4 Flash, однако после 14 сентября API-alias Pro должен отвечать уже через V4.1 Flash.

Практический критерий — не цена одного токена, а стоимость успешно выполненной задачи. Если V4.1 Flash делает больше reasoning-токенов или требует повторного запуска, её реальная экономия окажется ниже табличной. Сравнивать модели лучше на одинаковых промптах, инструментах, лимитах ответа и минимум в нескольких прогонах.

Источники данных

Другие модели и фильтры по назначению доступны в каталоге LLM, а способы прямого доступа — в карточке DeepSeek.

Автор статьи

Анастасия Петрова — Контент-менеджер AI-раздела
Анастасия Петрова

Контент-менеджер AI-раздела

Отвечает за каталог нейросетей и AI-инструментов. Следит за обновлениями LLM-моделей, тестирует новые сервисы и ведёт раздел бесплатных инструментов.

Вопросы и ответы

По опубликованному 10 сентября тарифу дешевле V4.1 Flash: от 0,15 доллара за некэшированный ввод и 0,60 доллара за вывод вне пиковых часов.

Численная таблица V4.1 Flash пока не опубликована. DeepSeek заявила о превосходстве над V4 Pro, но не привела результаты отдельных тестов и методику сравнения.

DeepSeek планирует направлять запросы к Pro на V4.1 Flash и тарифицировать их по цене Flash. Локально развёрнутые веса V4 Pro 0813 от этого не изменятся.

На момент подготовки сравнения отдельные открытые веса, лицензия и инструкция локального запуска финальной V4.1 Flash не объявлены.

Смотрите также

Поделиться

Комментарии(0)

Оставьте комментарий

Войдите, чтобы присоединиться к обсуждению

Модель из статьи

Весь каталог