Текущая2026-08-13

От DeepSeek
DeepSeek V4 Pro — открытая reasoning-модель DeepSeek, выпущенная в GA 13 августа 2026 года как DeepSeek-V4-Pro-0813. С 10 сентября 2026 года, 04:00 UTC, и до выхода V4.1 Pro компания планирует временно направлять запросы к alias deepseek-v4-pro на V4.1 Flash и тарифицировать их по цене Flash. Карточка сохраняет характеристики V4 Pro 0813 и отдельно отмечает переходный режим.
DeepSeek V4 Pro сильнее всего выглядит в категориях «математика и общее качество». Профиль рассчитан по процентилям LiveBench, Artificial Analysis и LMArena; пропуски не считаются нулём.
Показатели G‑Код, G‑Рассуждения, G‑Агенты и G‑Зрение рассчитаны по массовым таблицам LiveBench, Artificial Analysis и LMArena. Наведите или нажмите на значок рядом с оценкой, чтобы увидеть исходный лидерборд, вариант модели, значение и размер выборки.
Уверенность данных
высокая
Покрытие
9 тестов · 8 направлений
Происхождение
livebench + artificialAnalysis
1 тест · уверенность: низкая
2 теста · уверенность: средняя
1 тест · уверенность: низкая
1 тест · уверенность: низкая
1 тест · уверенность: низкая
1 тест · уверенность: низкая
1 тест · уверенность: низкая
1 тест · уверенность: низкая
Место исходного бенчмарка показывается только при закреплённом source record и среди других карточек с источником. Эти старые значения не участвуют в G-Score лидербордов.
| Бенчмарк | Результат | Место | Доказательство |
|---|---|---|---|
| DeepSWE | 62.7% | 2 из 5 | Результат разработчика |
| NL2Repo | 61.5% | 1 из 8 | Результат разработчика |
| Humanity's Last Exam | 42.7% | 4 из 7 | Результат разработчика |
| Humanity's Last Exam с инструментами | 60% | 2 из 7 | Результат разработчика |
| Terminal-Bench 2.1 | 87.9% | 3 из 9 | Результат разработчика |
| Toolathlon Verified | 74.1% | 3 из 8 | Результат разработчика |
| AutomationBench Public | 31.8% | 1 из 3 | Результат разработчика |
Происхождение результатов
Значения взяты из официальной таблицы DeepSeek для режима Max. Это developer-reported результаты preview-линейки; Terminal-Bench 2.0 и Toolathlon нельзя смешивать с результатами Flash-0731 на обновлённых вариантах тестов.
Вариант: DeepSeek-V4-Pro-Max, official comparison across modes · получено 2026-08-08
DeepSeek V4 Pro — открытая reasoning-модель DeepSeek для длинных агентных и программных задач. Актуальный GA-релиз называется DeepSeek-V4-Pro-0813, а в API его вызывает прежний alias deepseek-v4-pro. Модель принимает до 1 млн токенов контекста, генерирует до 384 тыс. токенов и поддерживает tool calls, JSON Output, Responses API и Anthropic-совместимый API.
Обновление от 13 августа 2026 года: DeepSeek выпустила
DeepSeek-V4-Pro-0813в статусе GA и развернула модель в приложении, веб-интерфейсе и API. Это полноценный релиз Pro, а не предварительная версия.
Переход с 10 сентября 2026 года: после запуска V4.1 Flash и до выхода V4.1 Pro DeepSeek будет направлять запросы к
deepseek-v4-proна V4.1 Flash и считать их по тарифу Flash. Это временная маршрутизация alias, а не переименование V4 Pro 0813.
Для вызова последней версии Pro нужно указывать deepseek-v4-pro. DeepSeek сохранила этот alias после релиза, поэтому переводить интеграцию на имя Hugging Face-репозитория не требуется. Конкретная версия, на которую указывает alias на дату проверки 21 августа 2026 года, — DeepSeek-V4-Pro-0813.
С 10 сентября, 04:00 UTC, поведение alias временно изменится: запросы будет обслуживать V4.1 Flash. DeepSeek не требует менять имя модели на стороне клиента, но разработчикам стоит повторить тесты качества, инструментов и формата ответа после переключения. Компания заявляет, что V4.1 Flash превзошла V4 Pro по ключевым метрикам, однако полная публичная сравнительная таблица в уведомлении не приведена.
OpenAI-совместимые запросы отправляются на базовый адрес https://api.deepseek.com. Для приложений, рассчитанных на Anthropic API, документация указывает отдельный совместимый адрес https://api.deepseek.com/anthropic.
Контекстное окно DeepSeek V4 Pro составляет 1 млн токенов, максимальный вывод — 384 тыс. токенов. Для задач с reasoning effort high или max разработчик рекомендует разрешать модели вывод до полного лимита 384K: длинная цепочка рассуждений входит в этот бюджет.
В API доступны:
Thinking включён по умолчанию с уровнем effort high. Можно выбрать low, high или max; значения medium и xhigh API фактически сопоставляет с high. В thinking mode параметры temperature, top_p, presence_penalty и frequency_penalty не влияют на генерацию.
При использовании инструментов есть отдельное интеграционное условие: приложение должно полностью вернуть поле reasoning_content модели в следующий запрос. Если потерять это поле между вызовами инструментов, API ответит ошибкой 400.
Лимит одновременных запросов для V4 Pro — 500. Это ограничение следует учитывать при проектировании высоконагруженного агента или пакетной обработки.
До 10 сентября 2026 года, 04:00 UTC, для V4 Pro действует отдельный тариф. После запуска V4.1 Flash и до выхода V4.1 Pro обращения к alias Pro будут считаться по новому тарифу Flash. Все ставки указаны за 1 млн токенов.
| Операция | Pro до 10.09, off-peak | Переходный тариф, off-peak | Pro до 10.09, peak | Переходный тариф, peak |
|---|---|---|---|---|
| Ввод из кэша | $0.022 | $0.003 | $0.044 | $0.006 |
| Ввод без кэша | $0.66 | $0.15 | $1.32 | $0.30 |
| Вывод | $1.98 | $0.60 | $3.96 | $1.20 |
В переходный период вход из кэша станет дешевле примерно на 86%, вход без кэша — на 77%, вывод — на 70% относительно действующего тарифа Pro. Разница связана не со снижением цены прежней V4 Pro 0813 как отдельной модели, а с временной маршрутизацией запросов на V4.1 Flash.
Peak действует с 01:00 до 04:00 и с 06:00 до 10:00 UTC с понедельника по пятницу. На момент проверки 9 сентября публичная документация ещё показывала прежние цены, а новые условия были сообщены в официальном уведомлении DeepSeek API пользователям.
DeepSeek опубликовала новую таблицу результатов именно для DeepSeek-V4-Pro-0813. Это данные разработчика, а не независимое тестирование.
| Тест | Результат |
|---|---|
| Humanity's Last Exam без инструментов | 42.7 |
| Humanity's Last Exam с инструментами | 60.0 |
| Terminal-Bench 2.1 | 87.9 |
| NL2Repo | 61.5 |
| CyberGym | 83.3 |
| DeepSWE | 62.7 |
| Toolathlon-Verified | 74.1 |
| Agents' Last Exam | 25.7 |
| AutomationBench Public | 31.8 |
| DSBench-FullStack | 71.1 |
| DSBench-Hard | 67.2 |
Для публичных code-agent тестов DeepSeek указывает собственный harness в режиме minimal, reasoning effort max, temperature 1.0 и top_p 0.95. DSBench-FullStack и DSBench-Hard — внутренние наборы компании. Поэтому эти цифры помогают оценить заявленный профиль GA-релиза, но не доказывают превосходство над моделями, протестированными в других условиях.
Официальные веса deepseek-ai/DeepSeek-V4-Pro-0813 опубликованы под лицензией MIT. Метаданные репозитория указывают 1,7 трлн параметров; число активных параметров для версии 0813 в официальных материалах не приведено.
DeepSeek описывает DSpark — speculative decoding для запуска через vLLM и SGLang. Универсального минимального требования к видеопамяти в официальной карточке нет, поэтому конфигурацию локального сервера нужно подбирать по формату весов, способу распределения и выбранному runtime.
DeepSeek V4 Pro подходит командам, которым нужны длинный контекст, большой лимит ответа и агентные API-функции в одной модели. При выборе важно заранее проверить три вещи: попадание рабочего периода в peak, сохранение reasoning_content между tool calls и достаточный лимит вывода для режима high или max.
Цены приведены за 1 млн токенов и могут меняться. Доступность российских провайдеров проверяется на их стороне.
До 10.09.2026 04:00 UTC — тариф V4 Pro; затем временно тариф V4.1 Flash: off-peak $0.003 cache hit / $0.15 cache miss / $0.60 output, peak $0.006 / $0.30 / $1.20 за 1M токенов
Рассчитать сценарий →Для диаграммы пока недостаточно сопоставимых тестов.
История семейства
Последовательность собрана по датам релиза моделей DeepSeek в каталоге. Она показывает соседние поколения, но не приписывает им совместимость или наследование архитектуры без отдельного источника.
Сервисы, инструменты, материалы и обсуждения, связанные с моделью.
Точных связей пока нет. Искать по разработчику.
Задайте вопрос сообществу — карточка модели будет прикреплена автоматически.