
DeepSeek V3.1
от DeepSeek
DeepSeek
Open Source
CTX33K
PARНе раскрыто
StandardGeneralText
HumanEval 82.3%SWE-bench 51.8%GPQA 63%MMLU 85.7%
Для сложных рассуждений ориентируйтесь на GPQA и Humanity’s Last Exam, для математики — на MATH и AIME. Высокий балл не гарантирует точность на ваших данных, поэтому важные ответы необходимо проверять и тестировать на собственной выборке. Телеграм-бот fLLMs мониторит бесплатные API-ключи в роутерах.
Значение показывается только там, где для модели есть результат конкретного теста · Методология и источники
Модели для многошагового анализа, математики, науки и задач, где важна проверяемая цепочка рассуждений.























