
От DeepSeek
Обновление от 28 мая для [оригинального DeepSeek R1](/deepseek/deepseek-r1). Производительность на уровне [OpenAI o1](/openai/o1), но с открытым исходным кодом и с полностью открытыми токенами рассуждений. Его размер составляет 671 байт параметров, из них 37 байт активных...
R1 0528 сильнее всего выглядит в категории «код». Индекс 86/100 рассчитан по процентильным позициям в 2 сопоставимых тестах; уверенность — средняя. Это навигационная оценка, а не замена тесту на ваших задачах.
2 сопоставимых теста · уверенность: средняя
3 сопоставимых теста · уверенность: средняя
Позиция рассчитана только среди моделей, для которых в каталоге указан результат того же теста. Это помогает сравнивать карточки, но не заменяет проверку модели на вашей задаче.
| Бенчмарк | Результат | Место | Доказательство |
|---|---|---|---|
| Arena Elo (LMSYS) | 1390 | 277 из 384 | Источник не указан |
| MMLU (Общие знания) | 84.2% | 278 из 391 | Источник не указан |
| HumanEval (Кодинг) | 93.9% | 59 из 391 | Источник не указан |
| MATH (Математика) | 81.8% | 239 из 391 | Источник не указан |
| GPQA (Экспертные знания) | 59.8% | 361 из 390 | Источник не указан |
| SWE-bench (Разработка) | 64.2% | 50 из 381 | Источник не указан |
Цены приведены за 1 млн токенов и могут меняться. Доступность российских провайдеров проверяется на их стороне.
$0.50 / $2.15 за 1M токенов
Сервисы, инструменты, материалы и обсуждения, связанные с моделью.
Откройте результаты по названию модели и проверьте актуальную интеграцию.
Точных связей пока нет. Искать по разработчику.
Задайте вопрос сообществу — карточка модели будет прикреплена автоматически.