
От DeepSeek
DeepSeek R1 Distill Llama 70B — это дистиллированная модель большого языка, основанная на [Llama-3.3-70B-Instruct](/meta-llama/llama-3.3-70b-instruct) с использованием результатов из [DeepSeek R1](/deepseek/deepseek-r1). Модель сочетает в себе передовые методы дистилляции для достижения высокой производительности во всем...
R1 Distill Llama 70B сильнее всего выглядит в категории «рассуждения». Индекс 63/100 рассчитан по процентильным позициям в 3 сопоставимых тестах; уверенность — средняя. Это навигационная оценка, а не замена тесту на ваших задачах.
3 сопоставимых теста · уверенность: средняя
2 сопоставимых теста · уверенность: средняя
Позиция рассчитана только среди моделей, для которых в каталоге указан результат того же теста. Это помогает сравнивать карточки, но не заменяет проверку модели на вашей задаче.
| Бенчмарк | Результат | Место | Доказательство |
|---|---|---|---|
| Arena Elo (LMSYS) | 1405 | 227 из 382 | Источник не указан |
| MMLU (Общие знания) | 85.4% | 226 из 389 | Источник не указан |
| HumanEval (Кодинг) | 86.4% | 197 из 389 | Источник не указан |
| MATH (Математика) | 91.3% | 89 из 389 | Источник не указан |
| GPQA (Экспертные знания) | 69.3% | 114 из 388 | Источник не указан |
| SWE-bench (Разработка) | 58.1% | 122 из 379 | Источник не указан |
DeepSeek R1 Distill Llama 70B — это высокопроизводительная языковая модель с открытыми весами, представляющая собой результат глубокой дистилляции знаний из флагманской модели DeepSeek R1 в архитектуру Llama 3.3 70B Instruct. Представленная в январе 2025 года, эта модель объединяет в себе феноменальные способности к рассуждению (reasoning) от R1 с надежностью и эффективностью популярного семейства Llama, предлагая пользователям интеллект уровня o1-preview в компактном и быстром 70B формате.
Модель была создана командой DeepSeek путем обучения Llama 3.3 70B на огромном массиве данных, включающем «цепочки мыслей» (thinking traces), сгенерированные флагманской моделью DeepSeek R1.
Модель уверенно занимает топовые позиции в рейтингах систем среднего веса, соревнуясь с лучшими закрытыми аналогами в точности логического вывода.
| Бенчмарк | Результат | Описание |
|---|---|---|
| MATH | 91.3% | Исключительная точность в математических рассуждениях (премиум) |
| Arena Elo | 1405 | Высокий профессиональный уровень |
| HumanEval | 86.4% | Высокое качество генерации программного кода |
| MMLU | 85.4% | Глубокие общие знания и эрудиция |
| GPQA | 69.3% | Научные вопросы PhD-уровня |
| SWE_bench | 58.1% | Решение инженерных задач в реальных условиях |
Модель доступна в виде открытых весов и через API популярных агрегаторов (например, OpenRouter) по крайне привлекательной цене: всего $0.70 за 1M входных токенов и $0.80 за 1M выходных токенов. Это делает её одним из самых выгодных решений для систем, требующих глубокого рассуждения за минимальную стоимость.
Плюсы:
Минусы:
Цены приведены за 1 млн токенов и могут меняться. Доступность российских провайдеров проверяется на их стороне.
$0.70 / $0.80 за 1M токенов
Сервисы, инструменты, материалы и обсуждения, связанные с моделью.
Точных связей пока нет. Искать по разработчику.
Задайте вопрос сообществу — карточка модели будет прикреплена автоматически.