
От Anthropic
Claude 3.7 Sonnet — это усовершенствованная модель большого языка с улучшенными возможностями рассуждения, кодирования и решения проблем. Он представляет гибридный подход к рассуждению, позволяющий пользователям выбирать между быстрым ответом и...
Claude 3.7 Sonnet (thinking) сильнее всего выглядит в категории «рассуждения». Индекс 22/100 рассчитан по процентильным позициям в 3 сопоставимых тестах; уверенность — средняя. Это навигационная оценка, а не замена тесту на ваших задачах.
3 сопоставимых теста · уверенность: средняя
2 сопоставимых теста · уверенность: средняя
Позиция рассчитана только среди моделей, для которых в каталоге указан результат того же теста. Это помогает сравнивать карточки, но не заменяет проверку модели на вашей задаче.
| Бенчмарк | Результат | Место | Доказательство |
|---|---|---|---|
| Arena Elo (LMSYS) | 1393 | 272 из 384 | Источник не указан |
| MMLU (Общие знания) | 84.4% | 273 из 391 | Источник не указан |
| HumanEval (Кодинг) | 75% | 368 из 391 | Источник не указан |
| MATH (Математика) | 70.7% | 379 из 391 | Источник не указан |
| GPQA (Экспертные знания) | 63.6% | 264 из 390 | Источник не указан |
| SWE-bench (Разработка) | 40% | 365 из 381 | Источник не указан |
Цены приведены за 1 млн токенов и могут меняться. Доступность российских провайдеров проверяется на их стороне.
$3.00 / $15.00 за 1M токенов
Сервисы, инструменты, материалы и обсуждения, связанные с моделью.
Откройте результаты по названию модели и проверьте актуальную интеграцию.
Точных связей пока нет. Искать по разработчику.
Задайте вопрос сообществу — карточка модели будет прикреплена автоматически.