К списку моделей
Логотип Anthropic, разработчика Claude 3.7 Sonnet (thinking)

Claude 3.7 Sonnet (thinking)

G-Score19.1/100средняя#366 из 402Методология G-Score

От Anthropic

Proprietary
FAMClaude
CTX200K
PARНе раскрыто
Релиз: 2025-02-24
StandardReasoningText

Краткое описание

Claude 3.7 Sonnet — это усовершенствованная модель большого языка с улучшенными возможностями рассуждения, кодирования и решения проблем. Он представляет гибридный подход к рассуждению, позволяющий пользователям выбирать между быстрым ответом и...

G-Score и профиль

G-Score19.1/100средняя#366 из 402Методология G-Score

Claude 3.7 Sonnet (thinking) сильнее всего выглядит в категории «рассуждения». Профиль рассчитан по процентильным позициям внутри одинаковых тестов; пропуски не считаются нулём. Это навигационная оценка, а не замена тесту на ваших задачах.

Уверенность данных

средняя

Покрытие

6 тестов · 5 направлений

Происхождение

источник не закреплён

Рассуждения32/100

1 сопоставимых теста · уверенность: средняя

Знания30/100

1 сопоставимых теста · уверенность: средняя

Общее качество29/100

1 сопоставимых теста · уверенность: средняя

Код5/100

2 сопоставимых теста · уверенность: средняя

Математика3/100

1 сопоставимых теста · уверенность: средняя

Как рассчитан профиль →

Место модели в каталоге

Позиция рассчитана только среди моделей, для которых в каталоге указан результат того же теста. Это помогает сравнивать карточки, но не заменяет проверку модели на вашей задаче.

БенчмаркРезультатМестоДоказательство
Arena Elo (LMSYS)1393270 из 382Источник не указан
MMLU (Общие знания)84.4%271 из 389Источник не указан
HumanEval (Кодинг)75%366 из 389Источник не указан
MATH (Математика)70.7%377 из 389Источник не указан
GPQA (Экспертные знания)63.6%263 из 389Источник не указан
SWE-bench (Разработка)40%363 из 379Источник не указан

Где запустить модель

Цены приведены за 1 млн токенов и могут меняться. Доступность российских провайдеров проверяется на их стороне.

Обновляем провайдеров и цены…

Стоимость API

$3.00 / $15.00 за 1M токенов

Рассчитать сценарий →

Профиль модели

MMLU84.4%Code75%Math70.7%GPQA63.6%SWE40%

Бенчмарки

Arena Elo (LMSYS)1393
MMLU (Общие знания)84.4%
HumanEval (Кодинг)75%
MATH (Математика)70.7%
GPQA (Экспертные знания)63.6%
SWE-bench (Разработка)40%

История семейства

Линейка Claude

Последовательность собрана по датам релиза моделей Anthropic в каталоге. Она показывает соседние поколения, но не приписывает им совместимость или наследование архитектуры без отдельного источника.

Экосистема Claude 3.7 Sonnet (thinking)

Сервисы, инструменты, материалы и обсуждения, связанные с моделью.

MCP и инструменты

Весь каталог

Точных связей пока нет. Искать по разработчику.

Обсуждения о Claude 3.7 Sonnet (thinking)

Задайте вопрос сообществу — карточка модели будет прикреплена автоматически.

Создать обсуждение