
От Anthropic
Claude 3.7 Sonnet — это усовершенствованная модель большого языка с улучшенными возможностями рассуждения, кодирования и решения проблем. Он представляет гибридный подход к рассуждению, позволяющий пользователям выбирать между быстрым ответом и...
Claude 3.7 Sonnet сильнее всего выглядит в категории «рассуждения и код». Индекс 78/100 рассчитан по процентильным позициям в 3 сопоставимых тестах; уверенность — средняя. Это навигационная оценка, а не замена тесту на ваших задачах.
3 сопоставимых теста · уверенность: средняя
2 сопоставимых теста · уверенность: средняя
Позиция рассчитана только среди моделей, для которых в каталоге указан результат того же теста. Это помогает сравнивать карточки, но не заменяет проверку модели на вашей задаче.
| Бенчмарк | Результат | Место | Доказательство |
|---|---|---|---|
| Arena Elo (LMSYS) | 1466 | 69 из 384 | Источник не указан |
| MMLU (Общие знания) | 90.5% | 50 из 391 | Источник не указан |
| HumanEval (Кодинг) | 92.7% | 79 из 391 | Источник не указан |
| MATH (Математика) | 85.8% | 179 из 391 | Источник не указан |
| GPQA (Экспертные знания) | 75.4% | 26 из 390 | Источник не указан |
| SWE-bench (Разработка) | 52.8% | 208 из 381 | Источник не указан |
Claude 3.7 Sonnet, представленная в феврале 2025 года, стала первой моделью от Anthropic, объединившей мгновенную генерацию с возможностью глубокого рассуждения. Это превратило Sonnet из простого чат-бота в мощнейший движок для автономных агентов.
Главная новинка — режим «Extended Thinking» (Расширенное мышление). Пользователь может сам устанавливать «бюджет на раздумья», позволяя модели тратить больше времени на планирование и верификацию ответов.
В режиме расширенного мышления Claude 3.7 Sonnet показывает результаты, ранее казавшиеся недостижимыми для моделей такого класса.
| Бенчмарк | Показатель | Описание |
|---|---|---|
| SWE-bench Verified | 70.3% | Мировой рекорд в решении задач на GitHub |
| GPQA Diamond | 84.8% | Глубокое понимание научной литературы |
| AIME 2024 | 80.0% | Олимпиадная математика |
| IFEval | 93.2% | Безупречное следование сложным промптам |
Anthropic сохранила агрессивную ценовую политику, делая Sonnet 3.7 доступной для широкого круга задач.
Плюсы:
Минусы:
Цены приведены за 1 млн токенов и могут меняться. Доступность российских провайдеров проверяется на их стороне.
$3.00 / $15.00 за 1M токенов
Сервисы, инструменты, материалы и обсуждения, связанные с моделью.
Откройте результаты по названию модели и проверьте актуальную интеграцию.
Точных связей пока нет. Искать по разработчику.
Задайте вопрос сообществу — карточка модели будет прикреплена автоматически.