Текущая2025-05-22

От Anthropic
Claude Sonnet 4 значительно расширяет возможности своего предшественника Sonnet 3.7, превосходно справляясь как с задачами кодирования, так и с логическими рассуждениями, обладая повышенной точностью и управляемостью. Достижение самых высоких показателей на стенде SWE (72,7%),...
Claude Sonnet 4 сильнее всего выглядит в категории «зрение». Профиль рассчитан по процентилям LiveBench, Artificial Analysis и LMArena; пропуски не считаются нулём.
Показатели G‑Код, G‑Рассуждения, G‑Агенты и G‑Зрение рассчитаны по массовым таблицам LiveBench, Artificial Analysis и LMArena. Наведите или нажмите на значок рядом с оценкой, чтобы увидеть исходный лидерборд, вариант модели, значение и размер выборки.
Уверенность данных
средняя
Покрытие
1 тест · 1 направление
Происхождение
lmarenaVision
1 тест · уверенность: средняя
Место исходного бенчмарка показывается только при закреплённом source record и среди других карточек с источником. Эти старые значения не участвуют в G-Score лидербордов.
| Бенчмарк | Результат | Место | Доказательство |
|---|---|---|---|
| GPQA (Экспертные знания) | 63.6% | н/д | Источник не указан |
| MATH (Математика) | 94.7% | н/д | Источник не указан |
| MMLU (Общие знания) | 86.9% | н/д | Источник не указан |
| Arena Elo (LMSYS) | 1423 | н/д | Источник не указан |
| HumanEval (Кодинг) | 80.7% | н/д | Источник не указан |
| SWE-bench (Разработка) | 53.8% | н/д | Источник не указан |
Claude Sonnet 4 — это значимое обновление интеллектуальной линейки Sonnet от Anthropic, представленное в мае 2025 года. Модель совершила качественный скачок, значительно превзойдя возможности своей предшественницы (Sonnet 3.7) и вплотную приблизившись к флагманским показателям серии Opus предыдущего поколения. Claude Sonnet 4 ориентирована на решение сложных профессиональных задач в области программирования, логики и управления автономными агентами.
Модель была спроектирована Anthropic как высокопроизводительный инструмент для инженеров и исследователей.
Claude Sonnet 4 уверенно занимает топовые позиции в мировых рейтингах, подтверждая статус одной из самых сбалансированных моделей флагманского уровня.
| Бенчмарк | Результат | Описание |
|---|---|---|
| MATH | 94.7% | Исключительная точность в математических рассуждениях (премиум) |
| Arena Elo | 1423 | Высокий флагманский уровень |
| MMLU | 86.9% | Глубокие общие знания и эрудиция |
| HumanEval | 80.7% | Высокое качество генерации программного кода |
| GPQA | 63.6% | Научные вопросы PhD-уровня |
| SWE_bench | 53.8% | Решение инженерных задач в реальных условиях |
Claude Sonnet 4 доступна через API Anthropic и популярных агрегаторов по цене $3.00 за 1M входных токенов и $15.00 за 1M выходных токенов. Это премиальное, но высокоэффективное решение для профессиональных команд, которым требуется бескомпромиссная точность и интеллект для критически важных задач.
Плюсы:
Минусы:
Цены приведены за 1 млн токенов и могут меняться. Доступность российских провайдеров проверяется на их стороне.
История семейства
Последовательность собрана по датам релиза моделей Anthropic в каталоге. Она показывает соседние поколения, но не приписывает им совместимость или наследование архитектуры без отдельного источника.
Сервисы, инструменты, материалы и обсуждения, связанные с моделью.
Откройте результаты по названию модели и проверьте актуальную интеграцию.
Задайте вопрос сообществу — карточка модели будет прикреплена автоматически.