К списку моделей
Логотип Anthropic, разработчика Claude Sonnet 4

Claude Sonnet 4

G-Score: н/д

От Anthropic

Proprietary
FAMClaude
CTX1M
PARНе раскрыто
Релиз: 2025-05-22
StandardGeneralText

Краткое описание

Claude Sonnet 4 значительно расширяет возможности своего предшественника Sonnet 3.7, превосходно справляясь как с задачами кодирования, так и с логическими рассуждениями, обладая повышенной точностью и управляемостью. Достижение самых высоких показателей на стенде SWE (72,7%),...

G-Score и профиль

G-Score: н/д

Claude Sonnet 4 сильнее всего выглядит в категории «зрение». Профиль рассчитан по процентилям LiveBench, Artificial Analysis и LMArena; пропуски не считаются нулём.

Показатели G‑Код, G‑Рассуждения, G‑Агенты и G‑Зрение рассчитаны по массовым таблицам LiveBench, Artificial Analysis и LMArena. Наведите или нажмите на значок рядом с оценкой, чтобы увидеть исходный лидерборд, вариант модели, значение и размер выборки.

Уверенность данных

средняя

Покрытие

1 тест · 1 направление

Происхождение

lmarenaVision

G‑Зрение27/100

1 тест · уверенность: средняя

Как рассчитан профиль →

Место модели в каталоге

Место исходного бенчмарка показывается только при закреплённом source record и среди других карточек с источником. Эти старые значения не участвуют в G-Score лидербордов.

БенчмаркРезультатМестоДоказательство
GPQA (Экспертные знания)63.6%н/дИсточник не указан
MATH (Математика)94.7%н/дИсточник не указан
MMLU (Общие знания)86.9%н/дИсточник не указан
Arena Elo (LMSYS)1423н/дИсточник не указан
HumanEval (Кодинг)80.7%н/дИсточник не указан
SWE-bench (Разработка)53.8%н/дИсточник не указан

Подробный обзор модели

Claude Sonnet 4 — это значимое обновление интеллектуальной линейки Sonnet от Anthropic, представленное в мае 2025 года. Модель совершила качественный скачок, значительно превзойдя возможности своей предшественницы (Sonnet 3.7) и вплотную приблизившись к флагманским показателям серии Opus предыдущего поколения. Claude Sonnet 4 ориентирована на решение сложных профессиональных задач в области программирования, логики и управления автономными агентами.

Особенности и программный интеллект

Модель была спроектирована Anthropic как высокопроизводительный инструмент для инженеров и исследователей.

  • Мастерство кодинга (SWE-bench 72.7%): Claude Sonnet 4 достигла рекордных показателей в решении реальных задач разработки ПО. Модель умеет автономно исправлять баги, внедрять новые функции в крупные репозитории и проводить глубокий архитектурный аудит.
  • Повышенная управляемость: Версия 4 гораздо точнее следует сложным инструкциям и лучше соблюдает заданные ограничения. Она демонстрирует высокую степень «интеллектуальной дисциплины», минимизируя отклонения от сценария.
  • Гигантский контекст 1M: Поддержка контекстного окна в 1 миллион токенов позволяет модели анализировать целые библиотеки документов и кодовые базы, сохраняя идеальную связность рассуждений на сверхдлинных дистанциях.

Производительность и бенчмарки

Claude Sonnet 4 уверенно занимает топовые позиции в мировых рейтингах, подтверждая статус одной из самых сбалансированных моделей флагманского уровня.

БенчмаркРезультатОписание
MATH94.7%Исключительная точность в математических рассуждениях (премиум)
Arena Elo1423Высокий флагманский уровень
MMLU86.9%Глубокие общие знания и эрудиция
HumanEval80.7%Высокое качество генерации программного кода
GPQA63.6%Научные вопросы PhD-уровня
SWE_bench53.8%Решение инженерных задач в реальных условиях

Ценообразование и доступность

Claude Sonnet 4 доступна через API Anthropic и популярных агрегаторов по цене $3.00 за 1M входных токенов и $15.00 за 1M выходных токенов. Это премиальное, но высокоэффективное решение для профессиональных команд, которым требуется бескомпромиссная точность и интеллект для критически важных задач.

Идеальные сценарии применения (Use Cases)

  • Автономные кодинг-агенты: Создание «умных» сотрудников, способных самостоятельно вести разработку в крупных проектах.
  • Глубокий анализ и аудит ПО: Автоматический поиск уязвимостей, рефакторинг и оптимизация архитектуры систем.
  • Интеллектуальные RAG-системы: Построение надежных систем ответов на вопросы на базе гигантских объемов документации.

Плюсы и минусы

Плюсы:

  • Рекордная точность в математике и логике.
  • Феноменальные показатели в SWE-bench (72.7%).
  • Гигантское контекстное окно (1M токенов).
  • Лидирующая в индустрии управляемость и безопасность.

Минусы:

  • Высокая стоимость API по сравнению с серией Mini/Haiku.
  • Проприетарная архитектура (веса закрыты).

Где запустить модель

Цены приведены за 1 млн токенов и могут меняться. Доступность российских провайдеров проверяется на их стороне.

Обновляем провайдеров и цены…

Стоимость API

$3.00 / $15.00 за 1M токенов

Рассчитать сценарий →

Профиль модели

MMLU86.9%Code80.7%Math94.7%GPQA63.6%SWE53.8%

Бенчмарки

GPQA (Экспертные знания)63.6%
MATH (Математика)94.7%
MMLU (Общие знания)86.9%
Arena Elo (LMSYS)1423
HumanEval (Кодинг)80.7%
SWE-bench (Разработка)53.8%

История семейства

Линейка Claude

Последовательность собрана по датам релиза моделей Anthropic в каталоге. Она показывает соседние поколения, но не приписывает им совместимость или наследование архитектуры без отдельного источника.

Экосистема Claude Sonnet 4

Сервисы, инструменты, материалы и обсуждения, связанные с моделью.

Сервисы с поддержкой модели

Откройте результаты по названию модели и проверьте актуальную интеграцию.

Искать в /services/ →

Обсуждения о Claude Sonnet 4

Задайте вопрос сообществу — карточка модели будет прикреплена автоматически.

Создать обсуждение