Текущая2025-05-22

От Anthropic
На момент выпуска Claude Opus 4 оценивается как лучшая в мире модель кодирования, обеспечивающая стабильную производительность при выполнении сложных, длительных задач и рабочих процессов агентов. Он устанавливает новые стандарты в...
Claude Opus 4 сильнее всего выглядит в категории «зрение». Профиль рассчитан по процентилям LiveBench, Artificial Analysis и LMArena; пропуски не считаются нулём.
Показатели G‑Код, G‑Рассуждения, G‑Агенты и G‑Зрение рассчитаны по массовым таблицам LiveBench, Artificial Analysis и LMArena. Наведите или нажмите на значок рядом с оценкой, чтобы увидеть исходный лидерборд, вариант модели, значение и размер выборки.
Уверенность данных
средняя
Покрытие
1 тест · 1 направление
Происхождение
lmarenaVision
1 тест · уверенность: средняя
Место исходного бенчмарка показывается только при закреплённом source record и среди других карточек с источником. Эти старые значения не участвуют в G-Score лидербордов.
| Бенчмарк | Результат | Место | Доказательство |
|---|---|---|---|
| GPQA (Экспертные знания) | 65.5% | н/д | Источник не указан |
| MATH (Математика) | 77.9% | н/д | Источник не указан |
| MMLU (Общие знания) | 90.1% | н/д | Источник не указан |
| Arena Elo (LMSYS) | 1511 | н/д | Источник не указан |
| HumanEval (Кодинг) | 85.4% | н/д | Источник не указан |
| SWE-bench (Разработка) | 59.4% | н/д | Источник не указан |
Claude Opus 4 — это первая итерация четвертого поколения флагманских моделей от Anthropic, выпущенная в мае 2025 года. На момент выхода она была признана лучшей в мире моделью для программирования, установив новые стандарты производительности в решении сложных, долгосрочных задач и управлении сложными агентными ворклоу.
Claude Opus 4 была спроектирована для работы там, где другие модели пасуют. Она обладает глубоким пониманием сложных концепций, способна к тонкому анализу контекста и демонстрирует высокий уровень «интеллектуальной выносливости» при работе с многостраничными инструкциями.
Модель стала настоящим прорывом для инженеров. Способность Claude Opus 4 не просто писать фрагменты кода, а проектировать архитектуру и автономно проводить отладку в рамках агентных сценариев, сделала её фаворитом в среде профессиональной разработки.
Как и все модели Anthropic, Opus 4 обладает встроенными механизмами безопасности и минимизации предвзятости. Она предоставляет исключительно точные, вежливые и аргументированные ответы, избегая при этом галлюцинаций даже в очень специфических темах.
| Бенчмарк | Результат Claude Opus 4 | Категория |
|---|---|---|
| Arena Elo | 1511 | Флагманский уровень |
| MMLU | 90.1% | Глубокие общие знания |
| HumanEval | 85.4% | Генерация кода |
| MATH | 77.9% | Математические рассуждения |
| GPQA | 65.5% | Научные дисциплины |
| SWE_bench | 59.4% | Решение инженерных проблем |
Claude Opus 4 доступна по цене $15.00 за 1M входных токенов. Это инвестиция в качество и надежность для организаций, которым требуется максимально точный и ответственный ИИ для критически важных задач.
Статья подготовлена для Gruzdevv.ru. Все данные актуальны на май 2026 года.
Цены приведены за 1 млн токенов и могут меняться. Доступность российских провайдеров проверяется на их стороне.
История семейства
Последовательность собрана по датам релиза моделей Anthropic в каталоге. Она показывает соседние поколения, но не приписывает им совместимость или наследование архитектуры без отдельного источника.
Сервисы, инструменты, материалы и обсуждения, связанные с моделью.
Откройте результаты по названию модели и проверьте актуальную интеграцию.
Точных связей пока нет. Искать по разработчику.
Задайте вопрос сообществу — карточка модели будет прикреплена автоматически.