К списку моделей
Логотип Anthropic, разработчика Claude Opus 4.8

Claude Opus 4.8

G-Score89.8/100средняя#11 из 402Методология G-Score

От Anthropic

Proprietary
FAMClaude
CTX1M
PARНе раскрыто
Релиз: 2026-05-28
ProGeneralMultimodalFrontier TOPImage Input

Краткое описание

Claude Opus 4.8 — новейшая модель от Anthropic, выпущенная в мае 2026 года. Разработана специально для сложных агентных процессов, написания надежного кода и обработки сверхдлинных контекстов. Модель в 4 раза реже пропускает собственные ошибки в коде и набрала 69.2% в бенчмарке SWE-Bench Pro.

G-Score и профиль

G-Score89.8/100средняя#11 из 402Методология G-Score

Claude Opus 4.8 сильнее всего выглядит в категориях «знания и общее качество». Профиль рассчитан по процентильным позициям внутри одинаковых тестов; пропуски не считаются нулём. Это навигационная оценка, а не замена тесту на ваших задачах.

Уверенность данных

средняя

Покрытие

6 тестов · 5 направлений

Происхождение

источник не закреплён

Знания99/100

1 сопоставимых теста · уверенность: средняя

Общее качество98/100

1 сопоставимых теста · уверенность: средняя

Рассуждения97/100

1 сопоставимых теста · уверенность: средняя

Математика80/100

1 сопоставимых теста · уверенность: средняя

Код79/100

2 сопоставимых теста · уверенность: средняя

Как рассчитан профиль →

Место модели в каталоге

Позиция рассчитана только среди моделей, для которых в каталоге указан результат того же теста. Это помогает сравнивать карточки, но не заменяет проверку модели на вашей задаче.

БенчмаркРезультатМестоДоказательство
Arena Elo (LMSYS)15897 из 382Источник не указан
MMLU (Общие знания)96.5%6 из 389Источник не указан
HumanEval (Кодинг)88.4%157 из 389Источник не указан
MATH (Математика)92.1%77 из 389Источник не указан
GPQA (Экспертные знания)78.5%14 из 389Источник не указан
SWE-bench (Разработка)69.2%8 из 379Источник не указан

Подробный обзор модели

Обзор Claude Opus 4.8

Claude Opus 4.8 — это новейшая модель от Anthropic, выпущенная 28 мая 2026 года. Она позиционируется как «ощутимое улучшение» по сравнению со своим предшественником, Opus 4.7, и фокусируется на развитии агентных возможностей, надежности в написании кода и обработке длинного контекста.

Ключевые улучшения и бенчмарки

  • SWE-Bench Pro (Написание кода): Claude Opus 4.8 достигла результата 69.2% (по сравнению с 64.3% у Opus 4.7). Модель устанавливает новые стандарты в области автономного программирования и агентных задач.
  • MMLU-Pro: Модель показывает точность около 89.6%.
  • Arena Elo: В общих рейтингах Chatbot Arena модель получила оценку в районе 1590-1600, укрепляя позиции Anthropic в топе лидеров.
  • Агентные способности (Agentic Capabilities): Внутренние тесты Anthropic показали, что Opus 4.8 стала единственной моделью, которая смогла пройти все тестовые кейсы от начала до конца в бенчмарке "Super-Agent", а также набрала 84% в бенчмарке Online-Mind2Web, проверяющем использование компьютера ИИ.

Новые возможности

  1. Честность и надежность в коде: Главный фокус релиза — существенное снижение галлюцинаций в фактах и дефектов в коде. Anthropic заявляет, что Opus 4.8 примерно в 4 раза реже пропускает собственные ошибки в сгенерированном коде по сравнению с Opus 4.7.
  2. Динамические воркфлоу (Dynamic Workflows): Модель получила полноценную поддержку динамических рабочих процессов в Claude Code. Это позволяет ей автономно планировать и оркестрировать сотни параллельных подагентов.
  3. Режим Fast Mode: Цены остались на уровне Opus 4.7 ($5 за миллион токенов ввода и $25 за миллион вывода), однако был добавлен новый режим "Fast Mode". Он в 2.5 раза быстрее и в 3 раза дешевле, чем Fast Mode в предыдущих версиях.

Заключение

Claude Opus 4.8 не стала революционным скачком, но предложила пользователям ровно то, что было необходимо: невероятную надежность в программировании, возможность создания сложных агентных цепочек и улучшенную работу с длинными контекстами. Для команд разработки и бизнеса, интегрирующего ИИ, Opus 4.8 становится одним из самых стабильных решений на рынке в 2026 году.

Где запустить модель

Цены приведены за 1 млн токенов и могут меняться. Доступность российских провайдеров проверяется на их стороне.

Обновляем провайдеров и цены…

Стоимость API

$5.00 / $25.00 за 1M токенов

Рассчитать сценарий →

Профиль модели

MMLU96.5%Code88.4%Math92.1%GPQA78.5%SWE69.2%

Бенчмарки

Arena Elo (LMSYS)1589
MMLU (Общие знания)96.5%
HumanEval (Кодинг)88.4%
MATH (Математика)92.1%
GPQA (Экспертные знания)78.5%
SWE-bench (Разработка)69.2%

История семейства

Линейка Claude

Последовательность собрана по датам релиза моделей Anthropic в каталоге. Она показывает соседние поколения, но не приписывает им совместимость или наследование архитектуры без отдельного источника.

Экосистема Claude Opus 4.8

Сервисы, инструменты, материалы и обсуждения, связанные с моделью.

Обсуждения о Claude Opus 4.8

Задайте вопрос сообществу — карточка модели будет прикреплена автоматически.

Создать обсуждение