Текущая2026-09-28

От Anthropic
Claude Sonnet 5.5 — модель Anthropic среднего класса для агентного программирования, работы с компьютером и документами, пришедшая на смену Claude Sonnet 5 и ставшая второй моделью семейства Claude 5.5 после Opus 5.5. Контекст 1M токенов, вывод до 128K, adaptive thinking с уровнями effort от low до max; цена $2.00/$10.00 за 1M токенов не изменилась по сравнению с Sonnet 5. По данным Anthropic, модель генерирует ответы более чем на 30% быстрее предшественницы, стоит до 30% меньше в расчёте на задачу, набирает 70,6% на Terminal-Bench 4.0 (больше, чем Opus 5.5) и 80,1% на OSWorld 2.1.
Для Claude Sonnet 5.5 пока нет совпавших результатов в подключённых публичных лидербордах. Исходные значения карточки не используются для G‑Score.
Показатели G‑Код, G‑Рассуждения, G‑Агенты и G‑Зрение рассчитаны по массовым таблицам LiveBench, Artificial Analysis и LMArena. Наведите или нажмите на значок рядом с оценкой, чтобы увидеть исходный лидерборд, вариант модели, значение и размер выборки.
Уверенность данных
низкая
Покрытие
0 тестов · 0 направлений
Происхождение
нет данных лидербордов
Место исходного бенчмарка показывается только при закреплённом source record и среди других карточек с источником. Эти старые значения не участвуют в G-Score лидербордов.
| Бенчмарк | Результат | Место | Доказательство |
|---|---|---|---|
| OSWorld 2.0 (Компьютер) | 80.1% | 1 из 6 | Результат разработчика |
| Chartography | 61.6% | 2 из 2 | Результат разработчика |
| FrontierCode | 46.2% | 2 из 2 | Результат разработчика |
| Humanity's Last Exam с инструментами | 64.5% | 2 из 8 | Результат разработчика |
| CursorBench 4.0 | 55.5% | 1 из 1 | Результат разработчика |
| AA-Briefcase (Elo) | 1811 | 1 из 2 | Результат разработчика |
| GDPval-AA v2 (Elo) | 1844 | 2 из 9 | Результат разработчика |
| Terminal-Bench 4.0 | 70.6% | 1 из 5 | Результат разработчика |
Происхождение результатов
Значения из официальной таблицы Anthropic. OSWorld здесь версии 2.1 (partial), GDPval-AA — v2.1, AA-Briefcase — v1.1; GDPval-AA и AA-Briefcase измеряла Artificial Analysis на предрелизной версии с ошибкой structured outputs.
Вариант: claude-sonnet-5-5, launch comparison table; FrontierCode at max effort · получено 2026-09-30
Claude Sonnet 5.5 стоит выбирать как основную рабочую модель Anthropic для агентного программирования, работы с компьютером и документами, когда важны скорость и цена одной задачи. По большинству опубликованных тестов она вплотную подходит к Claude Opus 5.5, а на Terminal-Bench 4.0 даже обгоняет её — при цене API вдвое ниже. Opus 5.5 и Claude Fable 5.1 имеет смысл подключать там, где Sonnet 5.5 на ваших проверках стабильно не дотягивает.
Anthropic выпустила Claude Sonnet 5.5 28 сентября 2026 года — через неделю после Opus 5.5. Это вторая модель семейства Claude 5.5, которую Anthropic описывает как более быструю и дешёвую пару к Opus 5.5. Модель сменяет Claude Sonnet 5, вышедшую 30 июня 2026 года; Claude Haiku 5.5, по словам компании, присоединится к семейству в ближайшие недели.
Идентификатор в Claude API — claude-sonnet-5-5; в Amazon Bedrock используется anthropic.claude-sonnet-5-5, в Google Cloud, Microsoft Foundry и Claude Platform on AWS — claude-sonnet-5-5.
| Параметр | Значение |
|---|---|
| Контекстное окно | 1 000 000 токенов |
| Максимальный вывод | 128 000 токенов; до 300 000 в Message Batches API с beta-заголовком output-300k-2026-03-24 |
| Вход → выход | текст и изображения → текст |
| Thinking | adaptive, включён по умолчанию |
| Effort | low, medium, high, xhigh, max |
| Effort по умолчанию | high в API, medium в приложениях Claude |
| Сравнительная задержка | Fast |
| Граница знаний | июнь 2026 года |
| Вывод из эксплуатации | не раньше 28 сентября 2027 года |
По данным Anthropic, Sonnet 5.5 генерирует ответ более чем на 30% быстрее Sonnet 5 — это самая быстрая модель Sonnet на сегодня — и обходится до 30% дешевле в пересчёте на задачу. На нескольких бенчмарках Sonnet 5.5 на уровнях low или medium обходит лучший результат Sonnet 5 примерно за десятую часть стоимости задачи.
Adaptive thinking включён по умолчанию, глубину рассуждения задаёт параметр effort. Уровни откалиброваны заново: один и тот же уровень не даёт того же объёма рассуждения, что на Sonnet 5, поэтому настройки effort стоит подбирать повторно. Anthropic советует начинать с high, а для агентного кодинга и многошаговой работы с инструментами — с medium, повышая уровень для более сложных и длинных задач.
При переходе с Sonnet 5 нужно учесть несколько несовместимых изменений:
thinking: {"type": "disabled"} возвращает ошибку 400; самый низкий режим — between_tools, который отключает предварительное рассуждение и работает только на low, medium и high;budget_tokens тоже возвращает ошибку 400;tool_choice со значениями any и tool) не поддерживается — для гарантии схемы Anthropic рекомендует strict tool use или structured outputs;temperature, top_p и top_k возвращают ошибку 400;computer_toolset_20260801, старый computer_20251124 принимает лишь Amazon Bedrock;Модель поддерживает серверные и клиентские инструменты, computer use и browser use, Files API, PDF, зрение, пакетную обработку и prompt caching с минимальным кэшируемым промптом 512 токенов (у Sonnet 5 — 1024). Также доступны смена effort для отдельного сообщения (beta), системные сообщения посреди диалога и сжатие контекста по запросу (beta). В Claude Code модель подходит для работы с репозиторием, запуска тестов и правок в нескольких файлах.
| Категория | Claude Sonnet 5.5 | Claude Sonnet 5 | Claude Opus 5.5 |
|---|---|---|---|
| Вход, за 1 млн токенов | $2 | $2 | $4 |
| Выход, за 1 млн токенов | $10 | $10 | $20 |
| Запись кэша на 5 минут | $2,50 | $2,50 | $5 |
| Запись кэша на 1 час | $4 | $4 | $8 |
| Чтение кэша | $0,20 | $0,20 | $0,20 |
| Batch API, вход / выход | $1 / $5 | $1 / $5 | $2 / $10 |
Прайс Sonnet 5.5 полностью совпадает с Sonnet 5, включая кэш и пакетную обработку. Ставка $2/$10 для Sonnet 5 изначально объявлялась как вводная до 31 августа 2026 года, но Anthropic сделала её постоянной и отменила повышение до $3/$15. Весь контекст в 1M токенов тарифицируется по стандартной ставке без надбавки за длинные запросы. US-only inference (inference_geo: "us") добавляет коэффициент 1,1 ко всем категориям токенов. Fast mode для Sonnet 5.5 не предусмотрен — он доступен только для моделей Opus.
| Тест | Sonnet 5.5 | Opus 5.5 | Что важно знать |
|---|---|---|---|
| Terminal-Bench 4.0 | 70,6% | 66,4% | у Opus 5.5 — на уровне xhigh |
| CursorBench 4.0 | 55,5% | 57,8% | Sonnet 5 — 34,1% |
| FrontierCode 1.1 (Main) | 46,2% | 54,4% | Sonnet 5.5 на max; на xhigh результат выше |
| GDPval-AA v2.1 | 1844 Elo | 1846 Elo | Sonnet 5 — 1449 |
| AA-Briefcase v1.1 | 1811 Elo | 1822 Elo | Sonnet 5 — 1359 |
| Humanity's Last Exam с инструментами | 64,5% | 67,7% | Sonnet 5 — 54,9% |
| OSWorld 2.1 (partial) | 80,1% | 81,8% | Sonnet 5 — 57,0% |
| Chartography без инструментов | 61,6% | 64,4% | Sonnet 5 — 15,6% |
Все цифры опубликованы Anthropic и пока не подтверждены независимыми прогонами. GDPval-AA и AA-Briefcase измеряла Artificial Analysis на предрелизной версии, в которой была ошибка structured outputs. В сравнении с GPT-6 Sol Anthropic приводит FrontierCode (49,3%, на xhigh — 52,1%), GDPval-AA (1487) и Chartography (53,6%); часть результатов GPT-6 Sol могла быть получена до исправления ошибки в распознавании изображений. Бенчмарки не измеряют качество русского текста, стабильность вашей связки инструментов и стоимость человеческой проверки.
В каталоге OSWorld 2.1 учитывается в строке OSWorld, как и у Opus 5.5. Отдельно Anthropic отмечает, что Sonnet 5.5 стала первой моделью Sonnet, прошедшей Pokémon Red только по скриншотам.
По кибервозможностям Sonnet 5.5 сопоставима с Claude Opus 5, поэтому это первая модель Sonnet, которая запускается с защитой в области кибербезопасности: рискованные задачи в этой области видимо передаются на Sonnet 5. В ближайшее время специалисты по киберзащите смогут подать заявку в расширенную программу Cyber Verification, чтобы получить поэтапный доступ к более продвинутым возможностям. Защита в биологической области такая же, как у Sonnet 5. Кроме того, Sonnet 5.5 — первая модель Sonnet с классификаторами, которые не дают извлечь её внутреннее рассуждение.
Отказы в API приходят с stop_reason: "refusal" и категорией в stop_details: cyber, bio, frontier_llm, reasoning_extraction или general_harms. Серверный fallback (beta) повторяет отказы категорий cyber и frontier_llm на Sonnet 5.
Лучший в линейке Anthropic результат на Terminal-Bench 4.0 и заметный рост на CursorBench 4.0 делают Sonnet 5.5 основным кандидатом для кодинг-агентов в терминале и IDE. Для самых сложных задач, где важен FrontierCode, Opus 5.5 всё ещё впереди.
80,1% на OSWorld 2.1 против 57,0% у Sonnet 5 — серьёзный шаг для сценариев, где агент управляет интерфейсами, формами и таблицами. Для Claude API нужно перейти на новый набор инструментов computer use.
Результаты GDPval-AA и AA-Briefcase почти совпадают с Opus 5.5, а Chartography вырос с 15,6% до 61,6%. Это делает модель разумным выбором для отчётов, анализа таблиц и графиков при вдвое меньшей цене токенов.
Sonnet 5.5 доступна всем клиентам Claude API, а также в Amazon Bedrock, Claude Platform on AWS, Google Cloud и Microsoft Foundry; поддерживается Zero Data Retention. В GitHub Copilot модель с 28 сентября 2026 года постепенно открывается пользователям Pro, Pro+, Max, Business и Enterprise в VS Code, Visual Studio, JetBrains IDE, Xcode, Eclipse, Copilot CLI, coding agent, на github.com и в GitHub Mobile; оплата идёт по прайсу провайдера в рамках usage-based billing. В приложениях Claude модель по умолчанию работает на уровне medium.
| Модель | Цена API, вход/выход | Когда выбирать |
|---|---|---|
| Claude Fable 5.1 | $10 / $50 | многочасовые агентные исследования и самые сложные проекты |
| Claude Opus 5.5 | $4 / $20 | сложный код и задачи, где Sonnet 5.5 не проходит ваши проверки |
| Claude Sonnet 5.5 | $2 / $10 | основная нагрузка: кодинг-агенты, computer use, документы |
| Claude Sonnet 5 | $2 / $10 | только если интеграция пока не готова к изменениям API |
Цена Sonnet 5.5 и Sonnet 5 одинакова, поэтому главный вопрос миграции — не стоимость, а совместимость кода. Соберите 20–50 типичных задач, подберите effort заново и сравните долю успешных результатов, время и расход токенов.
Anthropic выпустила модель 28 сентября 2026 года. Она сменила Claude Sonnet 5 и стала второй моделью семейства Claude 5.5 после Opus 5.5.
$2 за миллион входных и $10 за миллион выходных токенов, чтение кэша — $0,20, запись кэша — $2,50 на 5 минут или $4 на час. В Batch API действует скидка 50%.
По данным Anthropic, модель работает более чем на 30% быстрее, стоит до 30% меньше в расчёте на задачу и заметно сильнее на CursorBench 4.0, OSWorld 2.1, Humanity's Last Exam и Chartography. Цена токенов при этом не изменилась.
Значение disabled больше не принимается. Минимальный режим — between_tools: он отключает предварительное рассуждение и работает на уровнях effort до high.
Россия не входит в список регионов, которые поддерживает Anthropic. Использование API из неподдерживаемой страны нарушает условия сервиса; перед интеграцией проверяйте официальный список регионов и условия облачного провайдера.
Цены приведены за 1 млн токенов и могут меняться. Доступность российских провайдеров проверяется на их стороне.
$2.00 / $10.00 за 1M токенов; cache read $0.20, cache write $2.50 (5 мин) / $4.00 (1 ч); Batch API $1.00 / $5.00
Рассчитать сценарий →Для диаграммы пока недостаточно сопоставимых тестов.
История семейства
Последовательность собрана по датам релиза моделей Anthropic в каталоге. Она показывает соседние поколения, но не приписывает им совместимость или наследование архитектуры без отдельного источника.
Сервисы, инструменты, материалы и обсуждения, связанные с моделью.
Откройте результаты по названию модели и проверьте актуальную интеграцию.
Точных связей пока нет. Искать по разработчику.
Задайте вопрос сообществу — карточка модели будет прикреплена автоматически.