Текущая2026-10-07

От Anthropic
Claude Haiku 5.5 — самая быстрая и дешёвая модель семейства Claude 5.5, вышедшая 7 октября 2026 года на смену Claude Haiku 4.5. Это первая Haiku с adaptive thinking и уровнями effort от low до max: контекст вырос до 1M токенов, вывод — до 128K. Для запросов до 100K токенов модель стоит $0,10 / $0,50 за 1M токенов — на 90% дешевле Haiku 4.5; с учётом нового токенизатора, который даёт примерно на 30% больше токенов, Anthropic оценивает среднюю экономию в 75%. По данным Anthropic, Haiku 5.5 набирает 72,4% на OSWorld 2.1 против 15,7% у предшественницы, 39,2% на Terminal-Bench 4.0 и 1620 Elo на GDPval-AA v2.1, обходя GPT-6 Luna по той же цене. Модель рассчитана на классификацию, извлечение данных, маршрутизацию, поддержку в реальном времени и роль субагента при Opus 5.5 и Sonnet 5.5.
Для Claude Haiku 5.5 пока нет совпавших результатов в подключённых публичных лидербордах. Исходные значения карточки не используются для G‑Score.
Показатели G‑Код, G‑Рассуждения, G‑Агенты и G‑Зрение рассчитаны по массовым таблицам LiveBench, Artificial Analysis и LMArena. Наведите или нажмите на значок рядом с оценкой, чтобы увидеть исходный лидерборд, вариант модели, значение и размер выборки.
Уверенность данных
низкая
Покрытие
0 тестов · 0 направлений
Происхождение
нет данных лидербордов
Место исходного бенчмарка показывается только при закреплённом source record и среди других карточек с источником. Эти старые значения не участвуют в G-Score лидербордов.
| Бенчмарк | Результат | Место | Доказательство |
|---|---|---|---|
| Humanity's Last Exam | 45.9% | н/д | Источник не указан |
| OSWorld 2.0 (Компьютер) | 72.4% | н/д | Источник не указан |
| Chartography | 46.4% | н/д | Источник не указан |
| FrontierCode | 46.4% | н/д | Источник не указан |
| Humanity's Last Exam с инструментами | 57.4% | н/д | Источник не указан |
| AA-Briefcase (Elo) | 1578 | н/д | Источник не указан |
| GDPval-AA v2 (Elo) | 1620 | н/д | Источник не указан |
| Terminal-Bench 4.0 | 39.2% | н/д | Источник не указан |
Claude Haiku 5.5 — младшая модель семейства Claude 5.5 и самая быстрая модель Anthropic при стандартной скорости вывода. Для запросов до 100K токенов она стоит $0,10 / $0,50 за 1M токенов — на 90% дешевле Claude Haiku 4.5 и столько же, сколько GPT-6 Luna. При этом модель получила контекст 1M токенов, adaptive thinking с уровнями effort и, по данным Anthropic, вышла на уровень, где работа с компьютером, документами и терминалом перестаёт быть задачей только для старших моделей. Её стоит рассматривать для массовой классификации, извлечения данных, маршрутизации запросов, поддержки в реальном времени и как субагента при Claude Opus 5.5 или Claude Sonnet 5.5.
Anthropic выпустила Haiku 5.5 7 октября 2026 года — через две недели после Opus 5.5 и через девять дней после Sonnet 5.5. Модель сменила Claude Haiku 4.5, вышедшую в октябре 2025 года, и стала первой моделью линейки Haiku с параметром effort: доступны уровни low, medium, high, xhigh и max, по умолчанию в API — medium. Рассуждение работает в режиме adaptive thinking: модель сама решает, когда и сколько думать. Отключить его можно значением thinking: {"type": "disabled"}, но только на уровне effort high и ниже.
| Параметр | Значение |
|---|---|
| Идентификатор API | claude-haiku-5-5; в Amazon Bedrock — anthropic.claude-haiku-5-5 |
| Вход → выход | текст и изображения → текст |
| Контекст | 1M токенов (у Haiku 4.5 — 200K) |
| Максимальный вывод | 128K токенов (у Haiku 4.5 — 64K); до 300K в Message Batches API с beta-заголовком output-300k-2026-03-24 |
| Рассуждение | adaptive thinking, effort от low до max, по умолчанию medium |
| Граница знаний | июнь 2026 года |
| Платформы | Claude API, Amazon Bedrock, Google Cloud, Microsoft Foundry, Claude Platform on AWS |
| Поддержка | не раньше 7 октября 2027 года |
Haiku 5.5 использует тот же токенизатор, что и модели Claude начиная с Opus 4.7: один и тот же текст превращается примерно в 30% больше токенов, чем у Haiku 4.5. Это нужно учитывать при пересчёте бюджетов и лимитов max_tokens, тем более что токены рассуждения тоже входят в этот лимит.
| Категория, за 1M токенов | Haiku 5.5 (до 100K / свыше 100K) | Haiku 4.5 | Sonnet 5.5 |
|---|---|---|---|
| Вход | $0,10 / $0,50 | $1 | $2 |
| Выход | $0,50 / $2,50 | $5 | $10 |
| Запись кэша на 5 минут | $0,125 / $0,625 | $1,25 | $2,50 |
| Запись кэша на 1 час | $0,20 / $1 | $2 | $4 |
| Чтение кэша | $0,01 / $0,05 | $0,10 | $0,10 |
Цена зависит от длины запроса: если промпт короче 100 тысяч токенов, действует нижняя ставка, если длиннее — ставка в пять раз выше. Для коротких запросов это снижение на 90% по сравнению с Haiku 4.5, для длинных — на 50%. С поправкой на новый токенизатор Anthropic оценивает среднюю экономию в 75%. В Batch API действует скидка 50% на вход и выход.
Одновременно Anthropic вдвое снизила цену чтения кэша у Sonnet 5.5 — с $0,20 до $0,10 за 1M токенов. По оценке компании, это делает большинство агентных задач на Sonnet 5.5 примерно на 20% дешевле, поэтому связка «Sonnet 5.5 или Opus 5.5 как ведущая модель и Haiku 5.5 как субагент» подешевела с двух сторон.
Цифры из таблицы Anthropic в анонсе модели. Для сравнения — предшественница, GPT-6 Luna с такой же ценой токенов и Sonnet 5.5 из той же таблицы.
| Тест | Haiku 5.5 | Haiku 4.5 | GPT-6 Luna | Sonnet 5.5 |
|---|---|---|---|---|
| GDPval-AA v2.1 (Elo) | 1620 | 735 | 1437 | 1840 |
| AA-Briefcase v1.1 (Elo) | 1578 | 614 | 1336 | 1824 |
| OSWorld 2.1, offline subset | 72,4% | 15,7% | 48,9% | 83,9% |
| Humanity's Last Exam без инструментов | 45,9% | 10,2% | — | 56,9% |
| Humanity's Last Exam с инструментами | 57,4% | 18,7% | — | 64,5% |
| Terminal-Bench 4.0 | 39,2% | 0,0% | 16,4% | 70,6% |
| FrontierCode 1.1 (Main) | 46,4% | — | 42,4% | 52,1% (xhigh) |
| Chartography без инструментов | 46,4% | 6,4% | 29,1% | 61,6% |
Главный скачок — в работе с компьютером: на OSWorld 2.1 модель выросла с 15,7% до 72,4% и обошла GPT-6 Luna почти на 24 пункта. В знаниевой работе (GDPval-AA, AA-Briefcase) Haiku 5.5 больше чем вдвое сильнее Haiku 4.5 и заметно сильнее Luna. На FrontierCode младшая модель отстаёт от Sonnet 5.5 всего на 5,7 пункта, а вот в длинных терминальных задачах разрыв остаётся большим: 39,2% против 70,6% на Terminal-Bench 4.0. Anthropic сама пишет, что для сложного агентного программирования лучше подходят Sonnet 5.5 и Opus 5.5.
Все значения опубликованы Anthropic и пока не подтверждены независимыми прогонами. OSWorld 2.1 здесь — offline-подмножество с частичным зачётом, Terminal-Bench 4.0 — pass@1, GDPval-AA измеряла Artificial Analysis. Уровни effort для каждой строки в анонсе не указаны, подробности — в system card. Цифры Sonnet 5.5 в этой таблице отличаются от тех, что Anthropic публиковала на запуске Sonnet 5.5 (например, OSWorld 2.1 — 83,9% против 80,1%), поэтому в карточке Sonnet 5.5 оставлены исходные значения из её собственного анонса.
Переход с Haiku 4.5 требует правок в коде — Haiku 5.5 ведёт себя так же, как остальные модели поколения 5.5:
budget_tokens и ручной extended thinking возвращают ошибку — вместо них adaptive thinking и параметр effort.temperature, top_p и top_k возвращают ошибку 400, их нужно убрать из запросов.messages должен заканчиваться репликой пользователя.computer_toolset_20260801 вместо computer_20250124; появился инструмент browser use.thinking, а текст рассуждения по умолчанию не возвращается — блоки нужно выбирать по полю type.stop_reason: "refusal".В тот же день Anthropic добавила computer use и browser use в beta-версии Python и TypeScript SDK, а подписчики Max и Team начали получать ежемесячные кредиты на API: $100 на Max 5x, $200 на Max 20x и до $500 на команду в Team.
Для длинных задач в терминале, сложного рефакторинга и многошагового агентного кодинга разница со старшими моделями существенна — там лучше брать Sonnet 5.5 или Opus 5.5.
По оценке Anthropic, Haiku 5.5 заметно лучше Haiku 4.5 по метрикам выравнивания: реже демонстрирует нежелательное поведение и реже соглашается помогать со злоупотреблениями. Защита в области кибербезопасности строже, чем у Haiku 4.5, но мягче, чем у других свежих моделей Anthropic; пентест и похожие наступательные техники заблокированы. Защита в биологической области такая же, как у Sonnet 5, Sonnet 5.5 и Opus 5. Организации, которым нужна работа с этими темами, могут подать заявку в программы Life Sciences и Cyber Verification.
| Модель | Цена API, вход/выход за 1M | Контекст | Веса |
|---|---|---|---|
| Claude Haiku 5.5 | $0,10 / $0,50 (до 100K) | 1M | закрыты |
| GPT-6 Luna | $0,10 / $0,50 | 1,05M | закрыты |
| MiMo-V2.6-Flash | $0,14 / $0,28 | 1M | MIT |
| DeepSeek V4.1 Flash | $0,15 / $0,60 | — | закрыты |
| Gemini 3.8 Flash | $0,75 / $3,75 | 1M | закрыты |
| Claude Haiku 4.5 | $1 / $5 | 200K | закрыты |
| Claude Sonnet 5.5 | $2 / $10 | 1M | закрыты |
7 октября 2026 года. Модель сменила Claude Haiku 4.5 и стала третьей моделью семейства Claude 5.5 после Opus 5.5 и Sonnet 5.5.
Для запросов до 100 тысяч токенов — $0,10 за 1M входных и $0,50 за 1M выходных токенов, для более длинных — $0,50 и $2,50. Чтение кэша — $0,01, запись — $0,125 на 5 минут или $0,20 на час. В Batch API скидка 50%.
1M токенов на вход и до 128K токенов на выход; в Message Batches API с beta-заголовком — до 300K токенов вывода.
Контекст больше в пять раз, вывод — в два, появились adaptive thinking и уровни effort, а цена коротких запросов ниже на 90%. По данным Anthropic, OSWorld 2.1 вырос с 15,7% до 72,4%, Terminal-Bench 4.0 — с 0% до 39,2%, GDPval-AA v2.1 — с 735 до 1620 Elo.
Не всегда. Нужно убрать temperature, top_p, top_k и budget_tokens, отказаться от prefill ответа, выбирать блоки ответа по типу и пересчитать бюджеты токенов: новый токенизатор даёт примерно на 30% больше токенов на тот же текст.
Цены приведены за 1 млн токенов и могут меняться. Доступность российских провайдеров проверяется на их стороне.
$0.10 / $0.50 за 1M токенов для запросов до 100K токенов, свыше 100K — $0.50 / $2.50; cache read $0.01, cache write $0.125 (5 мин) / $0.20 (1 ч); Batch API −50%
Рассчитать сценарий →Для диаграммы пока недостаточно сопоставимых тестов.
История семейства
Последовательность собрана по датам релиза моделей Anthropic в каталоге. Она показывает соседние поколения, но не приписывает им совместимость или наследование архитектуры без отдельного источника.
Сервисы, инструменты, материалы и обсуждения, связанные с моделью.
Откройте результаты по названию модели и проверьте актуальную интеграцию.
Точных связей пока нет. Искать по разработчику.
Задайте вопрос сообществу — карточка модели будет прикреплена автоматически.