TL;DR
Claude Haiku 5.5 — самая быстрая малая модель Anthropic в стандартном режиме для задач с высоким объёмом и чувствительных к задержке. Она сочетает контекстное окно на 1 миллион токенов, стандартный лимит вывода 128K, адаптивное рассуждение и базовые цены от $0.10 за миллион входных токенов и $0.50 за миллион выходных токенов. Тарифы повышаются, когда промпт превышает 100,000 токенов. Для сложного кодирования и длительной агентной работы более сильным выбором остаются Sonnet 5.5 и Opus 5.5. Цены CometAPI в тарифе Standard на 20% ниже официальных, начиная с $0.08 за миллион входных токенов и $0.40 за миллион выходных токенов. Страница модели CometAPI доступна и сообщает о продакшен-доступе к API.
Key Takeaways
- Официальный релиз: 7 октября 2026; ID модели в Claude API: claude-haiku-5-5.
- Начальные тарифы API: $0.10 за вход и $0.50 за выход за миллион токенов для промптов до 100K токенов. CometAPI: $0.08 за вход и $0.40 за выход за миллион токенов на уровне 80% от официальных тарифов Standard.
- Контекст и вывод: 1M токенов контекста и 128K токенов стандартного вывода.
- Фокус: классификация, извлечение данных из документов, роутинг, поддержка и делегированные задачи агентов.
- Новый токенизатор может насчитывать примерно на 30% больше токенов для того же текста; оценивайте стоимость на принятую задачу, а не только цену за токен.
What Is Claude Haiku 5.5?
Claude Haiku 5.5 — лёгкая модель в текущем семействе Claude от Anthropic, разработанная для больших объёмов запросов, где ключевыми являются отклик и экономичность эксплуатации. Её основные применения — обработка документов, диалоговая поддержка, извлечение информации и компактные задания подагентов. Обзор модели Anthropic подтверждает дату запуска, возможности и идентификаторы на платформе.
Claude Haiku 5.5 — первая модель Haiku с поддержкой настраиваемых уровней усилия, позволяющая разработчикам балансировать глубину рассуждений, задержку и использование токенов в рамках одной модели.
What Are the Key Features of Claude Haiku 5.5?
Adaptive thinking and adjustable effort
Haiku 5.5 может решать, когда и насколько глубоко рассуждать, а параметр effort предоставляет разработчикам способ балансировать качество отклика, задержку и расход токенов. Значение по умолчанию — medium. Для простой классификации может быть предпочтительно низкое усилие; для неоднозначного извлечения или шага планирования инструментов оправдана более высокая настройка.
Large-context processing
Контекстное окно на 1M токенов позволяет уместить длинные документы и значительную историю диалога в одном запросе. Разработчикам всё же следует использовать retrieval, усечение и кэширование там, где это уместно: длинные контексты могут вносить ненужные затраты и компромиссы по точности, особенно за пределами порога 100K по тарифам.
Low-cost high-throughput processing
Новые стартовые ставки $0.10/$0.50 делают повторяющиеся короткие запросы существенно дешевле предыдущего поколения Haiku в пересчёте на токен. Однако Anthropic документирует изменённый токенизатор: идентичный текст даёт примерно на 30% больше токенов, чем на Haiku 4.5. Поэтому фактическая экономия на уровне задач может оказаться меньше, чем снижение ставок на уровне заголовков.
Computer use and delegated agent tasks
Опубликованные оценки показывают более сильную производительность во взаимодействии с компьютером и задачах с инструментами по сравнению с предыдущей моделью Haiku. Это делает Haiku 5.5 полезной для ограниченных шагов агентов, но успешная автоматизация по‑прежнему зависит от надёжных прав на инструменты, восстановления после ошибок и человеческого одобрения для рискованных действий.
How Does Claude Haiku 5.5 Perform on Benchmarks?
Anthropic сообщает о заметном росте по задачам профессиональных знаний, использованию компьютера, кодированию и рассуждению. Приведённые ниже результаты используют описанные конфигурации оценивания; результаты разных бенчмарков не следует объединять в единую «оценку интеллекта».
| Benchmark | Haiku 4.5 | Haiku 5.5 | Sonnet 5.5 |
|---|---|---|---|
| GDPval-AA v2.1 (Elo) | 735 | 1,620 | 1,840 |
| AA-Briefcase v1.1 (Elo) | 614 | 1,578 | 1,824 |
| OSWorld 2.1, offline subset, partial credit | 15.7% | 72.4% | 83.9% |
| Humanity's Last Exam, no tools | 10.2% | 45.9% | 56.9% |
| Humanity's Last Exam, with tools | 18.7% | 57.4% | 64.5% |
| Terminal-Bench 4.0 | 0.0% | 39.2% | 70.6% |
| Chartography, no tools | 6.4% | 46.4% | 61.6% |
Стандартная конфигурация оценивания Haiku 5.5 в системной карточке использует adaptive thinking на максимальном усилии, параметры выборки по умолчанию и пять прогонов, если не указано иное; в продукте по умолчанию стоит medium, поэтому итоговые показатели не являются гарантиями на настройках по умолчанию. OSWorld использует 82 офлайн‑задачи, без доступа к интернету, 1080p и лимит 500 действий. Показатель 72.4% — это частичный кредит; строгая доля проходов — 37.1%. GDPval-AA и AA-Briefcase приводятся Anthropic по независимым оценкам Artificial Analysis.
Terminal-Bench 4.0 использует Claude Code в режиме --bare с включёнными мерами безопасности. Haiku 5.5 использует max effort, без резервной модели и без выхода в интернет, с 10 прогонами на задачу; Sonnet 5.5 использует пять прогонов и fallback для некоторых отмеченных запросов. Haiku 4.5 использует фиксированный бюджет рассуждений в 63,999 токенов. Эти различия конфигураций важны при интерпретации 39.2% против 70.6%.
Опубликованные результаты бенчмарков Anthropic предоставляют приведённые выше оценки. OSWorld использует свой офлайн‑поднабор; Humanity's Last Exam разделяет прогоны с инструментами и без них, а Chartography — без инструментов. Это результаты, опубликованные поставщиком, а не независимые измерения в универсальной конфигурации. Anthropic даёт детали оценивания в своей системной карточке Haiku 5.5; воспроизводите соответствующие настройки усилия, инструментов, каркаса и бюджетов перед сравнением собственных результатов. Сводка запуска не задаёт полностью общий тестовый контур для каждой строки.

Официальная графика оценки Anthropic выше воспроизведена из её системной карточки. Она даёт дополнительные свидетельства о задействованных конфигурациях; это не новый бенчмарк, созданный для этой статьи.
Benchmark Interpretation
Рост в OSWorld предполагает, что Haiku 5.5 стала значительно более полезной для структурированных графических задач. Однако 70.6% у Sonnet 5.5 против 39.2% у Haiku 5.5 в Terminal-Bench указывает на сохраняющееся преимущество более крупных моделей для агентного кодирования. Выбирайте модели в соответствии со стоимостью ошибки и сложностью реального рабочего процесса.
Claude Haiku 5.5 vs Haiku 4.5 vs Sonnet 5.5
| Dimension | Haiku 4.5 | Haiku 5.5 | Sonnet 5.5 |
|---|---|---|---|
| Context | 200K | 1M | 1M |
| Max standard output | 64K | 128K | 128K |
| Standard input / MTok | $1 | $0.10 up to 100K; $0.50 over | $2 |
| Standard output / MTok | $5 | $0.50 up to 100K; $2.50 over | $10 |
| Reasoning | Extended thinking with a fixed token budget | Adaptive; medium default | Adaptive; high default |
| Relative latency | Fast | Fastest at standard speed | Fast |
| Coding depth | Bounded tasks | Stronger subagents | More complex coding |
| Typical use | Legacy small-model deployments | High-volume workflows | Complex production workflows |
Общие характеристики: все три модели принимают текст и изображения на вход и выдают текст на выходе. Доступ к ним возможен через Claude API и поддерживаемые партнёрские платформы; идентификаторы моделей и доступ к аккаунту зависят от провайдера. Цитируемая продуктовая документация не устанавливает количества параметров или подробных архитектур.
Haiku 5.5 — разумный первый выбор для задач, поддающихся проверке и повторяющихся. Sonnet 5.5 становится предпочтительнее там, где более сильное суждение экономит повторные неудачные вызовы, попытки с инструментами или коррекции человеком. Opus 5.5 — опция для особенно требовательных многошаговых заданий.
Метки сравнительной задержки относятся к режимам стандартной скорости. Квалификация скорости Anthropic исключает Opus Fast Mode из заявления о самой быстрой модели. Детали архитектуры, такие как число параметров, не определяются этими продуктовыми уровнями. Ввод текста и изображений с текстовым выводом отличается от генерации изображений.
Сравнение возможностей следует спецификациям моделей Anthropic. Доступ к платформе зависит от выбранного провайдера и аккаунта; ни один уровень моделей не подразумевает опубликованного числа параметров.
Workload Selection
| Workload | Practical default | Why |
|---|---|---|
| Email classification | Haiku 5.5 | Short, repeated, verifiable decisions |
| Document field extraction | Haiku 5.5 | Cost-efficient structured processing |
| Support triage | Haiku 5.5 | Fast responses and escalation |
| Coding subagents | Haiku 5.5 | Low-cost file search and contained edits |
| Complex debugging | Sonnet 5.5 | Stronger coding benchmark performance |
| High-stakes multi-step reasoning | Opus 5.5 | More capable upper-tier model |
| Mixed workload | Haiku + Sonnet | Route by complexity and confidence |
How Much Does Claude Haiku 5.5 Cost?
Почему Haiku 5.5 рекламируется как «примерно на 75% дешевле», если цена за токен ниже на 90%?
Цифра 90% описывает снижение тарифов Standard на вход и выход для промптов до 100,000 токенов; для более длинных промптов снижение на 50%. Anthropic сообщает, что в среднем Haiku 5.5 обходится примерно на 75% дешевле в эксплуатации с учётом распределения длин запросов в более ранней модели и изменений в использовании токенов на задачу. Токенизация — один из факторов: один и тот же входной текст может считаться примерно на 30% большим числом токенов, поэтому оценку стоимости следует делать по подсчётам с новой моделью.
Официальные цены Anthropic имеют два диапазона по длине промпта. Тарифы в первой таблице — официальные цены в USD за миллион токенов; сравнение CometAPI ниже применяет скидку 20% к официальным ставкам Standard на вход и выход.
| Rate category | Prompt up to 100K | Prompt over 100K |
|---|---|---|
| Input | $0.10 | $0.50 |
| Output | $0.50 | $2.50 |
| 5-minute cache write | $0.125 | $0.625 |
| 1-hour cache write | $0.20 | $1.00 |
| Cache read | $0.01 | $0.05 |
| Batch input (50% off) | $0.05 | $0.25 |
| Batch output (50% off) | $0.25 | $1.25 |
Официальные ставки Standard, кэш и Batch приведены выше, проверены 8 октября 2026. Длина промпта определяет применяемый диапазон; более высокий диапазон применяется к запросу целиком, а не только к токенам сверх 100K. Ставки CometAPI Standard ниже равны соответствующим официальным ставкам Standard, умноженным на 0.8. Это сравнение не предполагает, что скидка шлюза суммируется со скидками Batch или кэширования.
| Prompt length | Token category | Official Standard / MTok | CometAPI / MTok |
|---|---|---|---|
| Up to 100K tokens | Input | $0.10 | $0.08 |
| Up to 100K tokens | Output | $0.50 | $0.40 |
| Over 100K tokens | Input | $0.50 | $0.40 |
| Over 100K tokens | Output | $2.50 | $2.00 |
Example: 100,000 short requests per month
Предположим, каждый запрос использует 2,000 входных токенов и 500 выходных токенов; каждый запрос остаётся ниже порога в 100K. Игнорируем кэширование промптов, инструменты и повторы и предполагаем одинаковые подсчёты токенов для моделей в иллюстративных целях.
| Model / provider | Input/month | Output/month | Total/month |
|---|---|---|---|
| Haiku 4.5 — official Standard | $200 | $250 | $450 |
| Haiku 5.5 — official Standard | $20 | $25 | $45 |
| Sonnet 5.5 — official Standard | $400 | $500 | $900 |
| Haiku 5.5 — CometAPI | $16 | $20 | $36 |
В этом примере 100,000 запросов используют 200 миллионов входных токенов и 50 миллионов выходных токенов. Стоимость входа через CometAPI: 200 × $0.08 = $16, а выхода: 50 × $0.40 = $20, итого $36 в месяц против официальных $45: экономия $9, или 20%. Сценарий исключает кэширование, инструменты и повторы и использует фиксированные подсчёты токенов; измеряйте стоимость принятой задачи на репрезентативных входах, поскольку новый токенизатор изменяет подсчёты токенов.
Сравнение $450‑к‑$45 — иллюстрация фиксированных токенов с 90% снижением ставок, а не обещание 90% экономии для эквивалентных реальных нагрузок. В своём анонсе запуска Anthropic сообщает примерно о 75% более низких средних затратах на запуск с учётом длин запросов и изменений в использовании токенов. Пересчитывайте репрезентативные входы и измеряйте стоимость завершённой задачи перед оценкой собственной экономии.
Where Can You Access Claude Haiku 5.5?
Official access and cloud platforms
Haiku 5.5 доступна через Claude API и поддерживаемые платформы на Amazon Web Services, Google Cloud и Microsoft Azure согласно анонсу доступности Anthropic. Прямой ID модели в Claude API — claude-haiku-5-5; в Amazon Bedrock — anthropic.claude-haiku-5-5. Используйте креденшелы, выданные выбранным провайдером, и проверяйте текущие требования к доступу в аккаунте.
Third-party access through CometAPI
Страница модели CometAPI сообщает о доступности claude-haiku-5-5 с тарифами Standard от $0.08 за миллион входных токенов и $0.40 за миллион выходных токенов для промптов до 100K, что на 20% ниже соответствующих официальных ставок. Используйте ключ, выданный CometAPI, с эндпоинтом и форматом запросов CometAPI; это отдельный маршрут доступа от прямого API Anthropic. Проверяйте актуальную страницу на предмет доступности, тарифных диапазонов и деталей интеграции.
При смене провайдера или обновлении с Haiku 4.5 проверяйте ID моделей, пересчитывайте токены и тестируйте лимиты отклика и обработку диалогов. Для деталей внедрения и несовместимых изменений см. руководство по миграции Anthropic.
Migration Validation
- Обновите ID модели и проверьте специфичные для эндпоинта поля запроса.
- Пересчитайте токены новым токенизатором, включая стабильные префиксы и определения инструментов.
- Протестируйте настройки adaptive-thinking, распределения задержек и парсинг блоков ответа.
- Проверьте вызовы инструментов, восстановление после ошибок и любые ограничения аккаунта на сохранённые thinking‑блоки.
- Сравните p50/p95 задержки, долю принятых задач и общее число биллинговых токенов.
- Используйте поэтапный rollout и путь отката для бизнес‑критичных рабочих процессов.
- Assistant prefill is banned
Руководство по миграции Haiku 5.5 объясняет поведение токенизатора, ID и совместимость запросов. Опустите temperature, top_p и top_k. Если заданы явно, temperature должна быть 1, а top_p — 0.99; любое значение top_k или одновременная передача temperature и top_p возвращают ошибку 400.
What Are the Limitations of Claude Haiku 5.5?
Haiku 5.5 не является универсальной заменой более крупным моделям. Сложное кодирование и длительные цепочки рассуждений остаются значимыми отличиями в пользу Sonnet и Opus. Более длинные промпты также стоят дороже, поэтому окно в 1M токенов следует использовать выборочно. Адаптивное рассуждение вводит вариативность в количестве генерируемых токенов и задержке; бенчмарки не устанавливают гарантий для отдельного бизнес‑процесса.
Для автоматизации с повышенным уровнем риска следует валидировать структурированные выходы, ограничивать права внешних инструментов, вести аудиторные логи и требовать ревью перед значимыми действиями. Направляйте сомнительные задачи на более сильные модели, а не полагайтесь только на более низкую базовую цену токена у Haiku.
Conclusion
Для высокообъёмной обработки с измеряемыми критериями приёмки Claude Haiku 5.5 — привлекательное обновление: более низкие входные цены, больший контекст, адаптивное рассуждение и более сильные опубликованные оценки. Для сложного программирования и неоднозначного принятия решений Sonnet 5.5 или Opus 5.5 могут обеспечить лучшую экономику за счёт уменьшения повторов и коррекций. Выигрышная стратегия — измерять весь рабочий процесс и маршрутизировать запросы по сложности.
FAQ
How does Haiku 5.5's 100K pricing boundary affect a cached workflow?
Длина промпта определяет применяемый тарифный диапазон; не оценивайте списание по одному лишь новому тексту и не предполагайте, что только «лишние» токены используют более высокую ставку. Считайте запрос для выбранной модели, включая историю и определения инструментов, затем соотносите вход, запись в кэш, чтение из кэша и выход с соответствующим диапазоном. Сравнивайте счета по репрезентативным кэшированным запросам перед установкой продакшен‑бюджета.
Can Haiku 5.5 thinking blocks be replayed across accounts?
Они работают только в аккаунте, где были созданы, или в связанном с ним аккаунте. Если несвязанный аккаунт отправит сохранённый thinking‑блок, API отбросит его до того, как модель его увидит; запрос всё ещё может выполниться без этого рассуждения. См. официальное руководство по миграции. Сохраняйте блоки диалога и используйте исходный или связанный аккаунт при продолжении рабочего процесса с инструментами. Смена шлюза или аккаунта должна тестироваться явно; совпадение имени модели не гарантирует, что сохранённые thinking‑блоки останутся применимыми.
Why can Haiku 5.5 truncate a response that Haiku 4.5 completed?
Новый токенизатор может насчитывать больше токенов для того же текста, поэтому неизменённый max_tokens может вмещать меньше эквивалентного вывода. Адаптивное рассуждение также может расходовать бюджет вывода. Проверьте stop_reason и usage, пересчитайте промпты новой моделью и перенастройте лимиты вывода на реальных задачах, а не копируйте прежние ограничения.
How should Haiku 5.5 routing thresholds be selected?
Используйте размеченную выборку из реальной нагрузки, чтобы измерить долю принятых задач, стоимость коррекции и задержку. Направляйте запросы, не прошедшие явную валидацию или выходящие за рамки протестированной задачи, на более сильную модель. Настраивайте порог относительно общей стоимости рабочего процесса, включая повторы и эскалацию, и мониторьте его после изменений в промптах, инструментах или effort.
