Claude Haiku 5.5 and Nano Banana 2.1 are now live on CometAPI →
ai-model/Исследования CometAPI

Что такое Claude Haiku 5.5? Характеристики, бенчмарки, цены, возможности и доступ к API

Изучите спецификации Claude Haiku 5.5, контекстное окно 1M, бенчмарки, цены на API, возможности и сравнения с Haiku 4.5 и Sonnet 5.5.

CometAPI
Deon GoodwinКоманда исследователей AI-моделей и API
Обновлено Oct 8, 2026 13 мин. чтения
Что такое Claude Haiku 5.5? Характеристики, бенчмарки, цены, возможности и доступ к API
Использовать этот подход

Сделайте первый вызов API.

from openai import OpenAI

client = OpenAI(
    api_key="YOUR_COMETAPI_KEY",
    base_url="https://api.cometapi.com/v1",
)

response = client.chat.completions.create(
    model="gpt-5-mini",
    messages=[{"role": "user", "content": "Build this workflow."}],
)

print(response.choices[0].message.content)

TL;DR

Claude Haiku 5.5 — самая быстрая малая модель Anthropic в стандартном режиме для задач с высоким объёмом и чувствительных к задержке. Она сочетает контекстное окно на 1 миллион токенов, стандартный лимит вывода 128K, адаптивное рассуждение и базовые цены от $0.10 за миллион входных токенов и $0.50 за миллион выходных токенов. Тарифы повышаются, когда промпт превышает 100,000 токенов. Для сложного кодирования и длительной агентной работы более сильным выбором остаются Sonnet 5.5 и Opus 5.5. Цены CometAPI в тарифе Standard на 20% ниже официальных, начиная с $0.08 за миллион входных токенов и $0.40 за миллион выходных токенов. Страница модели CometAPI доступна и сообщает о продакшен-доступе к API.

Key Takeaways

  • Официальный релиз: 7 октября 2026; ID модели в Claude API: claude-haiku-5-5.
  • Начальные тарифы API: $0.10 за вход и $0.50 за выход за миллион токенов для промптов до 100K токенов. CometAPI: $0.08 за вход и $0.40 за выход за миллион токенов на уровне 80% от официальных тарифов Standard.
  • Контекст и вывод: 1M токенов контекста и 128K токенов стандартного вывода.
  • Фокус: классификация, извлечение данных из документов, роутинг, поддержка и делегированные задачи агентов.
  • Новый токенизатор может насчитывать примерно на 30% больше токенов для того же текста; оценивайте стоимость на принятую задачу, а не только цену за токен.

What Is Claude Haiku 5.5?

Claude Haiku 5.5 — лёгкая модель в текущем семействе Claude от Anthropic, разработанная для больших объёмов запросов, где ключевыми являются отклик и экономичность эксплуатации. Её основные применения — обработка документов, диалоговая поддержка, извлечение информации и компактные задания подагентов. Обзор модели Anthropic подтверждает дату запуска, возможности и идентификаторы на платформе.

Claude Haiku 5.5 — первая модель Haiku с поддержкой настраиваемых уровней усилия, позволяющая разработчикам балансировать глубину рассуждений, задержку и использование токенов в рамках одной модели.

What Are the Key Features of Claude Haiku 5.5?

Adaptive thinking and adjustable effort

Haiku 5.5 может решать, когда и насколько глубоко рассуждать, а параметр effort предоставляет разработчикам способ балансировать качество отклика, задержку и расход токенов. Значение по умолчанию — medium. Для простой классификации может быть предпочтительно низкое усилие; для неоднозначного извлечения или шага планирования инструментов оправдана более высокая настройка.

Large-context processing

Контекстное окно на 1M токенов позволяет уместить длинные документы и значительную историю диалога в одном запросе. Разработчикам всё же следует использовать retrieval, усечение и кэширование там, где это уместно: длинные контексты могут вносить ненужные затраты и компромиссы по точности, особенно за пределами порога 100K по тарифам.

Low-cost high-throughput processing

Новые стартовые ставки $0.10/$0.50 делают повторяющиеся короткие запросы существенно дешевле предыдущего поколения Haiku в пересчёте на токен. Однако Anthropic документирует изменённый токенизатор: идентичный текст даёт примерно на 30% больше токенов, чем на Haiku 4.5. Поэтому фактическая экономия на уровне задач может оказаться меньше, чем снижение ставок на уровне заголовков.

Computer use and delegated agent tasks

Опубликованные оценки показывают более сильную производительность во взаимодействии с компьютером и задачах с инструментами по сравнению с предыдущей моделью Haiku. Это делает Haiku 5.5 полезной для ограниченных шагов агентов, но успешная автоматизация по‑прежнему зависит от надёжных прав на инструменты, восстановления после ошибок и человеческого одобрения для рискованных действий.

How Does Claude Haiku 5.5 Perform on Benchmarks?

Anthropic сообщает о заметном росте по задачам профессиональных знаний, использованию компьютера, кодированию и рассуждению. Приведённые ниже результаты используют описанные конфигурации оценивания; результаты разных бенчмарков не следует объединять в единую «оценку интеллекта».

BenchmarkHaiku 4.5Haiku 5.5Sonnet 5.5
GDPval-AA v2.1 (Elo)7351,6201,840
AA-Briefcase v1.1 (Elo)6141,5781,824
OSWorld 2.1, offline subset, partial credit15.7%72.4%83.9%
Humanity's Last Exam, no tools10.2%45.9%56.9%
Humanity's Last Exam, with tools18.7%57.4%64.5%
Terminal-Bench 4.00.0%39.2%70.6%
Chartography, no tools6.4%46.4%61.6%

Стандартная конфигурация оценивания Haiku 5.5 в системной карточке использует adaptive thinking на максимальном усилии, параметры выборки по умолчанию и пять прогонов, если не указано иное; в продукте по умолчанию стоит medium, поэтому итоговые показатели не являются гарантиями на настройках по умолчанию. OSWorld использует 82 офлайн‑задачи, без доступа к интернету, 1080p и лимит 500 действий. Показатель 72.4% — это частичный кредит; строгая доля проходов — 37.1%. GDPval-AA и AA-Briefcase приводятся Anthropic по независимым оценкам Artificial Analysis.

Terminal-Bench 4.0 использует Claude Code в режиме --bare с включёнными мерами безопасности. Haiku 5.5 использует max effort, без резервной модели и без выхода в интернет, с 10 прогонами на задачу; Sonnet 5.5 использует пять прогонов и fallback для некоторых отмеченных запросов. Haiku 4.5 использует фиксированный бюджет рассуждений в 63,999 токенов. Эти различия конфигураций важны при интерпретации 39.2% против 70.6%.
Опубликованные результаты бенчмарков Anthropic предоставляют приведённые выше оценки. OSWorld использует свой офлайн‑поднабор; Humanity's Last Exam разделяет прогоны с инструментами и без них, а Chartography — без инструментов. Это результаты, опубликованные поставщиком, а не независимые измерения в универсальной конфигурации. Anthropic даёт детали оценивания в своей системной карточке Haiku 5.5; воспроизводите соответствующие настройки усилия, инструментов, каркаса и бюджетов перед сравнением собственных результатов. Сводка запуска не задаёт полностью общий тестовый контур для каждой строки.

Что такое Claude Haiku 5.5? Характеристики, бенчмарки, цены, возможности и доступ к API

Официальная графика оценки Anthropic выше воспроизведена из её системной карточки. Она даёт дополнительные свидетельства о задействованных конфигурациях; это не новый бенчмарк, созданный для этой статьи.

Benchmark Interpretation

Рост в OSWorld предполагает, что Haiku 5.5 стала значительно более полезной для структурированных графических задач. Однако 70.6% у Sonnet 5.5 против 39.2% у Haiku 5.5 в Terminal-Bench указывает на сохраняющееся преимущество более крупных моделей для агентного кодирования. Выбирайте модели в соответствии со стоимостью ошибки и сложностью реального рабочего процесса.

Claude Haiku 5.5 vs Haiku 4.5 vs Sonnet 5.5

DimensionHaiku 4.5Haiku 5.5Sonnet 5.5
Context200K1M1M
Max standard output64K128K128K
Standard input / MTok$1$0.10 up to 100K; $0.50 over$2
Standard output / MTok$5$0.50 up to 100K; $2.50 over$10
ReasoningExtended thinking with a fixed token budgetAdaptive; medium defaultAdaptive; high default
Relative latencyFastFastest at standard speedFast
Coding depthBounded tasksStronger subagentsMore complex coding
Typical useLegacy small-model deploymentsHigh-volume workflowsComplex production workflows

Общие характеристики: все три модели принимают текст и изображения на вход и выдают текст на выходе. Доступ к ним возможен через Claude API и поддерживаемые партнёрские платформы; идентификаторы моделей и доступ к аккаунту зависят от провайдера. Цитируемая продуктовая документация не устанавливает количества параметров или подробных архитектур.

Haiku 5.5 — разумный первый выбор для задач, поддающихся проверке и повторяющихся. Sonnet 5.5 становится предпочтительнее там, где более сильное суждение экономит повторные неудачные вызовы, попытки с инструментами или коррекции человеком. Opus 5.5 — опция для особенно требовательных многошаговых заданий.

Метки сравнительной задержки относятся к режимам стандартной скорости. Квалификация скорости Anthropic исключает Opus Fast Mode из заявления о самой быстрой модели. Детали архитектуры, такие как число параметров, не определяются этими продуктовыми уровнями. Ввод текста и изображений с текстовым выводом отличается от генерации изображений.

Сравнение возможностей следует спецификациям моделей Anthropic. Доступ к платформе зависит от выбранного провайдера и аккаунта; ни один уровень моделей не подразумевает опубликованного числа параметров.

Workload Selection

WorkloadPractical defaultWhy
Email classificationHaiku 5.5Short, repeated, verifiable decisions
Document field extractionHaiku 5.5Cost-efficient structured processing
Support triageHaiku 5.5Fast responses and escalation
Coding subagentsHaiku 5.5Low-cost file search and contained edits
Complex debuggingSonnet 5.5Stronger coding benchmark performance
High-stakes multi-step reasoningOpus 5.5More capable upper-tier model
Mixed workloadHaiku + SonnetRoute by complexity and confidence

How Much Does Claude Haiku 5.5 Cost?

Почему Haiku 5.5 рекламируется как «примерно на 75% дешевле», если цена за токен ниже на 90%?

Цифра 90% описывает снижение тарифов Standard на вход и выход для промптов до 100,000 токенов; для более длинных промптов снижение на 50%. Anthropic сообщает, что в среднем Haiku 5.5 обходится примерно на 75% дешевле в эксплуатации с учётом распределения длин запросов в более ранней модели и изменений в использовании токенов на задачу. Токенизация — один из факторов: один и тот же входной текст может считаться примерно на 30% большим числом токенов, поэтому оценку стоимости следует делать по подсчётам с новой моделью.

Официальные цены Anthropic имеют два диапазона по длине промпта. Тарифы в первой таблице — официальные цены в USD за миллион токенов; сравнение CometAPI ниже применяет скидку 20% к официальным ставкам Standard на вход и выход.

Rate categoryPrompt up to 100KPrompt over 100K
Input$0.10$0.50
Output$0.50$2.50
5-minute cache write$0.125$0.625
1-hour cache write$0.20$1.00
Cache read$0.01$0.05
Batch input (50% off)$0.05$0.25
Batch output (50% off)$0.25$1.25

Официальные ставки Standard, кэш и Batch приведены выше, проверены 8 октября 2026. Длина промпта определяет применяемый диапазон; более высокий диапазон применяется к запросу целиком, а не только к токенам сверх 100K. Ставки CometAPI Standard ниже равны соответствующим официальным ставкам Standard, умноженным на 0.8. Это сравнение не предполагает, что скидка шлюза суммируется со скидками Batch или кэширования.

Prompt lengthToken categoryOfficial Standard / MTokCometAPI / MTok
Up to 100K tokensInput$0.10$0.08
Up to 100K tokensOutput$0.50$0.40
Over 100K tokensInput$0.50$0.40
Over 100K tokensOutput$2.50$2.00

Example: 100,000 short requests per month

Предположим, каждый запрос использует 2,000 входных токенов и 500 выходных токенов; каждый запрос остаётся ниже порога в 100K. Игнорируем кэширование промптов, инструменты и повторы и предполагаем одинаковые подсчёты токенов для моделей в иллюстративных целях.

Model / providerInput/monthOutput/monthTotal/month
Haiku 4.5 — official Standard$200$250$450
Haiku 5.5 — official Standard$20$25$45
Sonnet 5.5 — official Standard$400$500$900
Haiku 5.5 — CometAPI$16$20$36

В этом примере 100,000 запросов используют 200 миллионов входных токенов и 50 миллионов выходных токенов. Стоимость входа через CometAPI: 200 × $0.08 = $16, а выхода: 50 × $0.40 = $20, итого $36 в месяц против официальных $45: экономия $9, или 20%. Сценарий исключает кэширование, инструменты и повторы и использует фиксированные подсчёты токенов; измеряйте стоимость принятой задачи на репрезентативных входах, поскольку новый токенизатор изменяет подсчёты токенов.

Сравнение $450‑к‑$45 — иллюстрация фиксированных токенов с 90% снижением ставок, а не обещание 90% экономии для эквивалентных реальных нагрузок. В своём анонсе запуска Anthropic сообщает примерно о 75% более низких средних затратах на запуск с учётом длин запросов и изменений в использовании токенов. Пересчитывайте репрезентативные входы и измеряйте стоимость завершённой задачи перед оценкой собственной экономии.

Where Can You Access Claude Haiku 5.5?

Official access and cloud platforms

Haiku 5.5 доступна через Claude API и поддерживаемые платформы на Amazon Web Services, Google Cloud и Microsoft Azure согласно анонсу доступности Anthropic. Прямой ID модели в Claude API — claude-haiku-5-5; в Amazon Bedrock — anthropic.claude-haiku-5-5. Используйте креденшелы, выданные выбранным провайдером, и проверяйте текущие требования к доступу в аккаунте.

Third-party access through CometAPI

Страница модели CometAPI сообщает о доступности claude-haiku-5-5 с тарифами Standard от $0.08 за миллион входных токенов и $0.40 за миллион выходных токенов для промптов до 100K, что на 20% ниже соответствующих официальных ставок. Используйте ключ, выданный CometAPI, с эндпоинтом и форматом запросов CometAPI; это отдельный маршрут доступа от прямого API Anthropic. Проверяйте актуальную страницу на предмет доступности, тарифных диапазонов и деталей интеграции.

При смене провайдера или обновлении с Haiku 4.5 проверяйте ID моделей, пересчитывайте токены и тестируйте лимиты отклика и обработку диалогов. Для деталей внедрения и несовместимых изменений см. руководство по миграции Anthropic.

Migration Validation

  • Обновите ID модели и проверьте специфичные для эндпоинта поля запроса.
  • Пересчитайте токены новым токенизатором, включая стабильные префиксы и определения инструментов.
  • Протестируйте настройки adaptive-thinking, распределения задержек и парсинг блоков ответа.
  • Проверьте вызовы инструментов, восстановление после ошибок и любые ограничения аккаунта на сохранённые thinking‑блоки.
  • Сравните p50/p95 задержки, долю принятых задач и общее число биллинговых токенов.
  • Используйте поэтапный rollout и путь отката для бизнес‑критичных рабочих процессов.
  • Assistant prefill is banned

Руководство по миграции Haiku 5.5 объясняет поведение токенизатора, ID и совместимость запросов. Опустите temperature, top_p и top_k. Если заданы явно, temperature должна быть 1, а top_p — 0.99; любое значение top_k или одновременная передача temperature и top_p возвращают ошибку 400.

What Are the Limitations of Claude Haiku 5.5?

Haiku 5.5 не является универсальной заменой более крупным моделям. Сложное кодирование и длительные цепочки рассуждений остаются значимыми отличиями в пользу Sonnet и Opus. Более длинные промпты также стоят дороже, поэтому окно в 1M токенов следует использовать выборочно. Адаптивное рассуждение вводит вариативность в количестве генерируемых токенов и задержке; бенчмарки не устанавливают гарантий для отдельного бизнес‑процесса.

Для автоматизации с повышенным уровнем риска следует валидировать структурированные выходы, ограничивать права внешних инструментов, вести аудиторные логи и требовать ревью перед значимыми действиями. Направляйте сомнительные задачи на более сильные модели, а не полагайтесь только на более низкую базовую цену токена у Haiku.

Conclusion

Для высокообъёмной обработки с измеряемыми критериями приёмки Claude Haiku 5.5 — привлекательное обновление: более низкие входные цены, больший контекст, адаптивное рассуждение и более сильные опубликованные оценки. Для сложного программирования и неоднозначного принятия решений Sonnet 5.5 или Opus 5.5 могут обеспечить лучшую экономику за счёт уменьшения повторов и коррекций. Выигрышная стратегия — измерять весь рабочий процесс и маршрутизировать запросы по сложности.

FAQ

How does Haiku 5.5's 100K pricing boundary affect a cached workflow?

Длина промпта определяет применяемый тарифный диапазон; не оценивайте списание по одному лишь новому тексту и не предполагайте, что только «лишние» токены используют более высокую ставку. Считайте запрос для выбранной модели, включая историю и определения инструментов, затем соотносите вход, запись в кэш, чтение из кэша и выход с соответствующим диапазоном. Сравнивайте счета по репрезентативным кэшированным запросам перед установкой продакшен‑бюджета.

Can Haiku 5.5 thinking blocks be replayed across accounts?

Они работают только в аккаунте, где были созданы, или в связанном с ним аккаунте. Если несвязанный аккаунт отправит сохранённый thinking‑блок, API отбросит его до того, как модель его увидит; запрос всё ещё может выполниться без этого рассуждения. См. официальное руководство по миграции. Сохраняйте блоки диалога и используйте исходный или связанный аккаунт при продолжении рабочего процесса с инструментами. Смена шлюза или аккаунта должна тестироваться явно; совпадение имени модели не гарантирует, что сохранённые thinking‑блоки останутся применимыми.

Why can Haiku 5.5 truncate a response that Haiku 4.5 completed?

Новый токенизатор может насчитывать больше токенов для того же текста, поэтому неизменённый max_tokens может вмещать меньше эквивалентного вывода. Адаптивное рассуждение также может расходовать бюджет вывода. Проверьте stop_reason и usage, пересчитайте промпты новой моделью и перенастройте лимиты вывода на реальных задачах, а не копируйте прежние ограничения.

How should Haiku 5.5 routing thresholds be selected?

Используйте размеченную выборку из реальной нагрузки, чтобы измерить долю принятых задач, стоимость коррекции и задержку. Направляйте запросы, не прошедшие явную валидацию или выходящие за рамки протестированной задачи, на более сильную модель. Настраивайте порог относительно общей стоимости рабочего процесса, включая повторы и эскалацию, и мониторьте его после изменений в промптах, инструментах или effort.

Продолжить обучение

Свяжите эту статью со следующим решением.

Посмотреть все темы
Опубликовано Oct 8, 2026
Последнее обновление Oct 8, 2026
0 просмотров
Проверено на ясность, указание источников и актуальную терминологию API.

Читать далее