GPT-6 Sol, GPT-6 Luna, and Claude Opus 5.5 are now live on CometAPI →
ai-model/Исследования CometAPI

Что такое Claude Sonnet 5.5? Бенчмарки, цены и доступ к API

Ознакомьтесь с техническими характеристиками Claude Sonnet 5.5, контекстным окном 1M, бенчмарками, ценообразованием, возможностями для программирования, сравнениями и доступом к API.

CometAPI
Deon GoodwinКоманда исследователей AI-моделей и API
Обновлено Sep 29, 2026 12 мин. чтения
Что такое Claude Sonnet 5.5? Бенчмарки, цены и доступ к API
Использовать этот подход

Сделайте первый вызов API.

from openai import OpenAI

client = OpenAI(
    api_key="YOUR_COMETAPI_KEY",
    base_url="https://api.cometapi.com/v1",
)

response = client.chat.completions.create(
    model="gpt-5-mini",
    messages=[{"role": "user", "content": "Build this workflow."}],
)

print(response.choices[0].message.content)

TL;DR

Claude Sonnet 5.5 — новейшая модель класса Sonnet от Anthropic, выпущенная 28 сентября 2026 года. Она позиционируется как более быстрая и доступная по цене дополняющая модель к Claude Opus 5.5 для кодинга, чётко сформулированных агентных задач, подготовки документов, компьютерного использования и мультимодального анализа.

Модель сохраняет стандартные цены: $2 за 1 млн входных токенов и $10 за 1 млн выходных токенов. Anthropic сообщает, что генерация вывода более чем на 30% быстрее, чем у Sonnet 5, а стоимость на задачу может быть до 30% ниже, поскольку новая модель часто завершает работу с меньшим числом токенов и шагов.

Опубликованные результаты включают 70.6% на Terminal-Bench 4.0, 55.5% на CursorBench 4.0, 1844 на GDPval-AA v2.1 и 80.1% на OSWorld 2.1. Практическая ценность — не один изолированный балл: Sonnet 5.5 приближается к Opus 5.5 на ряде оценок профессиональной работы, сохраняя более низкие стандартные цены за токены.

Key Takeaways

  • Claude Sonnet 5.5 — вторая модель в семействе Claude 5.5 от Anthropic, оптимизированная для быстрой производственной работы, а не для самых неоднозначных, открытых задач.
  • Поддерживает контекстное окно 1M токенов, до 128K токенов вывода, текстовый и визуальный ввод, адаптивное мышление, использование инструментов и структурированные ответы.
  • Стандартные цены Claude API: $2/М вход, $10/М выход, $0.20/М чтение из кэша и $2.50/М запись в кэш на пять минут.
  • Anthropic отмечает более чем 30% ускорение генерации по сравнению с Sonnet 5 и существенные улучшения в кодинге, компьютерном использовании, понимании диаграмм и в долгосрочной работе с знаниями.
  • Идентификатор модели в Claude API — claude-sonnet-5-5; разработчики также могут получить доступ через Claude Sonnet 5.5 API в CometAPI.

What Is Claude Sonnet 5.5?

Claude Sonnet 5.5 — новейшая универсальная модель класса Sonnet от Anthropic и второй релиз в семействе Claude 5.5 после Claude Opus 5.5. Anthropic позиционирует её как более быструю и доступную по цене замену в дополнение к Opus, а не прямую замену флагмана.

Практическое различие: Opus 5.5 нацелен на сложную, неоднозначную работу, требующую устойчивого суждения, тогда как Sonnet 5.5 оптимизирован для чётко сформулированных задач, исправления багов, быстрой итерации, кодинга, подготовки документов и высокообъёмных профессиональных рабочих процессов.

What Are the Most Important Claude Sonnet 5.5 Features?

Модель сочетает контекстное окно на 1M токенов, до 128K токенов вывода, текстово-визуальный ввод, адаптивное мышление, регулируемые усилия, инструменты, структурированные ответы, кэширование промптов, пакетную обработку и поддержку в Claude API, Amazon Bedrock, Google Cloud, Microsoft Foundry и Claude Platform на AWS. Для продакшен-команд ключевым является не отдельная функция, а сочетание быстрой генерации, меньшего расхода токенов на задачу и близкой к Opus производительности на ряде чётко определённых профессиональных нагрузок.

Claude Sonnet 5.5 benchmarks

Anthropic сообщает о существенных улучшениях в кодинге, долгосрочной профессиональной работе, компьютерном использовании и визуальном понимании. Ниже таблица с опубликованными результатами оценок компании.

Бенчмарк и официальный источникClaude Sonnet 5.5Claude Sonnet 5Claude Opus 5.5GPT-6 Sol
Terminal-Bench 4.070.6%10.3%66.4% at XhighNot publicly reported
FrontierCode 1.1 Main46.2% at Max42.4%54.4%49.3% / 52.1% at Xhigh
CursorBench 4.055.5%34.1%57.8%Not publicly reported
GDPval-AA v2.11844144918461487
AA-Briefcase v1.11811135918221483
Humanity's Last Exam64.5% with tools54.9%67.7%Not reported in the source table
OSWorld 2.180.1%57.0%81.8%Not reported in the source table
Chartography61.6%15.6%64.4%53.6%

Оговорки и условия оценки: Баллы измерялись не всегда при одном и том же уровне усилий. Результат Opus 5.5 66.4% на Terminal-Bench сообщён при Xhigh. Anthropic отмечает, что Sonnet 5.5 может показывать более низкий результат на Max, чем на Xhigh в FrontierCode, поскольку дополнительные шаги проверки могут приводить к тайм-аутам или правкам вне области задачи. Artificial Analysis запускала GDPval-AA и AA-Briefcase на предпродакшен-развёртывании Sonnet 5.5, на которое влияла ошибка структурированных ответов, которую Anthropic, по их словам, уже исправила. Кросс-вендорные значения GPT-6 Sol также следует считать устаревшими наблюдениями, поскольку OpenAI исправила проблему кодирования изображений 25 сентября 2026 года.

Что означают результаты: Sonnet 5.5 не просто обходит Sonnet 5 на отдельных тестах. Она значительно приблизилась к Opus 5.5 в кодинге, профессиональной работе, компьютерном использовании и распознавании диаграмм, сохраняя цены уровня Sonnet. Anthropic также сообщает, что при Low или Medium Sonnet 5.5 может превосходить лучший результат Sonnet 5 на нескольких оценках примерно за одну десятую стоимости на задачу. Это сочетание возможностей, скорости и эффективности на уровне задачи — её главное конкурентное преимущество.

How Good Is Claude Sonnet 5.5?

Coding

Улучшение носит и операционный характер. Anthropic отмечает, что Sonnet 5.5 быстрее понимает кодовые базы, эффективнее группирует вызовы инструментов, использует меньше шагов и снижает стоимость на завершённую задачу. FrontierCode проверяет, являются ли предлагаемые изменения в коде пригодными для слияния, тогда как CursorBench использует неоднозначные задачи в нескольких файлах из реальных сессий кодинга; следовательно, улучшения отражают уровень исполнения и суждений на уровне репозитория, а не только краткую генерацию кода. Это важно для исправления багов, ревью кода, выполнения тестов и длительной работы кодирующих агентов.

Что такое Claude Sonnet 5.5? Бенчмарки, цены и доступ к API

Knowledge Work

Улучшения выходят за рамки программирования. GDPval-AA тестирует реальные профессиональные задачи в 44 профессиях и девяти крупных отраслях, поэтому результат Sonnet 5.5 — 1844 (против 1449 у Sonnet 5 и 1846 у Opus 5.5) — указывает на перенос улучшений в практический анализ, подготовку документов и поддержку принятия решений, а не только в лабораторные тесты на рассуждение.

Anthropic выделяет финансовый анализ, синтез документов, создание слайдов, работу с электронными таблицами, интерпретацию графиков, проверку источников, поиск информации и профессиональное письмо как области, где модель улучшилась.

Ранние тестировщики также отметили менее измеримые улучшения: более ясное сотрудничество, более естественные суждения в диалоге и улучшенное чувство дизайна. По словам Anthropic, модель может «наводить лоск» на пользовательские интерфейсы и достаточно точно следовать шаблонам слайдов, чтобы презентации требовали минимальной правки; в одном внутреннем тесте операционного обзора двое экспертов признали первый черновик готовым к отправке без изменений.

Более широкий вывод: Sonnet 5.5 правильнее понимать как модель для профессиональной работы, а не просто как более дешёвую модель для кодинга.

Computer Use

Sonnet 5.5 набирает 80.1% на OSWorld 2.1 против 57.0% у Sonnet 5 и 81.8% у Opus 5.5. OSWorld оценивает способность работать в графических компьютерных средах, поэтому результат указывает на значительное поколенческое улучшение и близкую к Opus производительность для рабочих процессов, включающих браузеры, настольные инструменты и понимание мультимодальных интерфейсов. Результаты Chartography показывают схожую картину для визуального распознавания диаграмм: 61.6% у Sonnet 5.5 против 15.6% у Sonnet 5.

Speed

Anthropic сообщает, что Sonnet 5.5 генерирует ответы более чем на 30% быстрее, чем Sonnet 5, делая её самой быстрой моделью класса Sonnet на момент запуска. Более быстрое формирование вывода вместе с меньшим числом вызовов инструментов и меньшим расходом токенов сокращает циклы агента, уменьшает ожидание при итеративном кодинге и повышает пропускную способность в поддержке и других высокообъёмных рабочих процессах.

How Much Does Claude Sonnet 5.5 Cost?

Цены и официальный источникClaude Sonnet 5.5CometAPI: Sonnet 5.5Claude Opus 5.5
Чтение из кэша$0.20 / 1M$0.16 / 1M$0.20 / 1M
Запись в кэш на 5 минут$2.50 / 1M$2 / 1M$5 / 1M
Входные токены$2 / 1M$1.60/M$4 / 1M
Выходные токены$10 / 1M$8.00/M$20 / 1M

При стандартных тарифах за токены Sonnet 5.5 стоит вдвое меньше Opus 5.5 за вход и выход. Anthropic также отмечает, что новая Sonnet часто требует меньше токенов для выполнения той же работы, снижая стоимость на завершённую задачу.

Это стандартные цены Claude API. Тарифы облачных провайдеров, региональная обработка, длительность кэша, скидки на пакетную обработку и правила для длинного контекста могут влиять на эффективную стоимость.

What Safety Changes Does Claude Sonnet 5.5 Introduce?

Anthropic сообщает, что автоматизированный поведенческий аудит охватил около 1 850 сценариев и показал, что Sonnet 5.5 улучшилась или не уступает Sonnet 5 по большинству измеряемых показателей выравнивания, устойчивости к злоупотреблениям и честности.

Cybersecurity Safeguards

Поскольку у Sonnet 5.5 более сильные кибервозможности, чем у предшественницы, Anthropic внедряет меры защиты, аналогичные используемым для более способных моделей. Обычная разработка ПО и стандартное исправление багов остаются поддерживаемыми, в то время как некоторые более рискованные киберзадачи могут переводиться на более безопасный путь модели.

Biology Safeguards

Модель использует те же меры биобезопасности, что и Sonnet 5, нацеленные на узкий круг потенциально вредных запросов, при этом подавляющее большинство научной, образовательной и клинической работы остаётся без ограничений.

Anti-Distillation Protections

По словам Anthropic, Sonnet 5.5 — первая модель класса Sonnet, запущенная с классификаторами безопасности, предназначенными для предотвращения извлечения рассуждений через индустриальные атаки дистилляцией. Также расширяется механизм сохранённого thinking, привязывающий содержимое thinking к аккаунту и беседе, в которых оно было создано, чтобы рассуждения нельзя было свободно отделить и воспроизвести где-то ещё. Большинство разработчиков не заметят изменений, но системам, переносящим беседы между аккаунтами или изменяющим раннее состояние беседы, стоит изучить рекомендации по миграции.

Эти заявления описывают заявленные Anthropic меры безопасности, а не независимую гарантию полной безопасности любого развёртывания. Командам следует оценивать модель с учётом своей модели угроз, политик и высокорисковых сценариев.

Claude Sonnet 5.5 vs Claude Sonnet 5 vs Claude Opus 5.5 vs GPT-6 Sol

Claude Sonnet 5.5 позиционируется как быстрая, эффективная производственная модель в этой группе. По данным Anthropic, она генерирует ответы более чем на 30% быстрее, чем Claude Sonnet 5, сохраняя ту же цену за токены. Claude Opus 5.5 ориентирован на более сложную и неоднозначную работу, а GPT-6 Sol — ближайшее сравнение от OpenAI для длинного контекста в кодинге и агентных рабочих процессах.

ИзмерениеClaude Sonnet 5Claude Sonnet 5.5Claude Opus 5.5GPT-6 Sol
ПозиционированиеПредыдущая производственная SonnetБыстрый, эффективный «рабочий конь»Более сложные рассужденияСложный кодинг и агентные рабочие процессы
Контекстное окно1M1M1M1.05M
Максимальный вывод128K128K128K128K
Контроль рассужденийAdaptive effortAdaptive effortAdaptive thinking, always onnone, low, medium, high, xhigh, and max
Мультимодальный вводТекст и изображенияТекст и изображенияТекст и изображенияТекст и изображения
Доступность APIClaude API и крупные облачные платформыClaude API и крупные облачные платформыClaude API и крупные облачные платформыResponses API and Chat Completions
Цена за 1М: вход / выход$2 / $10$2 / $10$4 / $20$2 / $10 для промптов до 272K входных токенов
СкоростьБазовый уровеньБолее чем на 30% быстрее, чем Sonnet 5Оптимизирован для более сложной, долгой работыЗависит от уровня усилий рассуждений
FrontierCode 1.142.4%46.2% at Max54.4%49.3% / 52.1% at Xhigh
GDPval-AA v2.11449184418461487
Наиболее подходит дляСуществующие рабочие нагрузки SonnetВысокообъёмные агенты для кодинга и профработСложные, неоднозначные, долгие задачиНативные для OpenAI кодинг, агенты, инструменты и длинный контекст

Эти бенчмарки — кросс-вендорные наблюдения, а не контролируемые постоянные рейтинги. Результаты зависят от настроек усилий и условий развёртывания.

How Do You Access and Call Claude Sonnet 5.5 Through CometAPI?

Claude Sonnet 5.5 доступна через Claude, Claude Platform, Amazon Web Services, Google Cloud и Microsoft Azure. Разработчики, которым нужен единый интерфейс, совместимый с OpenAI, для нескольких провайдеров, могут вызывать модель через Claude Sonnet 5.5 API в CometAPI с идентификатором модели claude-sonnet-5-5.

import os
from openai import OpenAI

client = OpenAI(
    api_key=os.environ["COMETAPI_KEY"],
    base_url="https://api.cometapi.com/v1",
)

response = client.chat.completions.create(
    model="claude-sonnet-5-5",
    messages=[
        {
            "role": "user",
            "content": "Analyze this codebase and identify the three highest-impact bugs.",
        }
    ],
    max_tokens=2048,
)

print(response.choices[0].message.content)

Для продакшена храните API-ключ в переменной окружения и оценивайте уровни усилий, кэширование, вызовы инструментов, стратегию повторных попыток и расход токенов на задачу.

What Is the Effort Setting in Claude Sonnet 5.5?

Claude Sonnet 5.5 поддерживает регулируемые уровни усилий, которые балансируют скорость и расход токенов с глубиной рассуждений. Anthropic по умолчанию ставит Medium в приложениях Claude и Claude Code, тогда как Claude Platform по умолчанию использует High.

Низкие уровни усилий подходят для рутинной или высокоструктурированной работы. Высокие уровни позволяют больше рассуждений и проверок для более сложных задач кодинга, анализа и агентной работы. Поэтому при бюджетировании в продакшене следует учитывать уровень усилий, использование инструментов и общую стоимость завершения задачи, а не только цену за токен.

API: What’s new compared with Sonnet 5

Пять изменений могут нарушить или изменить существующие интеграции Sonnet 5:

  1. Thinking-off migrations: интеграциям, которые отключали thinking, следует перейти на thinking: {"type": "between_tools"}. Эта настройка отключает предварительное thinking, сохраняя рассуждения между инструментами.
  2. Forced tool use: принудительный выбор инструмента теперь возвращает ошибку; используйте автоматический выбор инструмента с жёсткими схемами там, где уместно.
  3. Thinking-block preservation: thinking-блоки привязаны к модели и беседе. Передавайте их обратно без изменений и не предполагаете, что их можно воспроизводить после изменения ранних системных сообщений, инструментов или контекста аккаунта.
  4. Computer-use tool version: в Claude API и Google Cloud старый инструмент computer_20251124 больше не принимается; перейдите на актуальный набор инструментов для computer-use.
  5. Advisor compatibility: инструмент advisor отклоняет Claude Opus 4.8, Opus 4.7 и Sonnet 5 как советников.

Ещё одно изменение формы ответа может проявляться без явной ошибки: текст, сгенерированный между вызовами инструментов, может появляться в thinking-блоках вместо текстовых блоков. Приложения, которые транслируют сообщения о прогрессе, должны обрабатывать ответы по типам блоков и настраивать соответствующий режим отображения. Sonnet 5.5 также добавляет per-message effort (бета), системные сообщения посреди диалога, изменение набора инструментов посреди диалога (бета), минимальную длину кэшируемого промпта 512 токенов, пакетную обработку, поддержку Files API, ввод PDF и vision, а также серверные и клиентские инструменты.

What Does Claude Sonnet 5.5 Mean for the Claude 5.5 Family?

  • Claude Opus 5.5: сложная, требующая суждения, долгосрочная работа.
  • Claude Sonnet 5.5: эффективный продакшен, кодинг, агенты и профессиональная работа.
  • Claude Haiku 5.5: анонсирован как будущий высокопроизводительный и чувствительный к стоимости участник семейства.

Более широкий тренд — смещение фокуса к измерению стоимости на успешную задачу, скорости вывода и маршрутизации моделей, а не только к цене за токен или отдельному бенчмарку.

Conclusion

Claude Sonnet 5.5 — обновление, нацеленное на эффективность, для производственного уровня Anthropic. Она сохраняет стандартные цены Sonnet 5 в $2/$10, добавляя контекст 1M токенов, до 128K токенов вывода, существенно более быструю генерацию и значительные улучшения в кодинге, компьютерном использовании, визуальном понимании и профессиональной работе с знаниями.

Сильнейший аргумент в пользу модели — экономика рабочих нагрузок: насколько надёжно и быстро она завершает задачу, сколько инструментальных вызовов и токенов потребляет и как часто поток всё же требует эскалации до Opus 5.5. Командам следует валидировать эти факторы на собственных задачах и относиться к кросс-вендорным бенчмаркам как к устаревающим наблюдениям, а не к постоянным рейтингам.

Продолжить обучение

Свяжите эту статью со следующим решением.

Посмотреть все темы
Опубликовано Sep 29, 2026
Последнее обновление Sep 29, 2026
0 просмотров
Проверено на ясность, указание источников и актуальную терминологию API.

Готовы сократить затраты на AI-разработку на 20%?

Начните бесплатно за несколько минут. Пробные кредиты включены. Карта не нужна.

Читать далее