GPT Image 2.5 Sunburst and Flare are now live on CometAPI →
guide/Исследования CometAPI

Как использовать API Claude Fable 5.1

Узнайте, как вызывать Claude Fable 5.1 через CometAPI, настраивать параметр effort, использовать инструменты, обрабатывать несовместимые изменения и выполнять миграцию.

CometAPI
Mia MarenКоманда исследователей AI-моделей и API
Обновлено Sep 16, 2026 15 мин. чтения
Как использовать API Claude Fable 5.1
Использовать этот подход

Сделайте первый вызов API.

from openai import OpenAI

client = OpenAI(
    api_key="YOUR_COMETAPI_KEY",
    base_url="https://api.cometapi.com/v1",
)

response = client.chat.completions.create(
    model="gpt-5-mini",
    messages=[{"role": "user", "content": "Build this workflow."}],
)

print(response.choices[0].message.content)

Краткое резюме: Чтобы использовать Claude Fable 5.1 API в CometAPI, подготовьте ключ API, установите идентификатор модели в claude-fable-5-1 и проверьте небольшой запрос, прежде чем строить более длинный рабочий процесс. В этом руководстве рассматриваются доступ, уровень усилий, стриминг, инструменты, кэширование, миграция и проверки для продакшена. Относитесь к развёртыванию как к чему-то большему, чем замена строки модели: подтвердите совместимость маршрута, проверьте ответы и измерьте долю принятых задач, задержку и стоимость до расширения использования.

Ключевые выводы

  • Сначала добейтесь успешного выполнения одного запроса: подтвердите учётные данные, доступ к модели, выбранную конечную точку и пригодный ответ на несекретных тестовых данных.
  • Выбирайте усилие осознанно: начните с высокого, затем сравнивайте другие настройки на репрезентативных задачах, а не используйте максимальное усилие для каждого запроса. В Claude Code по умолчанию High. В Claude Cowork / Claude.ai по умолчанию Medium.
  • Пересмотрите поведение при миграции:принудительный выбор инструмента отклоняется; сохраняйте обязательные шаги рабочего процесса и валидацию аргументов инструментов в коде приложения.
  • Измеряйте весь рабочий процесс: отслеживайте использование кэша, стоимость по токенам, задержку, отказы, поведение фолбэка и то, проходит ли итоговый результат ваши проверки приемки.

Для справки см. ранний трекер Fable 5.1 от CometAPI и учебник по Fable 5 API. Эта статья сосредоточена на текущем интеграционном рабочем процессе.

Что такое Claude Fable 5.1?

Claude Fable 5.1 — наиболее способная в широком доступе модель Anthropic для амбициозной разработки кода, многошаговых исследований, компьютерного использования и документоёмких профессиональных рабочих процессов. Anthropic рекомендует начинать большинство нагрузок с Claude Opus 5 и переходить к Fable 5.1, когда высокое усилие в Opus всё ещё не даёт требуемого качества.

Разница операционная: Fable 5.1 спроектирован для непрерывной работы через зависимые шаги, восстановления после неудачного вызова инструмента, верификации результатов и отчётов о прогрессе во время длительных запусков. Это может повысить долю завершённых задач, но делает стоимость, задержку и наблюдаемость центральными для развёртывания.

Спецификации Claude Fable 5.1 API

Официальная спецификацияClaude Fable 5.1
ПровайдерAnthropic
Идентификатор моделиclaude-fable-5-1
Дата релизаSeptember 1, 2026
Контекстное окно1,000,000 tokens
Максимальный вывод128,000 tokens
Ввод и выводТекст и изображения в текст
Режим мышленияAdaptive, всегда включён
Усилие по умолчаниюAPI — High, в Claude Code по умолчанию High, в Claude Cowork / Claude.ai по умолчанию Medium
Уровни усилияlow, medium, high, xhigh, max
Срез знанийJune 2026
Официальная цена$10 input / $50 output за миллион токенов
Чтение из кэша$0.25 за миллион токенов

Официальный обзор подтверждает 1M контекстное окно и 128K максимальный вывод. Адаптивное мышление всегда активно; глубина рассуждений управляется усилием, а не традиционным бюджетом токенов для размышлений.

Claude Fable 5.1 API: официальная производительность в бенчмарках

Сводка бенчмарков намеренно компактна, поскольку основная цель статьи — внедрение. Результаты ниже показывают, где премиум API наиболее вероятно будет иметь значение.

Бенчмарк AnthropicClaude Fable 5.1Claude Fable 5Claude Opus 5GPT-5.6 Sol
Terminal-Bench-Science 0.152.6%24.7%29.0%22.4%
Terminal-Bench 4.055.8%42.0%52.3%37.3%
GDPval-AA v21,853 Elo1,7231,8241,711
OSWorld 2.0, partial77.9%72.9%75.4%
Humanity's Last Exam, no tools60.9%57.8%56.6%
AutomationBench31.4%17.1%26.9%19.6%
CursorBench 3.2.073.4%70.5%70.0%67.2%

Как использовать API Claude Fable 5.1

Официальное сравнение бенчмарков Claude Fable 5.1 от Anthropic

Наибольший межпоколенческий прирост в этом наборе — Terminal-Bench-Science: 52.6% против 24.7%. AutomationBench растёт с 17.1% до 31.4%, а Terminal-Bench 4.0 улучшается до 55.8%. Итог — убедительный аргумент для тестирования Fable 5.1 на исследовательских агентах, длительной разработке кода и бизнес-автоматизации — но не для маршрутизации каждого короткого запроса на самую дорогую модель.

Что изменилось по сравнению с Claude Fable 5 API?

ИзмерениеClaude Fable 5.1Claude Fable 5Влияние на миграцию
Основная рольБолее сильные длительные агенты и исследованияИсходная публичная модель класса MythosПереоценить самые сложные процессы
Принудительный выбор инструментаВозвращает ошибкуРанее поддерживалсяУдалить любой и именной forcing
История мышленияБолее строгие правила совместимостиБолее раннее поведениеДержите истории только на добавление
Обновления прогрессаЧитаемые обновления между вызовами инструментовНедоступно в таком видеЭкспонировать статус длинных запусков
Усилие на сообщениеДоступно в бетаНе доступно в таком видеПодбирать глубину в рамках диалога
Цена чтения кэша$0.25 / MTok$1.00 / MTokПересчитать экономику длинного контекста
Цена ввода/вывода$10 / $50 per MTok$10 / $50 per MTokИзменений в лист-рейте нет

Три ломающих изменения

Принудительное использование инструмента больше не поддерживается

Claude Fable 5.1 отклоняет значения tool_choice, принуждающие любой инструмент или конкретно названный инструмент, возвращая 400 invalid-request. Оставьте автоматический выбор, используйте строгие схемы или структурированный вывод для валидации, а обязательные шаги рабочего процесса обеспечивайте оркестрацией приложения, а не принуждением к вызову инструмента моделью.

Более ранние модели не читают блоки мышления Fable 5.1

Совместимость мышления односторонняя: Fable 5.1 может потреблять блоки мышления, созданные более ранними совместимыми моделями Claude, но более ранние модели не могут читать блоки, созданные Fable 5.1. Маршрутизатор или фолбэк на раннюю модель может отбросить эти блоки перед инференсом, поэтому интеграциям следует логировать переключения моделей и явно тестировать поведение фолбэка.

Редактирование ранних ходов аннулирует сохранённое мышление

Изменение раннего системного промпта, определения инструмента, сообщения или байтов ссылочного файла может признать недействительными последующие блоки мышления. Рассматривайте префикс диалога как только добавляемый, используйте инструкции в середине диалога вместо переписывания истории и мониторьте трансформации несоответствия префикса при миграции.

Пять добавленных возможностей API

Усилие на сообщение

Приложения могут менять усилие в ходе диалога без инвалидации кэша промпта. Эта бета-возможность позволяет уменьшать усилие для рутинных продолжений и повышать его для сложного планирования, отладки или верификационных ходов.

Системные сообщения с охватом в один ход

Бета системное сообщение может применяться к одному ходу и переставать рендериться после следующего пользовательского сообщения, оставаясь неизменным в истории. Это полезно для временных инструкций в циклах инструментов, поскольку сохраняет совпадение промпт-кэша и валидность последующих блоков мышления.

Читаемые обновления прогресса между вызовами инструментов

С опцией бета отображения прогресса выбранные блоки мышления могут нести короткие статусы, которые приложение может показывать пользователям, пока приватные рассуждения остаются скрытыми. Длительные агенты должны трактовать эти обновления как операционный статус, а не финальные ответы.

Более низкая цена на чтение кэша

Чтение кэша стоит $0.25 за миллион токенов — четверть ставки для Fable 5, тогда как базовые цены ввода и вывода неизменны. Это существенно снижает стоимость длинных сессий, многократно переиспользующих стабильный кэшированный префикс.

Происхождение контента

Сгенерированный текст несёт статистический вотермаркер Anthropic, а поддерживаемые медиа, полученные через Files API, могут включать подписанные C2PA Content Credentials. Эти механизмы происхождения не добавляют токены в промпт и не требуют изменений формата запроса.

Что нужно перед использованием Claude Fable 5.1 API?

  • Аккаунт и ключ API: войдите в CometAPI и сгенерируйте ключ в консоли ключей API. Проверьте доступ к модели и готовность аккаунта к биллингу по использованию перед отправкой тестовых вызовов.
  • Локальное окружение: используйте терминал с curl для первого HTTP-примера. Для примеров на Python подготовьте Python и pip в изолированном окружении, затем установите SDK, используемый вашим примером.
  • Выбранный маршрут: Claude Fable 5.1 API в CometAPI предлагает форматы Messages и Chat Completions. Используйте соответствующий base URL и формат запроса; не смешивайте их payload’ы.
  • Безопасная конфигурация: задайте COMETAPI_KEY вне коммитимых исходников, используйте claude-fable-5-1 как ID модели и убедитесь, что сеть достигает https://api.cometapi.com.
  • Безопасный тест и проверка приемки: начните с короткого, не содержащего секретов промпта. Убедитесь, что ответ содержит пригодный контент, проверьте usage и статус завершения и соблюдение требований вашей организации к обработке данных, прежде чем отправлять реальные документы или логи.

Как получить доступ к Claude Fable 5.1 через CometAPI

CometAPI экспонирует Claude Fable 5.1 через маршрут Messages, совместимый с Anthropic, и маршрут Chat Completions, совместимый с OpenAI. Используйте Messages, когда нужны нативные усилие, мышление, кэширование и семантика инструментов Claude; используйте Chat Completions, когда ваше приложение уже стандартизовано на SDK OpenAI.

Шаг 1: сохраните ключ API

export COMETAPI_KEY="your-cometapi-key"
$env:COMETAPI_KEY="your-cometapi-key"

Шаг 2: выполните первый запрос к Messages

curl https://api.cometapi.com/v1/messages \
  --header "Authorization: Bearer $COMETAPI_KEY" \
  --header "content-type: application/json" \
  --data '{
    "model": "claude-fable-5-1",
    "max_tokens": 2048,
    "messages": [{
      "role": "user",
      "content": "Review this deployment architecture and list the three highest-risk failure modes."
    }]
  }'

Шаг 3: используйте Anthropic Python SDK

pip install anthropic
import os
import anthropic

client = anthropic.Anthropic(
    api_key=os.environ["COMETAPI_KEY"],
    base_url="https://api.cometapi.com",
)

response = client.messages.create(
    model="claude-fable-5-1",
    max_tokens=4096,
    messages=[{
        "role": "user",
        "content": "Find the root cause of this test failure and propose a verified patch.",
    }],
)

print(response.content[0].text)

Шаг 4: используйте OpenAI Python SDK

pip install openai
import os
from openai import OpenAI

client = OpenAI(
    api_key=os.environ["COMETAPI_KEY"],
    base_url="https://api.cometapi.com/v1",
)

response = client.chat.completions.create(
    model="claude-fable-5-1",
    messages=[{
        "role": "user",
        "content": "Design a migration plan for this service.",
    }],
)

print(response.choices[0].message.content)

Как устроено рассуждение в Claude Fable 5.1 API?

Более ранние модели не читают блоки мышления Claude Fable 5.1

Блоки мышления, созданные Fable 5.1, не совместимы назад с ранними моделями Claude. Если в рабочем процессе модель меняется в середине диалога, удалите несовместимые блоки мышления или начните новую ветку, сохранив только видимые пользователю сообщения и результаты инструментов, необходимые для следующего запроса.

Редактирование ранних ходов аннулирует сохранённое мышление

Сохранённый блок мышления криптографически связан с предшествующим состоянием диалога. Изменение раннего системного промпта, определения инструмента, пользовательского сообщения, ответа ассистента или результата инструмента может нарушить эту связь и вызвать ошибку истории мышления. Держите воспроизводимый префикс байт-в-байт стабильным и добавляйте новые ходы вместо переписывания старых.

Сохранённое мышление между ходами

Когда префикс диалога остаётся неизменным, сохранённое мышление может переносить полезное состояние рассуждений в последующие ходы. Храните блоки мышления в исходном порядке сообщений, воспроизводите их только на совместимой модели и рассматривайте редактирование истории как новую ветку диалога, а не мутацию существующей транскрипции.

Управляйте рассуждением с помощью усилия

Начните сложную продакшен-работу с высокого усилия, затем тестируйте более низкие настройки на рутинных ходах и более высокие — только там, где рост качества принятых задач оправдывает дополнительную задержку и токены. Поскольку усилие можно менять между ходами, один диалог больше не обязан иметь единый уровень рассуждений.

Fable 5.1 использует адаптивное мышление как единственный режим. Начните с high, затем измеряйте более низкие настройки для рутины и xhigh или max — только когда дополнительная способность оправдывает стоимость и задержку.

УсилиеРекомендуемая рольКомпромисс
lowРутинная, хорошо заданная работаСамое быстрое и экономичное
mediumСбалансированный продакшн-трафикУмеренная глубина
highСложная работа по умолчаниюЛучшая отправная точка
xhighДлительная разработка и агентыБольше задержки и токенов
maxСамые сложные задачи наивысшей ценностиСтоимость и задержка вторичны
response = client.messages.create(
    model="claude-fable-5-1",
    max_tokens=8192,
    output_config={"effort": "high"},
    messages=[{
        "role": "user",
        "content": "Audit this repository migration plan.",
    }],
)

Claude Fable 5.1 API: поток длинных ответов, инструменты и кэширование промптов

Настраивайте совместно следующее: усилие рассуждения, стриминг, выполнение инструментов, кэширование промптов и обработку мер безопасности и сохраняемых данных. Каждая из этих опций влияет на то, как длительный запрос наблюдается, валидируется и эксплуатируется.

Потоковая передача длинных ответов

Стриминг — более безопасный вариант по умолчанию для долгих задач с высоким усилием, поскольку позволяет получать вывод без ожидания завершения большого ответа.

with client.messages.stream(
    model="claude-fable-5-1",
    max_tokens=8192,
    output_config={"effort": "high"},
    messages=[{
        "role": "user",
        "content": "Analyze these logs and produce a remediation plan.",
    }],
) as stream:
    for text in stream.text_stream:
        print(text, end="", flush=True)

Используйте инструменты без принудительного выбора

Fable 5.1 отклоняет принудительный выбор инструмента с tool_choice типа any или именным инструментом. Используйте автоматический выбор, строгие схемы, валидируйте аргументы инструментов в коде приложения и управляйте обязательной последовательностью шагов вне модели. Если рабочий процесс требует запуска конкретного инструмента, не полагайтесь на tool_choice для принуждения последовательности. Пусть приложение вызовет этот инструмент или реализует нужный шаг в оркестрации.

tools = [{
    "name": "search_incidents",
    "description": "Search recent production incidents",
    "input_schema": {
        "type": "object",
        "properties": {
            "service": {"type": "string"},
            "days": {"type": "integer"},
        },
        "required": ["service", "days"],
    },
}]

response = client.messages.create(
    model="claude-fable-5-1",
    max_tokens=4096,
    tools=tools,
    tool_choice={"type": "auto"},
    messages=[{
        "role": "user",
        "content": "Review checkout incidents from the last 30 days.",
    }],
)

Используйте кэширование промптов для длинных контекстов

Anthropic указывает чтение кэша по $0.25 за миллион токенов — четверть ставки Fable 5. Поместите стабильные системные инструкции, схемы инструментов и большие справочные материалы перед динамическим пользовательским контентом, затем проверяйте попадания в кэш в метаданных usage.

messages = [{
    "role": "user",
    "content": [
        {
            "type": "text",
            "text": large_reference_document,
            "cache_control": {"type": "ephemeral"},
        },
        {
            "type": "text",
            "text": "Identify obligations that changed in this revision.",
        },
    ],
}]

Обрабатывайте меры безопасности и хранение данных

Anthropic заявляет, что многие флажковые запросы по кибербезопасности и биологии маршрутизируются на менее способные модели. Рассматривайте отказ или фолбэк как состояние приложения: фиксируйте причину остановки, показывайте уместное сообщение пользователю и направляйте на одобренную альтернативу, где политика позволяет.

Fable также требует хранение данных 30 дней по умолчанию для мониторинга безопасности. Подтвердите организационные условия и настройки хранения, прежде чем отлаживать синтаксически корректный запрос как сугубо проблемный в формате API.

Fable 5.1 vs Opus 5 vs Sonnet 5

Измерение выбораClaude Fable 5.1Claude Opus 5Claude Sonnet 5
Контекст / макс. вывод1M / 128K1M / 128K1M / 128K
Офиц. ввод/вывод$10 / $50$5 / $25$2 / $10
Относительная задержкаМедленнееУмереннаяБыстрая
Усилие по умолчаниюhighhighhigh
Основная сильная сторонаМаксимальные долгосрочные способностиПремиум-общие рассужденияБаланс скорость/стоимость
Лучшая роль в продакшенеЭскалация возможностейСложная работа по умолчаниюВысокотрафиковая база

Результат выбора: запускайте рутинный трафик на Sonnet 5, используйте Opus 5 для сложной общей работы и повышайте уровень только самых трудных или регулярно проваливающихся задач до Fable 5.1. Это следует рекомендациям Anthropic и не допускает превращения премиальных рассуждений в дефолтную стоимость каждого запроса.

Ценообразование через CometAPI

МаршрутВвод / MTokВывод / MTokЧтение кэша / MTok
Листинг Anthropic$10$50$0.25
Листинг CometAPI$8$40Смотрите live route
Номинальная разница ввода/выводаНа 20% нижеНа 20% нижеЗависит от маршрута

Живая страница модели CometAPI — источник истины по текущей доступности маршрутов и ценам. Для запроса со 100,000 некэшированных входных токенов и 10,000 выходных токенов простая оценка CometAPI — $1.20; фактическая стоимость может меняться из-за кэширования, рассуждения, пакетного поведения и маршрутизации. Цены могут изменяться; проверяйте живую страницу модели перед бюджетированием продакшена.

Чеклист миграции с Fable 5

  1. Замените ID модели с claude-fable-5 на claude-fable-5-1.
  2. Удалите принудительный tool_choice any и именной инструмент; используйте auto.
  3. Замените старые предположения о бюджете мышления на output_config.effort.
  4. Начните оценку с high, затем настраивайте на реальных задачах.
  5. Держите истории только на добавление, если в них есть сохранённые блоки мышления.
  6. Увеличьте max_tokens для длительных запусков с высоким усилием.
  7. Проверяйте попадания в кэш по метаданным usage.
  8. Обрабатывайте отказы и фолбэки как явные состояния.
  9. Воспроизведите производственные трэйсы и сравните долю принятых задач, задержку и стоимость.

Самая безопасная стратегия миграции: держите истории только на добавление. Fable 5.1 может сохранять блоки мышления между ходами, но воспроизводимые блоки мышления привязаны к предшествующему состоянию диалога; изменение ранних системных промптов, инструментов или сообщений может аннулировать эту привязку.

Частые ошибки API

Ошибка 400 после изменения вызовов инструментов

Вероятная причина: принудительный tool_choice типа any или именной инструмент. Используйте auto и обеспечьте требуемую последовательность в логике приложения.

claude-fable-5.1 не работает

Канонический ID с дефисами: claude-fable-5-1.

Вывод заканчивается раньше ожидаемого

effort управляет тем, сколько рассуждений выполняет модель, а max_tokens ограничивает бюджет токенов для ответа. Более высокое усилие может требовать большего бюджета вывода, поэтому в продакшене настраивайте оба параметра независимо. Повышайте max_tokens, где это оправдано, и применяйте стриминг длинных ответов.

Кэш промптов никогда не срабатывает

Держите кэшируемый префикс байт-в-байт стабильным; отметки времени, переупорядоченные инструменты и изменяемые системные сообщения предотвращают повторное использование.

HTTP-успех без нормального ответа

Проверьте stop_reason и метаданные фолбэка, а не считайте каждый отказ транспортной ошибкой.

Воспроизведение истории вызывает ошибку мышления

Не редактируйте ранние ходы перед сохранёнными блоками мышления Fable 5.1. Используйте историю только на добавление или текущие средства миграции.

Как использовать Claude Fable 5.1 API в продакшене?

Разделите маршрутизацию запросов, выполнение модели, выполнение инструментов, валидацию и оценку. Логируйте ID модели, усилие, задержку, использование токенов, использование кэша, причину остановки, поведение фолбэка и итоговый успех задачи.

Используйте Fable 5.1 для миграций по всему репозиторию, сложной отладки, длительных агентов, глубоких исследований, синтеза больших документов и задач высокой ценности, где более дешёвые модели регулярно проваливаются. Избегайте его как дефолта для суммаризации, классификации, извлечения и коротких ответов службы поддержки.

Пример: расследование инцидента при оформлении заказа

Команда может предоставить обезличенные ошибки оформления, недавние diff’ы деплоя и соответствующие runbook’и. Приложение извлекает подходящие инциденты, затем просит модель ранжировать возможные причины и связать каждую гипотезу с доказательствами. Инженер изучает предложенные шаги диагностики и одобряет тест в песочнице с синтетическими транзакциями. Критерии приемки — воспроизводимое поведение, трассируемые доказательства и прохождение регрессионных проверок; любое исправление в продакшене требует отдельного одобрения человеком.

Пример: анализ изменений в операционных требованиях

Команда может предоставить утверждённое руководство по эксплуатации, поддерживающие политики и переработанный проект. Держите неизменившийся справочный материал как стабильный контекст, затем попросите модель сравнить изменившиеся обязательства, ответственные команды, сроки и исключения. Каждое предложенное наблюдение должно ссылаться на соответствующие фрагменты в обеих версиях и различать явные изменения и неопределённые интерпретации. Критерий приемки — рецензент подтверждает каждое сообщённое изменение по цитируемым доказательствам перед обновлением процедур или уведомлением затронутых команд.

Заключение

Claude Fable 5.1 — это не просто обновление строки модели. Его поведение с инструментами, правила истории мышления, управление усилием, экономика кэша и функции прогресса для длинных запусков требуют продуманной миграции.

Наиболее эффективное развёртывание использует Claude Sonnet 5 для рутинного объёма, Claude Opus 5 для сложного трафика по умолчанию и Claude Fable 5.1 как измеренную эскалацию возможностей. Продвигайте его только тогда, когда доля принятых задач улучшается настолько, чтобы оправдать совокупную стоимость и задержку.

Продолжить обучение

Свяжите эту статью со следующим решением.

Посмотреть все темы
Опубликовано Sep 16, 2026
Последнее обновление Sep 16, 2026
1 просмотров
Проверено на ясность, указание источников и актуальную терминологию API.

Готовы сократить затраты на AI-разработку на 20%?

Начните бесплатно за несколько минут. Пробные кредиты включены. Карта не нужна.

Читать далее