GPT-6 Astra is now live on CometAPI →
ai-model/CometAPI Research

Was ist Claude Fable 5.1?

Erkunden Sie Spezifikationen auf einen Blick, offizielle Benchmarks, Cache-Preise, Migrationsänderungen, Schutzmaßnahmen und Vergleiche mit Opus 5 und Sonnet 5.

CometAPI
Mia MarenForschungsteam für KI-Modelle und API
Aktualisiert Sep 4, 2026 12 Min. Lesezeit
Was ist Claude Fable 5.1?
Dieses Muster verwenden

Den ersten API-Aufruf ausführen.

from openai import OpenAI

client = OpenAI(
    api_key="YOUR_COMETAPI_KEY",
    base_url="https://api.cometapi.com/v1",
)

response = client.chat.completions.create(
    model="gpt-5-mini",
    messages=[{"role": "user", "content": "Build this workflow."}],
)

print(response.choices[0].message.content)

Anthropic hat am 1. September 2026 Fable 5.1 als sein leistungsfähigstes allgemein verfügbares Modell für Coding- und Wissensarbeit veröffentlicht. Das Modell zielt auf Langstrecken-Aufgaben: mehrstündiges Codieren, mehrstufige Recherche, dokumentenintensive professionelle Arbeit sowie Agenten, die wiederholt Tools verwenden und dabei große Kontextmengen beibehalten.

Claude Fable 5.1 kombiniert ein Kontextfenster mit 1M Tokens, bis zu 128K Ausgabetokens, Text- und Bildeingaben und stets aktive adaptive Denkprozesse. Die Basispreise bleiben bei $10 für Eingaben und $50 für Ausgaben pro MTok; die wichtige Kostenänderung ist $0.25 pro MTok für Cache-Lesevorgänge.

Spezifikationen von Claude Fable 5.1 auf einen Blick

Die untenstehenden Spezifikationen stammen aus der Modell-Dokumentation von Anthropic. Preise sind die Listenpreise von Anthropic und sollten von etwaigen CometAPI-Preisen getrennt betrachtet werden.

Offizielle SpezifikationClaude Fable 5.1
Release und Modell-ID1. September 2026 — claude-fable-5-1
Primäre RolleAnspruchsvolles Reasoning und langlaufende agentische Arbeit
Kontext und maximale Ausgabe1M-Token-Kontext — bis zu 128K Ausgabe
Eingabe → AusgabeText und Bilder → Text
Denken und Standard-API-AufwandAdaptive Denkprozesse, immer aktiv — hoher Aufwand
Verlässlicher WissensstichtagJuni 2026
Listenpreise$10 Eingabe — $50 Ausgabe — $0.25 Cache-Read pro MTok

Zwei Details zählen über die reinen Zahlen hinaus. Das 1M-Kontextfenster ist standardmäßig verfügbar und nicht als spezielle Langkontext-Stufe. Adaptive Denkprozesse sind immer aktiviert, während der Effort steuert, wie viel Arbeit das Modell leistet; laut Anthropic ist die Vorgabe in Claude Code hoch und in Claude Cowork sowie Claude.ai mittel.

Was ist Claude Fable 5.1

Claude Fable 5.1 ist das Frontier-Modell von Anthropic für Aufgaben, bei denen ein System über viele Schritte hinweg weiterdenken, Tools verwenden und Kontext bewahren muss. Anstatt kurze Frage-und-Antwort-Wechsel anzustreben, ist es für die fortgesetzte Ausführung ausgelegt: das Erkunden eines Codebases, das Ausführen von Terminal-Workflows, das Synthesieren großer Dokumentmengen und das Erledigen professioneller Aufgaben, die Stunden dauern können.

Sein prägendes Paket ist ein 1M-Token-Kontextfenster mit bis zu 128K Ausgabe, Text- und Bildeingaben sowie adaptive Denkprozesse, die während einer Anfrage aktiv bleiben. So kann ein Agent lange Anweisungen, Quellenmaterial, Tool-Ergebnisse und Zwischenentscheidungen in einem Arbeitskontext halten und den Denkaufwand an die Schwierigkeit jedes Schritts anpassen.

Am besten passt es zu Workflows mit hohem Wert, bei denen Fehlschläge, Nacharbeit oder verlorener Kontext teurer sind als Premium-Tokenpreise. Beispiele sind Engineering auf Repository-Ebene, mehrstufige Recherche, Computer-Use-Agenten, compliance-lastige Dokumentanalyse und Geschäftsautomatisierung mit wiederholten Tool-Aufrufen. Für Routineklassifizierung, Extraktion in hohem Volumen oder latenzsensitiven Chat ist eine günstigere Claude-Stufe weiterhin der bessere Ausgangspunkt.

Die Standardnutzung von Fable erfordert 30 Tage Aufbewahrung für Sicherheitsmonitoring. Berechtigte Enterprise-Kunden können Zero Data Retention nutzen, während Enterprise Frontier Safeguards ausgerollt werden; laut Anthropic speichert die geplante Architektur überwachte Daten in kundenkontrollierter Cloud-Infrastruktur. Regulierte Teams sollten vor der Bereitstellung kontospezifische Bedingungen verifizieren.

Claude Fable 5.1 vs. Fable 5: Was hat sich geändert?

Das 5.1-Release ist kein einheitlicher Fähigkeitssprung. Am klarsten sind niedrigere Kosten für wiederholten Kontext und deutlich stärkere Ausführung bei agentischer Recherche, Terminal-Coding und Business-Workflows, während allgemeines toolgestütztes Reasoning nur leicht zulegt.

DimensionClaude Fable 5Claude Fable 5.1Änderung
Basis Eingabe / Ausgabe$10 / $50 pro MTok$10 / $50 pro MTokKeine Änderung
Cache-Read$1.00 pro MTok$0.25 pro MTok75% niedriger
Terminal-Bench-Science 0.124.7%52.6%+27.9 Punkte
Terminal-Bench 4.042.0%55.8%+13.8 Punkte
AutomationBench17.1%31.4%+14.3 Punkte
HLE mit Tools63.8%65.0%+1.2 Punkte

Cache-Reads sind 75% günstiger, während Basispreise stabil bleiben

Die Eingabe bleibt bei $10 pro MTok und die Ausgabe bei $50 pro MTok, der Headline-Tarif ist also nicht gefallen. Die materielle Änderung ist der Rückgang des Cache-Read-Preises von $1.00 auf $0.25 pro MTok. Das ist vor allem für Agenten relevant, die wiederholt ein langes Präfix mit Repositories, Richtlinien, Dokumenten, Tool-Definitionen und Vorzustand neu laden. Ihre Kosten pro abgeschlossenem Workflow können sinken, auch wenn die Raten für frische Eingaben und Ausgaben unverändert bleiben.

Agentische wissenschaftliche Recherche zeigt den größten Zuwachs

Terminal-Bench-Science 0.1 steigt von 24.7% auf 52.6%, ein Zugewinn von 27.9 Prozentpunkten und mehr als eine Verdopplung des bisherigen Werts. Das ist der stärkste Hinweis darauf, dass Fable 5.1 die Langstrecken-Ausführung verbessert: eine Untersuchung planen, Tools bedienen, Ergebnisse interpretieren und sich von Zwischenfehlern erholen.

Terminal-Coding und Geschäftsautomatisierung verbessern sich signifikant

Terminal-Bench 4.0 steigt von 42.0% auf 55.8%, während AutomationBench von 17.1% auf 31.4% zulegt. Diese Ergebnisse deuten auf bessere End-to-End-Aufgabenerfüllung hin, nicht nur auf bessere Codegenerierung. Teams sollten den größten Nutzen in Workflows erwarten, die das Modell erfordern, eine Umgebung zu inspizieren, Aktionen zu wählen, Tools zu nutzen und Ergebnisse über mehrere Schritte zu verifizieren.

Allgemeines Reasoning verbessert sich weniger als die Ausführung

Humanity’s Last Exam mit Tools geht von 63.8% auf 65.0%, nur 1.2 Punkte, und CursorBench steigt um 2.9 Punkte. Der Vergleich stützt daher nicht die pauschale Behauptung, dass jede Fähigkeit gleichermaßen zugelegt hat. Fable 5.1 ist besser als ausführungsorientiertes Upgrade zu verstehen, dessen stärkste Zugewinne auftreten, wenn Reasoning über Tools und lange Aufgabenketten hinweg aufrechterhalten werden muss.

Vergleichsergebnis: Bestehende Fable-5-Nutzer, die langlaufende, toolintensive Agenten betreiben, haben den klarsten Grund zum Upgrade: deutlich günstigere Cache-Reads und weniger Fehlschläge bei ausführungsorientierten Benchmarks. Teams mit kurzen Prompts oder allgemeinen Wissensaufgaben sollten die kleineren Zugewinne gegenüber Latenz und Gesamtkosten validieren, bevor sie migrieren.

Benchmark-Leistung von Claude Fable 5.1

Die offizielle Benchmark-Tabelle von Anthropic vergleicht das neue Modell mit seinem Vorgänger, Claude Opus 5, und GPT-5.6 Sol. Die ausgewählten Zeilen unten decken Recherche, Coding, Wissensarbeit, Computer-Nutzung und Automatisierung ab.

Offizieller BenchmarkClaude Fable 5.1Claude Fable 5Claude Opus 5GPT-5.6 Sol
Terminal-Bench-Science 0.152.6%24.7%29.0%22.4%
Terminal-Bench 4.055.8%42.0%52.3%37.3%
GDPval-AA v21853172318241711
OSWorld 2.0 partial77.9%72.9%75.4%
OSWorld 2.0 strict41.7%36.1%39.6%
AutomationBench31.4%17.1%26.9%19.6%
CursorBench 3.2.073.4%70.5%70.0%67.2%

Die obige Grafik ist das offizielle Benchmark-Bild von Anthropic, kopiert aus dem Quelldokument, keine lokal neu gezeichnete Grafik. Anthropic weist für Terminal-Bench-Science auf einen Standardfehler von ±3.5–4.5 Punkten hin und sagt, dass Produktions-Safeguards während der Auswertung aktiviert waren. Kleine Unterschiede sollten daher mit Vorsicht betrachtet werden.

Was ist Claude Fable 5.1?

Quelle: Offizielle Anthropic Fable 5.1 Benchmark-Grafik

So sind die Benchmark-Ergebnisse zu lesen

Diese Werte sollten nicht als universelle Maßzahlen der Modellqualität interpretiert werden. Anthropic evaluierte Claude Fable 5.1 mit aktivierten Produktions-Safeguards, und einige Benchmark-Aufgaben können durch Safeguard-Interventionen beeinflusst sein. Terminal-Bench-Science meldet außerdem einen Standardfehler von ungefähr ±3.5–4.5 Prozentpunkten pro Modell.

Die OSWorld-2.0-Ergebnisse verwenden den Aufgaben-Release der Benchmark-Autoren von August 2026, daher sollten sie nicht direkt mit Werten aus früheren Aufgaben-Releases verglichen werden.

Preise für Claude Fable 5.1

Preise für Eingabe und Ausgabe

Anthropic listet Claude Fable 5.1 mit $10 pro MTok Eingabe und $50 pro MTok Ausgabe. Die Claude Fable 5.1 API in CometAPI liegt bei $8 pro MTok Eingabe und $40 pro MTok Ausgabe, eine Reduktion um 20% gegenüber den offiziellen Listenpreisen. Dies sind nutzungsbasierte Tarife; prüfen Sie vor dem Produktionseinsatz die Live-Modellseite, da Plattformpreise und Abrechnungsregeln sich ändern können.

Preise für Prompt-Cache

Anthropic bepreist einen 5-Minuten-Cache-Write mit $12.50 pro MTok, einen 1-Stunden-Cache-Write mit $20 pro MTok und einen Cache-Read mit $0.25 pro MTok. Die Lesekosten liegen 75% unter den $1 pro MTok von Fable 5, sodass langlaufende Agenten, die Repositories, Richtlinien, Tool-Definitionen oder Vorzustand wiederverwenden, stärker profitieren als kurze Ad-hoc-Prompts.

Beispielkosten für einen Agenten-Workflow

Ein Agent, der bei jedem von 1,000 Schritten 150K gecachte Tokens liest, verbraucht 150 MTok an Cache-Reads. Bei Fable 5.1 zu $0.25 kostet diese Komponente $37.50; bei Fable 5 zu $1 wären es $150 — eine Ersparnis von $112.50. Frische Eingaben, Ausgaben, Cache-Writes und Plattformgebühren kommen hinzu, daher sollten Teams die Gesamtkosten pro erfolgreichem Workflow und nicht nur die Cache-Kosten vergleichen.

Warum Cache-Preise die Agenten-Ökonomie verändern

Eine herkömmliche Anfrage gibt den Großteil der Kosten für frische Eingaben und Ausgaben aus. Ein Agent ist anders: Jeder Tool-Schritt kann ein großes gecachtes Präfix mit Richtlinie, Code, Dokumenten, Tool-Definitionen und früherem Zustand erneut lesen. Die 75%ige Reduktion der Cache-Reads von Anthropic kommt langen Schleifen überproportional zugute.

Beispiel: Ein Agent, der 150K gecachte Tokens über 1,000 Schritte erneut liest, verbraucht 150 Millionen Cache-Read-Tokens. Bei $1 pro MTok kostet diese Komponente $150; bei $0.25 pro MTok kostet sie $37.50. Dieses Beispiel schließt frische Eingaben, Ausgaben, Cache-Writes und Plattformgebühren aus, zeigt aber, warum unveränderte Basispreise dennoch zu niedrigeren Kosten pro abgeschlossener Aufgabe führen können.

Anthropic schätzt etwa 25% niedrigere Kosten für typische, tokenbasiert abgerechnete Workloads und bis zu ungefähr 45% für stark agentische Workloads. Dies sind Workload-Mix-Schätzungen, kein universeller Rabatt auf jeden Token.

Claude Fable 5.1 vs Opus 5 vs Sonnet 5

Das Frontier-Modell definiert die Fähigkeitsobergrenze, aber Anthropic empfiehlt die Opus-Stufe als Ausgangspunkt für die meisten Workloads. Die Sonnet-Stufe bleibt die schnellere, günstigere Wahl, wenn Durchsatz und Latenz wichtiger sind als maximale Langstrecken-Zuverlässigkeit. Für eine tiefere Zwei-Modell-Analyse siehe den Fable-vs-Sonnet-Vergleich von CometAPI.

DimensionClaude Fable 5.1Claude Opus 5Claude Sonnet 5
Kontextfenster1M1M1M
Maximale Ausgabe128K128K128K
Listenpreis Eingabe/Ausgabe$10 / $50$5 / $25$2 / $10
VergleichslatenzLangsamerModeratSchnell
Best FitSchwerste Langstrecken-Agenten und ReasoningStandard-Premium-AusgangspunktHochvolumige Arbeit mit Priorität auf Geschwindigkeit und Kosten

Auswahlergebnis: Beginnen Sie mit der günstigeren Stufe, die die Aufgabe erfüllt. Eskalieren Sie erst, wenn Produktionsevaluierungen zeigen, dass das Frontier-Modell die Akzeptanzrate erhöht, Wiederholungen reduziert oder die Gesamtkosten pro erfolgreichem Workflow senkt.

Migrationsänderungen, die Entwickler testen müssen

Das neue Modell ist größtenteils ein Drop-in-Nachfolger, aber Anthropic dokumentiert drei Breaking Changes, die Agenten-Frameworks und lange Konversationen betreffen.

MigrationsänderungWas passiertErforderliche Entwickleraktion
Erzwungene Tool-Wahltool_choice = any oder ein benanntes Tool ergibt HTTP 400auto verwenden, das Modell instruieren und bei Bedarf strenge Schemas erzwingen
Thinking-Blöcke bei ModellwechselnÄltere Modelle können die neuen Thinking-Blöcke nicht lesenRouter testen und erwarten, dass Reasoning-Blöcke beim Zurückrouten verworfen werden
Bearbeiten früherer TurnsGeänderte Historie kann Thinking-Blöcke invalidierenHistorien nur anhängen oder unterstützte Kompaktionsmuster verwenden

Testen Sie außerdem pro-Nachricht-Effort, turn-skopierte Systemnachrichten, Fortschrittsupdates zwischen Tool-Aufrufen, Cache-Verhalten und Inhaltsherkunft, bevor Sie Produktionstraffic umleiten. Das bestehende Fable-API-Tutorial bleibt der bessere Ort für generisches SDK-Setup und Request-Beispiele.

Wer sollte Claude Fable 5.1 verwenden?

Claude Fable 5.1 eignet sich am besten für Workloads, bei denen fortgesetztes Reasoning und erfolgreiche Ausführung wichtiger sind als minimale Latenz oder Tokenpreis. Wählen Sie es, wenn die Aufgabe viele Schritte umfasst, wiederholt Tools verwendet oder geschäftlich so wertvoll ist, dass weniger Fehlversuche und Nacharbeit die Premium-Modellkosten aufwiegen können.

  • Engineering auf Repository-Ebene: Debugging, Migrationen, Refactoring über mehrere Dateien, Testausführung und unbeaufsichtigte Coding-Agenten.
  • Mehrstufige Recherche: Suchen, Bewertung von Evidenz, Analysen ausführen und einen fundierten Abschlussbericht erstellen.
  • Großdokument- und professionelle Arbeit: Verträge, technische Dokumentation, Finanzmaterial, Tabellenkalkulationen und Präsentations-Workflows.
  • Computer-Nutzung und Automatisierung: Aufgaben, die wiederholte Tool-Aufrufe, Interface-Navigation, Verifikation und Wiederherstellung nach Zwischenfehlern erfordern.

Für Routineklassifizierung, Extraktion in hohem Volumen oder latenzsensitiven Chat starten Sie mit Claude Opus 5 oder Claude Sonnet 5.

Verfügbarkeit über CometAPI

Stand 4. September 2026 listet die CometAPI-Modellseite Claude Fable 5.1 als live und betriebsbereit. Die Modell-ID ist claude-fable-5-1.

  1. Erstellen Sie ein CometAPI-Konto oder melden Sie sich an und generieren Sie einen API-Schlüssel im Dashboard.
  2. Wählen Sie Claude Fable 5.1 und übergeben Sie claude-fable-5-1 als Modell-ID.
  3. Senden Sie Requests über den Anthropic-kompatiblen /v1/messages-Endpoint oder den OpenAI-kompatiblen /v1/chat/completions-Endpoint.
  4. Führen Sie eine produktionsnahe Evaluation durch, um Latenz, Kontexthandling, Tool-Verhalten und Abrechnung zu bestätigen, bevor Sie Traffic migrieren.

Entwickler können zudem direkt über die Claude API, Amazon Bedrock, Google Cloud, Microsoft Foundry und die Claude Platform on AWS auf das Modell zugreifen.

Fazit

Claude Fable 5.1 ist am besten als Ausführungs-Upgrade zu verstehen. Der überzeugendste Beleg sind nicht das unveränderte 1M-Kontextfenster oder der Premium-Basispreis von $10/$50, sondern die großen Verbesserungen bei agentischer Recherche, Terminal-Coding und Automatisierung in Kombination mit deutlich günstigeren Cache-Reads.

Nutzen Sie es, wenn eine Aufgabe schwierig, langlaufend und so wertvoll ist, dass weniger fehlgeschlagene Durchläufe die Premiumpreise rechtfertigen. Für Routine-, Hochvolumen- oder latenzsensitive Arbeit beginnen Sie mit einer günstigeren Stufe und eskalieren Sie nur, wenn Ihre eigene Evaluation eine messbare Verbesserung bei abgeschlossenen Ergebnissen zeigt.

FAQs

Ist Claude Fable 5.1 über eine API verfügbar?

Ja. Anthropic listet Claude Fable 5.1 seit dem 1. September 2026 als aktiv. Es ist über die Claude API, Amazon Bedrock, Google Cloud, Microsoft Foundry und die Claude Platform on AWS verfügbar.

Was kostet die Claude Fable 5.1 API?

Der offizielle Listenpreis von Anthropic beträgt $10 pro MTok Eingabe und $50 pro MTok Ausgabe. CometAPI listet derzeit $8 Eingabe und $40 Ausgabe pro MTok. Prüfen Sie vor dem Deployment den aktuellen Routentarif.

Wie groß ist das Kontextfenster von Claude Fable 5.1?

Das Modell unterstützt ein Kontextfenster mit 1M Tokens und bis zu 128K Ausgabetokens. Hohe Kapazität ersetzt nicht die Notwendigkeit, Retrieval-Qualität, Latenz und Kosten mit Produktionsdokumenten zu testen.

Was hat sich von Claude Fable 5 zu 5.1 geändert?

Die größten praktischen Änderungen sind stärkere agentische Recherche und Terminal-Ausführung, eine Reduktion des Cache-Read-Preises von $1 auf $0.25 pro MTok, Effort-Kontrollen pro Nachricht, Fortschrittsupdates und Inhaltsherkunft. Die Migration erfordert außerdem Tests zu erzwungener Tool-Wahl, Thinking-Blöcken bei Modellwechseln und bearbeiteten Gesprächshistorien.

Ist Claude Fable 5.1 besser als Claude Opus 5?

Nicht für jeden Workload. Fable 5.1 ist die höherfähige Option für anspruchsvolle Langstreckenarbeit, aber langsamer und teurer. Anthropic empfiehlt, die meisten Workloads mit Claude Opus 5 zu starten und erst dann aufzusteigen, wenn Evaluierungen mit höherem Effort noch nicht ausreichen.

Kann ich Claude Fable 5.1 über CometAPI nutzen?

Ja. CometAPI listet Claude Fable 5.1 derzeit als live unter der Modell-ID claude-fable-5-1, mit Anthropic-kompatiblen und OpenAI-kompatiblen Endpoints.

Unterstützt Claude Fable 5.1 erzwungene Tool-Nutzung?

Nein. Anthropic dokumentiert, dass tool_choice = any oder ein benanntes Tool HTTP 400 zurückgibt. Verwenden Sie auto oder none und steuern Sie die Tool-Auswahl mit Anweisungen und strikten Input-Schemas, wenn erforderlich.

Weiterlernen

Diesen Artikel mit der nächsten Entscheidung verknüpfen.

Alle Themen anzeigen
Veröffentlicht am Sep 4, 2026
Zuletzt aktualisiert Sep 4, 2026
0 Aufrufe
Auf Klarheit, Quellenangabe und aktuelle API-Terminologie geprüft.

Bereit, die KI-Entwicklungskosten um 20 % zu senken?

In wenigen Minuten kostenlos starten. Inklusive kostenlosem Testguthaben. Keine Kreditkarte erforderlich.

Mehr lesen