GPT-6 Sol, GPT-6 Luna, and Claude Opus 5.5 are now live on CometAPI →
ai-model/CometAPI Research

Was ist Claude Sonnet 5.5? Benchmarks, Preise und API-Zugriff

Erkunden Sie die Spezifikationen von Claude Sonnet 5.5, das 1M-Kontextfenster, Benchmarks, Preisgestaltung, Coding-Funktionen, Vergleiche und API-Zugriff.

CometAPI
Deon GoodwinForschungsteam für KI-Modelle und API
Aktualisiert Sep 29, 2026 12 Min. Lesezeit
Was ist Claude Sonnet 5.5? Benchmarks, Preise und API-Zugriff
Dieses Muster verwenden

Den ersten API-Aufruf ausführen.

from openai import OpenAI

client = OpenAI(
    api_key="YOUR_COMETAPI_KEY",
    base_url="https://api.cometapi.com/v1",
)

response = client.chat.completions.create(
    model="gpt-5-mini",
    messages=[{"role": "user", "content": "Build this workflow."}],
)

print(response.choices[0].message.content)

TL;DR

Claude Sonnet 5.5 ist das neueste Sonnet-Klassenmodell von Anthropic, veröffentlicht am 28. September 2026. Es ist als schnelleres, kostengünstigeres Pendant zu Claude Opus 5.5 positioniert und richtet sich an Coding, klar umrissene agentische Arbeit, Dokumentenerstellung, Computerbedienung und multimodale Analyse.

Das Modell behält die Standardpreise von $2 pro einer Million Eingabetoken und $10 pro einer Million Ausgabetoken bei. Anthropic berichtet, dass die Ausgabeerzeugung über 30% schneller ist als bei Sonnet 5 und dass die Aufgaben-kosten um bis zu 30% niedriger liegen können, da das neue Modell Arbeit häufig mit weniger Token und Schritten abschließt.

Veröffentlichte Ergebnisse umfassen 70.6% auf Terminal-Bench 4.0, 55.5% auf CursorBench 4.0, 1844 auf GDPval-AA v2.1 und 80.1% auf OSWorld 2.1. Der praktische Wert liegt nicht in einem einzelnen isolierten Score: Sonnet 5.5 nähert sich Opus 5.5 in mehreren Evaluierungen professioneller Arbeiten an, während es die niedrigeren Standard-Tokenpreise beibehält.

Zentrale Erkenntnisse

  • Claude Sonnet 5.5 ist das zweite Modell in Anthropics Claude-5.5-Familie und für schnelle Produktionsarbeit statt die offensten, am stärksten mehrdeutigen Aufgaben optimiert.
  • Es unterstützt ein Kontextfenster von 1M Token, bis zu 128K Ausgabetoken, Text- und Bildeingaben, adaptive Denkprozesse, Tool-Nutzung und strukturierte Antworten.
  • Standardpreise der Claude API sind $2/M Eingabe, $10/M Ausgabe, $0.20/M Cache-Lesevorgänge und $2.50/M Cache-Schreibvorgänge über fünf Minuten.
  • Anthropic meldet über 30% schnellere Ausgaben als Sonnet 5 sowie deutliche Fortschritte in Coding, Computerbedienung, Diagrammverständnis und Wissensarbeit mit langem Zeithorizont.
  • Die Claude-API-Modell-ID ist claude-sonnet-5-5; Entwickler können außerdem das Claude Sonnet 5.5 API in CometAPI nutzen.

Was ist Claude Sonnet 5.5?

Claude Sonnet 5.5 ist Anthropics neuestes, allgemein einsetzbares Sonnet-Modell und die zweite Veröffentlichung in der Claude-5.5-Familie nach Claude Opus 5.5. Anthropic positioniert es als schnelleres und kostengünstigeres Pendant zu Opus statt als direkten Ersatz des Flaggschiffs.

Der praktische Unterschied: Opus 5.5 zielt auf komplexe, mehrdeutige Arbeit ab, die anhaltendes Urteilsvermögen erfordert, während Sonnet 5.5 für klar umrissene Aufgaben, Bugfixing, schnelle Iterationen, Coding, Dokumentenerstellung und professionelle Workflows mit hohem Volumen optimiert ist.

Was sind die wichtigsten Funktionen von Claude Sonnet 5.5?

Das Modell kombiniert ein Kontextfenster von 1M Token, bis zu 128K Ausgabetoken, Text- und Bildeingaben, adaptives Denken, anpassbaren Aufwand, Tool-Nutzung, strukturierte Ausgaben, Prompt-Caching, Batch-Verarbeitung sowie Support über die Claude API, Amazon Bedrock, Google Cloud, Microsoft Foundry und die Claude Platform auf AWS. Für Produktionsteams ist nicht eine einzelne Funktion entscheidend, sondern die Kombination aus schneller Generierung, geringerem Tokenverbrauch pro Aufgabe und einer Leistung nahe Opus bei mehreren klar umrissenen professionellen Workloads.

Benchmarks zu Claude Sonnet 5.5

Anthropic berichtet von erheblichen Fortschritten in Coding, langhorizontierter professioneller Arbeit, Computerbedienung und visuellem Verständnis. Die folgende Tabelle fasst die vom Unternehmen veröffentlichten Evaluationsergebnisse zusammen.

Benchmark und offizielle QuelleClaude Sonnet 5.5Claude Sonnet 5Claude Opus 5.5GPT-6 Sol
Terminal-Bench 4.070.6%10.3%66.4% at XhighNot publicly reported
FrontierCode 1.1 Main46.2% at Max42.4%54.4%49.3% / 52.1% at Xhigh
CursorBench 4.055.5%34.1%57.8%Not publicly reported
GDPval-AA v2.11844144918461487
AA-Briefcase v1.11811135918221483
Humanity's Last Exam64.5% with tools54.9%67.7%Not reported in the source table
OSWorld 2.180.1%57.0%81.8%Not reported in the source table
Chartography61.6%15.6%64.4%53.6%

Evaluationsbedingungen und Hinweise: Die Scores wurden nicht alle mit derselben Aufwandsstufe gemessen. Das 66.4%-Ergebnis von Opus 5.5 auf Terminal-Bench ist bei Xhigh berichtet. Anthropic weist darauf hin, dass Sonnet 5.5 auf FrontierCode bei Max niedriger abschneiden kann als bei Xhigh, da zusätzliche Prüfschritte zu Timeouts oder nicht zum Umfang passenden Änderungen führen können. Artificial Analysis hat GDPval-AA und AA-Briefcase auf einer Vorab-Bereitstellung von Sonnet 5.5 durchgeführt, die von einem Bug bei strukturierten Ausgaben betroffen war, den Anthropic inzwischen nach eigenen Angaben behoben hat. Cross-Vendor-Werte für GPT-6 Sol sollten ebenfalls als ältere Beobachtungen betrachtet werden, da OpenAI am 25. September 2026 ein Problem bei der Bildkodierung behoben hat.

Bedeutung der Ergebnisse: Sonnet 5.5 liegt nicht nur auf einzelnen Scores vor Sonnet 5. Es rückt bei Coding, professioneller Arbeit, Computerbedienung und Diagrammerkennung deutlich näher an Opus 5.5 heran und behält gleichzeitig Sonnet-Preise bei. Anthropic berichtet außerdem, dass Sonnet 5.5 bei niedrigem oder mittlerem Aufwand Sonnet 5s Bestwert in mehreren Evaluierungen übertreffen kann – bei ungefähr einem Zehntel der Aufgaben-kosten. Diese Kombination aus Fähigkeit, Geschwindigkeit und Effizienz auf Aufgabenebene ist sein Hauptwettbewerbsvorteil.

Wie gut ist Claude Sonnet 5.5?

Coding

Die Verbesserung ist auch operativ. Anthropic berichtet, dass Sonnet 5.5 Codebasen schneller versteht, Tool-Aufrufe effizienter bündelt, weniger Schritte nutzt und die Kosten pro abgeschlossener Aufgabe senkt. FrontierCode prüft, ob vorgeschlagene Codeänderungen mergebar sind, während CursorBench mehrdeutige Aufgaben mit mehreren Dateien aus realen Codingsitzungen verwendet; die Fortschritte spiegeln daher Repositoriums-übergreifende Ausführung und Urteilsvermögen wider, nicht nur kurze Codegenerierung. Diese Änderungen sind relevant für Bugfixing, Code-Reviews, Testausführung und langlaufende Coding-Agenten.

Was ist Claude Sonnet 5.5? Benchmarks, Preise und API-Zugriff

Wissensarbeit

Die Verbesserungen gehen über Programmierung hinaus. GDPval-AA testet reale, professionelle Aufgaben über 44 Berufe und neun große Branchen hinweg; der Score von Sonnet 5.5 von 1844 — gegenüber 1449 für Sonnet 5 und 1846 für Opus 5.5 — deutet darauf hin, dass sich die Fortschritte auf praktische Analyse, Dokumentensynthese und Entscheidungsunterstützung übertragen, statt auf Labor-Reasoningtests beschränkt zu bleiben.

Anthropic hebt Finanzanalyse, Dokumentensynthese, Folienerstellung, Tabellenarbeit, Diagramminterpretation, Quellenprüfung, Informationsrecherche und professionelle Schreibarbeit als Bereiche hervor, in denen sich das Modell verbessert.

Frühe Tester meldeten auch weniger quantifizierbare Verbesserungen: klarere Zusammenarbeit, natürlicheres konversationelles Urteilsvermögen und ein stärkeres Auge für Design. Anthropic sagt, das Modell könne Benutzeroberflächen verfeinern und Folienschablonen so genau befolgen, dass Decks mit minimaler Nachbearbeitung entstehen; in einem internen Test eines Betriebsreviews hielten zwei Experten den Erstentwurf ohne Änderungen für versandfertig.

Die breitere Implikation ist, dass Sonnet 5.5 als Modell für professionelle Arbeit zu verstehen ist, nicht bloß als günstigeres Coding-Modell.

Computerbedienung

Sonnet 5.5 erzielt 80.1% auf OSWorld 2.1, verglichen mit 57.0% für Sonnet 5 und 81.8% für Opus 5.5. OSWorld bewertet die Fähigkeit, grafische Computerumgebungen zu bedienen; das Resultat zeigt daher eine große Generationsverbesserung und eine Leistung nahe Opus für Workflows mit Browsern, Desktop-Tools und multimodalem Verständnis von Oberflächen. Chartography-Ergebnisse zeigen ein ähnliches Muster bei visueller Diagrammerkennung: 61.6% für Sonnet 5.5 gegenüber 15.6% für Sonnet 5.

Geschwindigkeit

Anthropic berichtet, dass Sonnet 5.5 Ausgaben über 30% schneller als Sonnet 5 generiert und damit zum Zeitpunkt der Einführung das schnellste Sonnet-Modell ist. Schnellere Ausgaben kombiniert mit weniger Tool-Aufrufen und geringerem Tokenverbrauch verkürzen Agent-Loops, verringern Wartezeiten bei iterativem Coding und verbessern den Durchsatz im Support und anderen Workflows mit hohem Volumen.

Was kostet Claude Sonnet 5.5?

Preise und offizielle QuelleClaude Sonnet 5.5CometAPI: Sonnet 5.5Claude Opus 5.5
Cache-Lesevorgänge$0.20 / 1M$0.16 / 1M$0.20 / 1M
Cache-Schreibvorgänge (5 Min)$2.50 / 1M$2 / 1M$5 / 1M
Eingabetoken$2 / 1M$1.60/M$4 / 1M
Ausgabetoken$10 / 1M$8.00/M$20 / 1M

Bei Standard-Tokenraten kostet Sonnet 5.5 halb so viel wie Opus 5.5 für Eingabe und Ausgabe. Anthropic sagt außerdem, dass das neue Sonnet oft weniger Token benötigt, um dieselbe Arbeit abzuschließen als Sonnet 5, wodurch die Kosten pro abgeschlossener Aufgabe sinken.

Dies sind Standardpreise der Claude API. Cloud-Provider-Preise, regionale Verarbeitung, Cache-Dauer, Batch-Rabatte und Regeln für lange Kontexte können die effektiven Kosten verändern.

Welche Sicherheitsänderungen führt Claude Sonnet 5.5 ein?

Anthropic sagt, sein automatisiertes Verhaltensaudit umfasste etwa 1.850 Szenarien und fand, dass Sonnet 5.5 Sonnet 5 bei den meisten getesteten Messgrößen für Ausrichtung, Widerstand gegen Missbrauch und Ehrlichkeit übertrifft oder erreicht.

Cybersicherheits-Schutzmaßnahmen

Da Sonnet 5.5 über stärkere Cyberfähigkeiten als sein Vorgänger verfügt, setzt Anthropic Schutzmaßnahmen ein, die denen für leistungsstärkere Modelle ähneln. Routinemäßige Softwareentwicklung und gewöhnliches Bugfixing bleiben unterstützt, während einige riskantere Cybersicherheitsaufgaben auf einen sichereren Modellpfad zurückfallen können.

Biologie-Schutzmaßnahmen

Das Modell nutzt dieselben Biologie-Schutzmaßnahmen wie Sonnet 5 und adressiert eine eng umrissene Menge potenziell schädlicher Anfragen, während die meisten Forschung, Ausbildung und klinische Arbeit unberührt bleiben.

Anti-Distillation-Schutz

Anthropic sagt, Sonnet 5.5 sei das erste Sonnet-Modell, das mit Sicherheitsklassifikatoren startet, die Reasoning-Extraktion durch industrielle Distillationsangriffe verhindern sollen. Es erweitert außerdem preserved thinking und bindet Denk-Inhalte an das Konto und die Unterhaltung, die sie erstellt haben, sodass das Reasoning nicht frei getrennt und anderswo wiedergegeben werden kann. Die meisten Entwickler werden diese Änderung nicht bemerken, aber Systeme, die Unterhaltungen zwischen Konten verschieben oder früheren Unterhaltungszustand verändern, sollten die Migrationshinweise prüfen.

Diese Aussagen beschreiben Anthropics gemeldete Schutzmaßnahmen und sind keine unabhängige Sicherheitsgarantie für jede Bereitstellung. Teams sollten das Modell anhand ihres eigenen Bedrohungsmodells, ihrer Richtlinien und Hochrisikoworkflows evaluieren.

Claude Sonnet 5.5 vs Claude Sonnet 5 vs Claude Opus 5.5 vs GPT-6 Sol

Claude Sonnet 5.5 ist in dieser Gruppe als schnelles, effizientes Produktionsmodell positioniert. Anthropic berichtet, dass es Ausgaben mehr als 30% schneller generiert als Claude Sonnet 5, bei gleichbleibendem Token-Preis. Claude Opus 5.5 zielt auf schwierigere und stärker mehrdeutige Arbeiten, während GPT-6 Sol der nächstliegende OpenAI-Vergleich für Langkontext-Coding und agentische Workflows ist.

DimensionClaude Sonnet 5Claude Sonnet 5.5Claude Opus 5.5GPT-6 Sol
PositionierungVorheriges Sonnet-ProduktionsmodellSchnelles, effizientes Produktions-ArbeitstierHöherwertiges komplexes ReasoningKomplexe Coding- und agentische Workflows
Kontextfenster1M1M1M1.05M
Maximale Ausgabe128K128K128K128K
Reasoning-SteuerungAdaptive effortAdaptive effortAdaptive thinking, always onnone, low, medium, high, xhigh, and max
Multimodale EingabeText und BilderText und BilderText und BilderText und Bilder
API-VerfügbarkeitClaude API und große Cloud-PlattformenClaude API und große Cloud-PlattformenClaude API und große Cloud-PlattformenResponses API und Chat Completions
Standardpreis pro 1M Input/Output$2 / $10$2 / $10$4 / $20$2 / $10 für Prompts bis 272K Eingabetoken
GeschwindigkeitBasisÜber 30% schneller als Sonnet 5Für schwierigere, langlaufende Arbeit optimiertVariiert je nach Reasoning-Aufwand
FrontierCode 1.142.4%46.2% at Max54.4%49.3% / 52.1% at Xhigh
GDPval-AA v2.11449184418461487
Am besten geeignet fürBestehende Sonnet-WorkloadsHochvolumiges Coding und professionelle AgentenHarte, mehrdeutige, langlaufende AufgabenOpenAI-native Coding, Agenten, Tools und Langkontext-Workflows

Diese Benchmarkzahlen sind berichtete, anbieterübergreifende Beobachtungen und keine kontrollierten, dauerhaften Ranglisten. Ergebnisse hängen von Aufwandsstufen und Bereitstellungsbedingungen ab.

Wie greift man über CometAPI auf Claude Sonnet 5.5 zu und ruft es auf?

Claude Sonnet 5.5 ist über Claude, die Claude Platform, Amazon Web Services, Google Cloud und Microsoft Azure verfügbar. Entwickler, die eine OpenAI-kompatible Schnittstelle für mehrere Anbieter wünschen, können das Modell über das Claude Sonnet 5.5 API in CometAPI mit dem Modellbezeichner claude-sonnet-5-5 aufrufen.

import os
from openai import OpenAI

client = OpenAI(
    api_key=os.environ["COMETAPI_KEY"],
    base_url="https://api.cometapi.com/v1",
)

response = client.chat.completions.create(
    model="claude-sonnet-5-5",
    messages=[
        {
            "role": "user",
            "content": "Analyze this codebase and identify the three highest-impact bugs.",
        }
    ],
    max_tokens=2048,
)

print(response.choices[0].message.content)

Für den Produktiveinsatz sollten der API-Schlüssel in einer Umgebungsvariable gespeichert und Aufwandsstufen, Caching, Tool-Aufrufe, Retry-Verhalten sowie der Tokenverbrauch auf Aufgabenebene evaluiert werden.

Was ist die Effort-Einstellung in Claude Sonnet 5.5?

Claude Sonnet 5.5 unterstützt anpassbare Aufwandsstufen, die Geschwindigkeit und Tokenverbrauch gegen Reasoning-Tiefe abwägen. Anthropic setzt in den Claude-Apps und in Claude Code standardmäßig Medium, während die Claude Platform standardmäßig High verwendet.

Niedrigere Aufwandsstufen eignen sich für Routine- oder stark strukturierte Arbeit. Höhere Stufen ermöglichen mehr Reasoning und Prüfungen für schwierigere Coding-, Analyse- und agentische Aufgaben. Budgetierung in der Produktion sollte daher Aufwand, Tool-Nutzung und Gesamtkosten der Aufgabenabschlüsse berücksichtigen, statt nur den Tokenpreis.

API: Was ist neu im Vergleich zu Sonnet 5

Fünf Änderungen können bestehende Sonnet-5-Integrationen brechen oder verändern:

  1. Thinking-off migrations: Integrationen, die Thinking deaktiviert hatten, sollten auf thinking: {"type": "between_tools"} umstellen. Diese Einstellung schaltet Thinking vorab aus, während das Reasoning zwischen Tools erhalten bleibt.
  2. Forced tool use: Erzwungene Tool-Wahlen führen jetzt zu einem Fehler; verwenden Sie automatische Tool-Auswahl mit strikten Schemata, wo geeignet.
  3. Thinking-block preservation: Thinking-Blöcke sind an das Modell und die Unterhaltung gebunden. Geben Sie sie unverändert zurück und gehen Sie nicht davon aus, dass sie nach Änderungen früherer Systemnachrichten, Tools oder des Accountkontexts erneut abgespielt werden können.
  4. Computer-use tool version: In der Claude API und bei Google Cloud wird das ältere computer_20251124-Tool nicht mehr akzeptiert; migrieren Sie auf den aktuell dokumentierten Computer-Toolsatz.
  5. Advisor compatibility: Das Advisor-Tool lehnt Claude Opus 4.8, Opus 4.7 und Sonnet 5 als Advisors ab.

Eine zusätzliche Änderung der Antwortform kann stillschweigend fehlschlagen: Text, der zwischen Tool-Aufrufen generiert wird, kann in Thinking-Blöcken statt in Text-Blöcken erscheinen. Anwendungen, die Fortschrittsmeldungen streamen, sollten Antworten nach Blocktyp verarbeiten und einen entsprechenden Anzeigemodus setzen. Sonnet 5.5 fügt außerdem per-Nachricht-Aufwand (Beta), Systemnachrichten mitten in Unterhaltungen, Tool-Änderungen mitten in Unterhaltungen (Beta), eine minimale cachebare Promptlänge von 512 Token, Batch-Verarbeitung, Files-API-Support, PDF- und Vision-Eingaben sowie sowohl Server- als auch Client-seitige Tools hinzu.

Was bedeutet Claude Sonnet 5.5 für die Claude-5.5-Familie?

  • Claude Opus 5.5: komplexe, urteilslastige, langhorizontierte Arbeit.
  • Claude Sonnet 5.5: effiziente Produktion, Coding, Agenten und professionelle Arbeit.
  • Claude Haiku 5.5: angekündigt als bevorstehendes, hochdurchsatz- und kostensensitives Mitglied der Familie.

Die breitere Entwicklung geht dahin, Kosten pro erfolgreicher Aufgabe, Inferenzgeschwindigkeit und Modellrouting zu messen, statt sich nur auf den reinen Tokenpreis oder einen einzelnen Benchmark zu konzentrieren.

Fazit

Claude Sonnet 5.5 ist ein auf Effizienz fokussiertes Upgrade für die Produktionsebene von Anthropic. Es behält die Standard-Tokenpreise von Sonnet 5 ($2/$10) bei und bietet ein Kontextfenster von 1M Token, bis zu 128K Ausgabetoken, deutlich schnellere Generierung und starke Fortschritte in Coding, Computerbedienung, visuellem Verständnis und Wissensarbeit.

Das stärkste Argument für das Modell sind die Workload-Ökonomie: wie zuverlässig und schnell es eine Aufgabe abschließt, wie viele Tool-Aufrufe und Token es verbraucht und wie häufig ein Workflow noch eine Eskalation zu Opus 5.5 benötigt. Teams sollten diese Faktoren auf ihren eigenen Aufgaben validieren und anbieterübergreifende Benchmarks als datierte Beobachtungen statt als permanente Ranglisten behandeln.

Weiterlernen

Diesen Artikel mit der nächsten Entscheidung verknüpfen.

Alle Themen anzeigen
Veröffentlicht am Sep 29, 2026
Zuletzt aktualisiert Sep 29, 2026
0 Aufrufe
Auf Klarheit, Quellenangabe und aktuelle API-Terminologie geprüft.

Bereit, die KI-Entwicklungskosten um 20 % zu senken?

In wenigen Minuten kostenlos starten. Inklusive kostenlosem Testguthaben. Keine Kreditkarte erforderlich.

Mehr lesen