TL;DR
Claude Sonnet 5.5 adalah model kelas Sonnet terbaru dari Anthropic, dirilis pada 28 September 2026. Model ini diposisikan sebagai pelengkap yang lebih cepat dan berbiaya lebih rendah dibanding Claude Opus 5.5 untuk pengodean, pekerjaan agen yang terstruktur dengan baik, produksi dokumen, penggunaan komputer, dan analisis multimodal.
Model ini mempertahankan harga standar sebesar $2 per satu juta token input dan $10 per satu juta token output. Anthropic melaporkan generasi output lebih dari 30% lebih cepat dibanding Sonnet 5 dan biaya per tugas yang dapat hingga 30% lebih rendah karena model yang lebih baru sering menyelesaikan pekerjaan dengan lebih sedikit token dan langkah.
Hasil yang dipublikasikan mencakup 70.6% pada Terminal-Bench 4.0, 55.5% pada CursorBench 4.0, 1844 pada GDPval-AA v2.1, dan 80.1% pada OSWorld 2.1. Nilai praktisnya bukan satu skor terisolasi: Sonnet 5.5 mendekati Opus 5.5 pada beberapa evaluasi pekerjaan profesional sambil mempertahankan harga token standar yang lebih rendah.
Poin-poin Utama
- Claude Sonnet 5.5 adalah model kedua dalam keluarga Claude 5.5 dan dioptimalkan untuk pekerjaan produksi cepat alih-alih tugas yang paling ambigu dan terbuka.
- Mendukung jendela konteks 1M token, hingga 128K token output, input teks dan gambar, adaptive thinking, penggunaan alat, dan respons terstruktur.
- Harga standar Claude API adalah $2/M input, $10/M output, $0.20/M cache read, dan $2.50/M cache write lima menit.
- Anthropic melaporkan output 30%+ lebih cepat daripada Sonnet 5 dan peningkatan kuat dalam pengodean, penggunaan komputer, pemahaman grafik, dan pekerjaan pengetahuan jangka panjang.
- ID model Claude API adalah claude-sonnet-5-5; pengembang juga dapat mengakses API Claude Sonnet 5.5 di CometAPI.
Apa itu Claude Sonnet 5.5?
Claude Sonnet 5.5 adalah model Sonnet serbaguna terbaru dari Anthropic dan rilis kedua dalam keluarga Claude 5.5 setelah Claude Opus 5.5. Anthropic memposisikannya sebagai pelengkap yang lebih cepat dan lebih hemat biaya dibanding Opus, bukan sebagai pengganti langsung untuk flagship.
Perbedaannya bersifat praktis: Opus 5.5 ditujukan untuk pekerjaan kompleks dan ambigu yang membutuhkan penilaian berkelanjutan, sementara Sonnet 5.5 dioptimalkan untuk tugas yang terdefinisi dengan baik, perbaikan bug, iterasi cepat, pengodean, produksi dokumen, dan alur kerja profesional ber-volume tinggi.
Apa Fitur Terpenting dari Claude Sonnet 5.5?
Model ini menggabungkan jendela konteks 1M token, hingga 128K token output, input teks dan gambar, adaptive thinking, adjustable effort, penggunaan alat, output terstruktur, caching prompt, pemrosesan batch, dan dukungan di Claude API, Amazon Bedrock, Google Cloud, Microsoft Foundry, serta Claude Platform di AWS. Bagi tim produksi, kombinasi yang menentukan bukan satu fitur tunggal melainkan generasi cepat, penggunaan token per tugas yang lebih rendah, dan performa mendekati Opus pada beberapa beban kerja profesional yang terstruktur dengan baik.
Benchmark Claude Sonnet 5.5
Anthropic melaporkan peningkatan substansial dalam pengodean, pekerjaan profesional jangka panjang, penggunaan komputer, dan pemahaman visual. Tabel di bawah merangkum hasil evaluasi yang dipublikasikan perusahaan.
| Benchmark dan sumber resmi | Claude Sonnet 5.5 | Claude Sonnet 5 | Claude Opus 5.5 | GPT-6 Sol |
|---|---|---|---|---|
| Terminal-Bench 4.0 | 70.6% | 10.3% | 66.4% at Xhigh | Tidak dilaporkan secara publik |
| FrontierCode 1.1 Main | 46.2% at Max | 42.4% | 54.4% | 49.3% / 52.1% at Xhigh |
| CursorBench 4.0 | 55.5% | 34.1% | 57.8% | Tidak dilaporkan secara publik |
| GDPval-AA v2.1 | 1844 | 1449 | 1846 | 1487 |
| AA-Briefcase v1.1 | 1811 | 1359 | 1822 | 1483 |
| Humanity's Last Exam | 64.5% with tools | 54.9% | 67.7% | Tidak tercantum di tabel sumber |
| OSWorld 2.1 | 80.1% | 57.0% | 81.8% | Tidak tercantum di tabel sumber |
| Chartography | 61.6% | 15.6% | 64.4% | 53.6% |
Ketentuan evaluasi dan catatan: Skor tidak semua diukur pada pengaturan effort yang sama. Hasil 66.4% Opus 5.5 untuk Terminal-Bench dilaporkan pada Xhigh. Anthropic mencatat bahwa Sonnet 5.5 dapat meraih skor lebih rendah pada Max dibanding Xhigh di FrontierCode karena langkah peninjauan ekstra dapat menyebabkan timeout atau edit di luar cakupan. Artificial Analysis menjalankan GDPval-AA dan AA-Briefcase pada deployment pra-rilis Sonnet 5.5 yang terdampak bug structured-output yang menurut Anthropic kini telah diperbaiki. Angka lintas vendor GPT-6 Sol juga harus diperlakukan sebagai observasi yang sudah usang karena OpenAI memperbaiki masalah encoding gambar pada 25 September 2026.
Makna hasil: Sonnet 5.5 tidak sekadar unggul atas Sonnet 5 pada skor-skor terisolasi. Model ini bergerak jauh lebih dekat ke Opus 5.5 pada pengodean, pekerjaan profesional, penggunaan komputer, dan pengenalan grafik sambil tetap menjaga harga setara Sonnet. Anthropic juga melaporkan bahwa pada effort Low atau Medium, Sonnet 5.5 dapat melampaui skor terbaik Sonnet 5 pada beberapa evaluasi dengan kira-kira sepersepuluh biaya per tugas. Kombinasi kapabilitas, kecepatan, dan efisiensi tingkat tugas itulah keunggulan kompetitif utamanya.
Seberapa Baik Claude Sonnet 5.5?
Pengodean
Peningkatannya juga bersifat operasional. Anthropic melaporkan bahwa Sonnet 5.5 memahami codebase lebih cepat, mengelompokkan panggilan alat dengan lebih efisien, menggunakan lebih sedikit langkah, dan menurunkan biaya per tugas yang diselesaikan. FrontierCode menguji apakah perubahan kode yang diusulkan dapat di-merge, sementara CursorBench menggunakan tugas multi-berkas yang ambigu yang diambil dari sesi pengodean nyata; karena itu, peningkatan mencerminkan eksekusi dan penilaian tingkat repositori, bukan hanya generasi kode pendek. Perubahan ini penting untuk perbaikan bug, code review, eksekusi pengujian, dan agen pengodean jangka panjang.

Pekerjaan Berbasis Pengetahuan
Peningkatan melampaui pemrograman. GDPval-AA menguji tugas profesional dunia nyata di 44 profesi dan sembilan industri utama, sehingga skor Sonnet 5.5 sebesar 1844—dibanding 1449 untuk Sonnet 5 dan 1846 untuk Opus 5.5—menunjukkan bahwa peningkatannya berpindah ke analisis praktis, produksi dokumen, dan pekerjaan dukungan keputusan, bukan hanya tetap pada uji penalaran laboratorium.
Anthropic menyoroti analisis keuangan, sintesis dokumen, pembuatan slide, pekerjaan spreadsheet, interpretasi grafik, pemeriksaan sumber, pengambilan informasi, dan penulisan profesional sebagai area yang mengalami peningkatan.
Penguji awal juga melaporkan peningkatan yang kurang terkuantifikasi: kolaborasi yang lebih jelas, penilaian percakapan yang lebih natural, dan kepekaan desain yang lebih kuat. Anthropic mengatakan model ini dapat menambah polesan pada antarmuka pengguna dan mengikuti template slide dengan cukup dekat sehingga menghasilkan deck yang membutuhkan penyuntingan minimal; dalam satu uji tinjauan operasional internal, dua ahli menilai draf pertama siap dikirim tanpa perubahan.
Implikasi yang lebih luas adalah bahwa Sonnet 5.5 paling tepat dipahami sebagai model pekerjaan profesional, bukan sekadar model pengodean yang lebih murah.
Penggunaan Komputer
Sonnet 5.5 meraih 80.1% pada OSWorld 2.1, dibanding 57.0% untuk Sonnet 5 dan 81.8% untuk Opus 5.5. OSWorld mengevaluasi kemampuan mengoperasikan lingkungan komputer berbasis grafis, sehingga hasil ini menunjukkan peningkatan generasional yang besar dan performa mendekati Opus untuk alur kerja yang melibatkan browser, alat desktop, dan pemahaman antarmuka multimodal. Hasil Chartography menunjukkan pola serupa dalam pengenalan grafik visual: 61.6% untuk Sonnet 5.5 dibanding 15.6% untuk Sonnet 5.
Kecepatan
Anthropic melaporkan bahwa Sonnet 5.5 menghasilkan output lebih dari 30% lebih cepat dibanding Sonnet 5, menjadikannya model Sonnet tercepat saat diluncurkan. Output yang lebih cepat dipadukan dengan lebih sedikit panggilan alat dan penggunaan token yang lebih rendah untuk mempersingkat loop agen, mengurangi waktu tunggu selama pengodean iteratif, dan meningkatkan throughput dalam dukungan dan alur kerja ber-volume tinggi lainnya.
Berapa Biaya Claude Sonnet 5.5?
| Harga dan sumber resmi | Claude Sonnet 5.5 | CometAPI: Sonnet 5.5 | Claude Opus 5.5 |
|---|---|---|---|
| Cache reads | $0.20 / 1M | $0.16 / 1M | $0.20 / 1M |
| Five-minute cache writes | $2.50 / 1M | $2 / 1M | $5 / 1M |
| Input tokens | $2 / 1M | $1.60/M | $4 / 1M |
| Output tokens | $10 / 1M | $8.00/M | $20 / 1M |
Pada tarif token standar, Sonnet 5.5 berbiaya setengah dari Opus 5.5 untuk input dan output. Anthropic juga mengatakan Sonnet yang lebih baru ini sering membutuhkan lebih sedikit token untuk menyelesaikan pekerjaan yang sama dibanding Sonnet 5, sehingga menurunkan biaya per tugas yang diselesaikan.
Ini adalah harga standar Claude API. Harga penyedia cloud, pemrosesan regional, durasi cache, diskon batch, dan aturan konteks panjang dapat mengubah biaya efektif.
Perubahan Keamanan Apa yang Diperkenalkan Claude Sonnet 5.5?
Anthropic mengatakan audit perilaku otomatisnya mencakup sekitar 1.850 skenario dan menemukan bahwa Sonnet 5.5 meningkat atau menyamai Sonnet 5 pada sebagian besar ukuran yang diuji terkait alignment, resistensi terhadap penyalahgunaan, dan kejujuran.
Perlindungan Keamanan Siber
Karena Sonnet 5.5 memiliki kapabilitas siber yang lebih kuat dibanding pendahulunya, Anthropic menerapkan perlindungan serupa dengan yang digunakan untuk model yang lebih kapabel. Pengembangan perangkat lunak rutin dan perbaikan bug biasa tetap didukung, sementara beberapa tugas keamanan siber berisiko lebih tinggi dapat dialihkan ke jalur model yang lebih aman.
Perlindungan Biologi
Model ini menggunakan perlindungan biologi yang sama seperti Sonnet 5, menargetkan serangkaian permintaan yang berpotensi berbahaya secara sempit sambil membiarkan sebagian besar penelitian, pendidikan, dan pekerjaan klinis tidak terpengaruh.
Perlindungan Anti-distilasi
Anthropic mengatakan Sonnet 5.5 adalah model Sonnet pertama yang diluncurkan dengan classifier keselamatan yang dirancang untuk mencegah ekstraksi penalaran melalui serangan distilasi skala industri. Model ini juga memperluas preserved thinking, mengikat konten penalaran ke akun dan percakapan yang membuatnya sehingga penalaran tersebut tidak dapat dilepas dan diputar ulang secara bebas di tempat lain. Sebagian besar pengembang tidak akan menyadari perubahan ini, tetapi sistem yang memindahkan percakapan antar akun atau mengubah status percakapan sebelumnya harus meninjau panduan migrasi.
Pernyataan ini menggambarkan perlindungan yang dilaporkan Anthropic, bukan jaminan independen atas keselamatan untuk setiap deployment. Tim harus mengevaluasi model terhadap model ancaman, kebijakan, dan alur kerja berisiko tinggi mereka sendiri.
Claude Sonnet 5.5 vs Claude Sonnet 5 vs Claude Opus 5.5 vs GPT-6 Sol
Claude Sonnet 5.5 diposisikan sebagai model produksi yang cepat dan efisien dalam kelompok ini. Anthropic melaporkan bahwa model ini menghasilkan output lebih dari 30% lebih cepat dibanding Claude Sonnet 5 sambil mempertahankan harga token utama yang sama. Claude Opus 5.5 menargetkan pekerjaan yang lebih sulit dan ambigu, sementara GPT-6 Sol adalah pembanding terdekat dari OpenAI untuk pengodean konteks panjang dan alur kerja agen.
| Dimensi | Claude Sonnet 5 | Claude Sonnet 5.5 | Claude Opus 5.5 | GPT-6 Sol |
|---|---|---|---|---|
| Posisi | Model produksi Sonnet sebelumnya | Kuda kerja produksi yang cepat dan efisien | Penalaran kompleks kelas atas | Pengodean kompleks dan alur kerja agen |
| Jendela konteks | 1M | 1M | 1M | 1.05M |
| Output maksimum | 128K | 128K | 128K | 128K |
| Kontrol penalaran | Adaptive effort | Adaptive effort | Adaptive thinking, always on | none, low, medium, high, xhigh, and max |
| Input multimodal | Teks dan gambar | Teks dan gambar | Teks dan gambar | Teks dan gambar |
| Ketersediaan API | Claude API dan platform cloud utama | Claude API dan platform cloud utama | Claude API dan platform cloud utama | Responses API dan Chat Completions |
| Harga standar per 1M input/output | $2 / $10 | $2 / $10 | $4 / $20 | $2 / $10 untuk prompt hingga 272K token input |
| Kecepatan | Baseline | Lebih dari 30% lebih cepat dari Sonnet 5 | Dioptimalkan untuk pekerjaan lebih sulit | Bervariasi menurut effort penalaran |
| FrontierCode 1.1 | 42.4% | 46.2% at Max | 54.4% | 49.3% / 52.1% at Xhigh |
| GDPval-AA v2.1 | 1449 | 1844 | 1846 | 1487 |
| Paling cocok untuk | Beban kerja Sonnet yang sudah ada | Agen pengodean dan profesional ber-volume tinggi | Tugas sulit, ambigu, dan jangka panjang | Alur kerja pengodean, agen, alat, dan konteks panjang native OpenAI |
Angka benchmark ini merupakan observasi lintas vendor, bukan peringkat permanen yang terkontrol. Hasil bergantung pada pengaturan effort dan kondisi deployment.
Bagaimana Mengakses dan Memanggil Claude Sonnet 5.5 melalui CometAPI?
Claude Sonnet 5.5 tersedia melalui Claude, Claude Platform, Amazon Web Services, Google Cloud, dan Microsoft Azure. Pengembang yang menginginkan antarmuka kompatibel OpenAI tunggal untuk banyak penyedia dapat memanggil model melalui API Claude Sonnet 5.5 di CometAPI dengan pengenal model claude-sonnet-5-5.
import os
from openai import OpenAI
client = OpenAI(
api_key=os.environ["COMETAPI_KEY"],
base_url="https://api.cometapi.com/v1",
)
response = client.chat.completions.create(
model="claude-sonnet-5-5",
messages=[
{
"role": "user",
"content": "Analisis basis kode ini dan identifikasi tiga bug dengan dampak tertinggi.",
}
],
max_tokens=2048,
)
print(response.choices[0].message.content)
Untuk penggunaan produksi, simpan kunci API dalam variabel lingkungan dan evaluasi pengaturan effort, caching, pemanggilan alat, perilaku retry, dan konsumsi token tingkat tugas.
Apa Itu Pengaturan Effort di Claude Sonnet 5.5?
Claude Sonnet 5.5 mendukung tingkat effort yang dapat disesuaikan yang menukar kecepatan dan penggunaan token dengan kedalaman penalaran. Anthropic mengatur effort Medium secara default di aplikasi Claude dan Claude Code, sementara Claude Platform default ke High.
Pengaturan effort yang lebih rendah cocok untuk pekerjaan rutin atau sangat terstruktur. Pengaturan yang lebih tinggi memungkinkan lebih banyak penalaran dan pemeriksaan untuk tugas pengodean, analisis, dan agen yang lebih sulit. Karena itu, penganggaran produksi harus mempertimbangkan effort, penggunaan alat, dan total biaya penyelesaian tugas, bukan hanya harga token.
API: Apa yang baru dibanding Sonnet 5
Lima perubahan dapat merusak atau mengubah integrasi Sonnet 5 yang ada:
- Thinking-off migrations: integrasi yang menonaktifkan thinking harus beralih ke
thinking: {"type": "between\_tools"}. Pengaturan ini mematikan thinking di awal namun mempertahankan perilaku penalaran di antara alat. - Forced tool use: pemilihan alat paksa kini mengembalikan error; gunakan seleksi alat otomatis dengan skema ketat jika sesuai.
- Thinking-block preservation: blok thinking diikat ke model dan percakapan. Teruskan kembali tanpa perubahan, dan jangan berasumsi blok tersebut dapat diputar ulang setelah mengubah pesan sistem sebelumnya, alat, atau konteks akun.
- Computer-use tool version: pada Claude API dan Google Cloud, alat lama
computer\_20251124tidak lagi diterima; migrasikan ke set alat computer yang saat ini didokumentasikan. - Advisor compatibility: alat advisor menolak Claude Opus 4.8, Opus 4.7, dan Sonnet 5 sebagai advisor.
Satu perubahan bentuk respons tambahan dapat gagal secara senyap: teks yang dihasilkan di antara panggilan alat dapat muncul di blok thinking alih-alih blok teks. Aplikasi yang melakukan streaming pesan progres harus memproses respons berdasarkan tipe blok dan mengatur mode tampilan yang sesuai. Sonnet 5.5 juga menambahkan per-message effort dalam beta, pesan sistem di tengah percakapan, perubahan alat di tengah percakapan dalam beta, panjang minimum prompt yang dapat di-cache sebesar 512 token, pemrosesan batch, dukungan Files API, input PDF dan visi, serta alat sisi server dan sisi klien.
Apa Arti Claude Sonnet 5.5 bagi Keluarga Claude 5.5?
- Claude Opus 5.5: pekerjaan kompleks, penilaian tinggi, dan jangka panjang.
- Claude Sonnet 5.5: produksi efisien, pengodean, agen, dan pekerjaan profesional.
- Claude Haiku 5.5: diumumkan sebagai anggota keluarga yang akan datang dengan throughput tinggi dan sensitif biaya.
Perubahan yang lebih luas adalah menuju pengukuran biaya per tugas berhasil, kecepatan inferensi, dan perutean model daripada hanya fokus pada harga token mentah atau satu benchmark.
Kesimpulan
Claude Sonnet 5.5 adalah peningkatan berfokus efisiensi untuk tier produksi Anthropic. Model ini mempertahankan harga token standar Sonnet 5 sebesar $2/$10 sambil menambahkan jendela konteks 1M token, hingga 128K token output, generasi yang secara signifikan lebih cepat, dan peningkatan kuat di pengodean, penggunaan komputer, pemahaman visual, dan pekerjaan berbasis pengetahuan.
Argumen terkuat untuk model ini adalah ekonomi beban kerja: seberapa andal dan cepat ia menyelesaikan tugas, berapa banyak panggilan alat dan token yang dikonsumsi, dan seberapa sering alur kerja masih perlu diekcalasi ke Opus 5.5. Tim harus memvalidasi faktor-faktor tersebut pada tugas mereka sendiri dan memperlakukan benchmark lintas vendor sebagai observasi yang sudah usang, bukan peringkat permanen.
