Spesifikasi teknis — Claude Sonnet 4.6
| Item | Claude Sonnet 4.6 (ringkasan publik) |
|---|---|
| Penyedia | Anthropic |
| Keluarga model | Sonnet (keluarga Claude v4.x) — varian Sonnet 4.6 |
| ID model (kanonis) | claude-sonnet-4-6 |
| Jenis input | Teks (utama). Dukungan terbatas/sekunder untuk I/O alat terstruktur/JSON. Tidak diposisikan sebagai model utama untuk pembuatan gambar. |
| Jenis output | Teks (bahasa alami, JSON terstruktur, kode, dan payload pemanggilan alat) |
| Jendela konteks | ~200,000 token (sekitar) — dirancang untuk koherensi multi-dokumen dan sesi panjang |
| Pemanggilan fungsi / penggunaan alat | Ya — pemanggilan alat terstruktur, output dibatasi JSON, orkestrasi bergaya agen didukung |
| Multimodalitas | Terbatas — Sonnet berfokus pada teks dan integrasi alat terstruktur; tidak dioptimalkan untuk pembuatan gambar. |
| Sorotan catatan rilis | Stabilitas/perbaikan dalam penalaran konteks panjang, varian Sonnet berlatensi lebih rendah yang disetel untuk kompromi kecepatan–akurasi, peningkatan kepatuhan terhadap instruksi. |
Apa itu Claude Sonnet 4.6
Claude Sonnet 4.6 adalah evolusi terbaru dari lini model Sonnet milik Anthropic, dirancang untuk menghadirkan kinerja mendekati Opus dengan harga yang lebih terjangkau. Model ini meningkatkan Sonnet dari iterasi 4.5 sebelumnya, menghadirkan kemampuan mengikuti instruksi yang lebih kuat, dukungan konteks yang jauh lebih luas, peningkatan kemampuan pengodean dan penggunaan komputer, serta kemampuan penalaran multi-langkah yang lebih luas — sambil mempertahankan kesetaraan harga dengan Sonnet 4.5.
Berbeda dengan model Opus, yang merupakan flagship dan dioptimalkan untuk beban kerja agen yang berat, Sonnet 4.6 menargetkan pengembang dan pekerjaan pengetahuan umum di mana kemampuan luas dan efektivitas biaya menjadi penting.
Fitur utama Claude Sonnet 4.6
- Jendela konteks 1M token (Beta): Sonnet 4.6 mendukung hingga satu juta token konteks dalam beta — kira-kira cukup untuk memuat seluruh basis kode, tumpukan kontrak hukum, atau beberapa makalah akademik dalam satu permintaan.
- Kinerja pengodean yang ditingkatkan: Dibandingkan dengan Sonnet 4.5, Sonnet 4.6 menunjukkan peningkatan signifikan dalam tugas pengembang dunia nyata dan tolok ukur seperti SWE-Bench Verified (~79.6% skor dilaporkan), sehingga cocok untuk tugas pengodean yang kompleks.
- Penggunaan komputer yang ditingkatkan: Tingkat kompetensi baru dalam tugas yang melibatkan pengoperasian perangkat lunak (spreadsheet, alur kerja formulir web multi-langkah, dll.) mendekati kinerja tingkat manusia pada uji OSWorld-Verified.
- Pemikiran adaptif: Model ini menggabungkan strategi penalaran yang ditingkatkan dan dapat secara dinamis mengalokasikan komputasi internal untuk menangani masalah kompleks selangkah demi selangkah.
- Kepatuhan instruksi yang lebih kuat: Pengguna melaporkan lebih banyak konsistensi dan presisi dalam mengikuti permintaan terperinci, dengan lebih sedikit halusinasi dan penyelesaian tugas yang lebih baik.
- Keamanan & ketahanan terhadap prompt injection: Anthropic telah meningkatkan ketahanan dibandingkan Sonnet 4.5 dalam menahan serangan prompt injection dan kerentanan serupa.
Kinerja benchmark Claude Sonnet 4.6
| Evaluasi | Claude Sonnet 4.6 (sekitar) | Catatan |
|---|---|---|
| SWE-Bench Verified | ~79.6% | Kinerja pengodean yang kuat mendekati kelas Opus. |
| OSWorld-Verified (Computer Use) | ~72.5% | Kinerja tugas mendekati tingkat manusia; kuat untuk alur kerja. |
| ARC-AGI-2 | ~60.4% | Mencerminkan kekuatan penalaran yang luas. |
Sebagai model kelas menengah, Sonnet 4.6 secara signifikan memperkecil kesenjangan kinerja dengan model Opus, menjadikannya cocok untuk banyak tugas yang sebelumnya diperuntukkan bagi kelas flagship.
Claude Sonnet 4.6 vs model Claude lainnya
| Model | Terbaik untuk | Perbedaan utama |
|---|---|---|
| Claude Sonnet 4.6 | Pengodean dan penalaran seimbang, konteks besar | Jendela konteks masif dalam beta, hemat biaya, kuat untuk tugas alur kerja. |
| Claude Sonnet 4.5 | Tugas umum kelas menengah | Tolok ukur lebih rendah, jendela konteks lebih kecil sebelum 4.6. |
| Claude Opus 4.6 | Penalaran mendalam & pengodean agentik | Penalaran mentah dan kemampuan agen yang lebih kuat; lebih mahal. |
Dibandingkan dengan Sonnet 4.5, rilis 4.6 meningkatkan pemahaman konteks dan kinerja pada tugas gaya perkantoran; dibandingkan dengan model Opus, Sonnet sedikit di bawah dalam kekuatan penalaran flagship tetapi seringkali lebih mendekati dalam tolok ukur pengodean dan tugas umum.
Keterbatasan Claude Sonnet 4.6
- Jendela konteks Beta: Konteks 1M token saat ini dalam beta — adopsi dan stabilitas dapat bervariasi tergantung penggunaan API dan paket.
- Latensi & biaya: Menangani konteks yang sangat besar meningkatkan biaya komputasi dan dapat memperkenalkan latensi lebih tinggi pada panggilan API dibandingkan konteks yang lebih kecil.
- Granularitas tolok ukur: Walaupun kuat dalam tes yang dilaporkan, Sonnet dapat sedikit tertinggal dari Opus pada tolok ukur penalaran paling kompleks atau multidisipliner.
Kasus penggunaan representatif Claude Sonnet 4.6
- Bantuan basis kode besar: Ideal untuk memuat dan bernalar tentang seluruh sistem perangkat lunak, refactoring, atau ketergantungan lintas file.
- Sintesis dokumen & riset: Berguna untuk analisis dokumen panjang di mana konteks melampaui batas biasanya.
- Automasi alur kerja: Menyelesaikan tugas komputer multi-langkah, seperti spreadsheet dan automasi formulir.
- Pekerjaan pengetahuan umum: Cocok untuk pekerja pengetahuan yang membutuhkan kepatuhan instruksi yang andal dan penalaran tanpa biaya model flagship.
Cara mengakses dan menggunakan API Claude Sonnet 4.6
Langkah 1: Daftar untuk Kunci API
Masuk ke cometapi.com. Jika Anda belum menjadi pengguna kami, silakan daftar terlebih dahulu. Masuk ke CometAPI console. Dapatkan kredensial akses kunci API untuk antarmuka. Klik “Add Token” pada token API di pusat pribadi, dapatkan kunci token: sk-xxxxx dan kirimkan.
Langkah 2: Kirim permintaan ke API claude-sonnet-4-6
Pilih endpoint “claude-opus-4-6” untuk mengirim permintaan API dan setel body permintaan. Metode permintaan dan body permintaan diperoleh dari dokumen API di situs web kami. Situs kami juga menyediakan pengujian Apifox untuk kenyamanan Anda. Gantilah <YOUR_API_KEY> dengan kunci CometAPI Anda yang sebenarnya dari akun Anda. Di mana memanggilnya: format Anthropic Messages dan format Chat.
Masukkan pertanyaan atau permintaan Anda ke bidang konten—itulah yang akan direspons oleh model. Proses respons API untuk mendapatkan jawaban yang dihasilkan.
Langkah 3: Ambil dan verifikasi hasil
Proses respons API untuk mendapatkan jawaban yang dihasilkan. Setelah pemrosesan, API merespons dengan status tugas dan data keluaran.