Spesifikasi Teknis — Claude Sonnet 4.6
| Item | Claude Sonnet 4.6 (ringkasan publik) |
|---|---|
| Provider | Anthropic |
| Model family | Sonnet (keluarga Claude v4.x) — varian Sonnet 4.6 |
| Model id (canonical) | claude-sonnet-4-6 |
| Input types | Teks (utama). Dukungan terbatas/sekunder untuk I/O alat/JSON terstruktur. Tidak diposisikan sebagai model utama untuk pembuatan gambar. |
| Output types | Teks (bahasa alami, JSON terstruktur, kode, dan payload pemanggilan alat) |
| Context window | ~200,000 token (perkiraan) — dirancang untuk koherensi multi-dokumen dan sesi panjang |
| Function-calling / tool use | Ya — pemanggilan alat terstruktur, output terbatasi JSON, orkestrasi gaya agen didukung |
| Multimodality | Terbatas — Sonnet berfokus pada teks dan integrasi alat terstruktur; tidak dioptimalkan untuk pembuatan gambar. |
| Release note highlights | Stabilitas/perbaikan dalam penalaran konteks panjang, varian Sonnet berlatensi lebih rendah yang disetel untuk kompromi kecepatan–akurasi, kepatuhan instruksi yang lebih baik. |
Apa Itu Claude Sonnet 4.6
Claude Sonnet 4.6 adalah evolusi terbaru dari lini model Sonnet milik Anthropic, dirancang untuk menghadirkan kinerja mendekati Opus dengan harga yang lebih terjangkau. Versi ini meningkatkan Sonnet dari iterasi 4.5 sebelumnya, menghadirkan kemampuan mengikuti instruksi yang lebih kuat, dukungan konteks yang sangat diperluas, peningkatan kemampuan pengodean dan penggunaan komputer, serta kemampuan penalaran multi-langkah yang lebih luas — sekaligus mempertahankan paritas harga dengan Sonnet 4.5.
Tidak seperti model Opus, yang merupakan flagship dan dioptimalkan untuk beban kerja agen yang berat, Sonnet 4.6 menargetkan pengembang dan pekerjaan pengetahuan umum di mana kapabilitas luas dan efektivitas biaya menjadi fokus.
Fitur Utama Claude Sonnet 4.6
- Jendela Konteks 1M Token (Beta): Sonnet 4.6 mendukung hingga satu juta token konteks dalam beta — kira-kira cukup untuk mengasup keseluruhan basis kode, tumpukan kontrak hukum, atau beberapa makalah akademik dalam satu permintaan.
- Kinerja Pengodean yang Ditingkatkan: Dibandingkan Sonnet 4.5, Sonnet 4.6 menunjukkan peningkatan signifikan pada tugas pengembang dunia nyata dan tolok ukur seperti SWE-Bench Verified (~79.6% dilaporkan), sehingga cocok untuk tugas pengodean yang kompleks.
- Penggunaan Komputer yang Ditingkatkan: Tingkat kompetensi baru dalam tugas yang melibatkan pengoperasian perangkat lunak (spreadsheet, alur kerja formulir web multi-langkah, dll.) mendekati kinerja setara manusia pada pengujian OSWorld-Verified.
- Pemikiran Adaptif: Model ini menggabungkan strategi penalaran yang ditingkatkan dan dapat mengalokasikan komputasi internal secara dinamis untuk menangani masalah kompleks langkah demi langkah.
- Kepatuhan Instruksi yang Lebih Kuat: Pengguna melaporkan konsistensi dan presisi yang lebih baik dalam mengikuti permintaan rinci, dengan lebih sedikit halusinasi dan penyelesaian tugas yang lebih baik.
- Keamanan & Ketahanan terhadap Injeksi Prompt: Anthropic meningkatkan ketangguhan dibandingkan Sonnet 4.5 dalam menahan serangan injeksi prompt dan kerentanan serupa.
Kinerja Benchmark Claude Sonnet 4.6
| Evaluation | Claude Sonnet 4.6 (approx.) | Notes |
|---|---|---|
| SWE-Bench Verified | ~79.6% | Kinerja pengodean kuat mendekati kelas Opus. |
| OSWorld-Verified (Computer Use) | ~72.5% | Kinerja tugas mendekati tingkat manusia; kuat untuk alur kerja. |
| ARC-AGI-2 | ~60.4% | Mencerminkan kekuatan penalaran yang luas. |
Sebagai model kelas menengah, Sonnet 4.6 memperkecil kesenjangan performa dengan model Opus secara signifikan, menjadikannya cocok untuk banyak tugas yang sebelumnya dicadangkan untuk kelas flagship.
Claude Sonnet 4.6 vs Model Claude Lainnya
| Model | Terbaik untuk | Perbedaan utama |
|---|---|---|
| Claude Sonnet 4.6 | Pengodean seimbang, penalaran, konteks besar | Jendela konteks masif beta, hemat biaya, kuat untuk tugas alur kerja. |
| Claude Sonnet 4.5 | Tugas umum kelas menengah | Benchmark lebih rendah, jendela konteks lebih kecil dibanding 4.6. |
| Claude Opus 4.6 | Penalaran mendalam & pengodean berbasis agen | Penalaran mentah dan kemampuan agen lebih kuat; lebih mahal. |
Dibandingkan Sonnet 4.5, rilis 4.6 meningkatkan pemahaman konteks dan kinerja pada tugas kantor; dibandingkan model Opus, Sonnet berada sedikit di bawah dalam kekuatan penalaran flagship tetapi sering lebih dekat dari yang diharapkan pada pengodean dan tolok ukur tugas umum.
Keterbatasan Claude Sonnet 4.6
- Jendela Konteks Beta: Jendela konteks 1M token saat ini dalam beta — adopsi dan stabilitas dapat bervariasi tergantung penggunaan API dan paket.
- Latensi & Biaya: Menangani konteks yang sangat besar meningkatkan biaya komputasi dan dapat menambah latensi pada panggilan API dibanding konteks yang lebih kecil.
- Granularitas Benchmark: Meski kuat pada tes yang dilaporkan, Sonnet dapat sedikit tertinggal dari Opus pada benchmark penalaran paling kompleks atau multidisiplin.
Kasus Penggunaan Representatif Claude Sonnet 4.6
- Asistensi Basis Kode Besar: Ideal untuk mengasup dan menalar keseluruhan sistem perangkat lunak, refactoring, atau dependensi lintas berkas.
- Sintesis Dokumen & Riset: Berguna untuk analisis dokumen panjang di mana konteks melampaui batas tipikal.
- Otomasi Alur Kerja: Menyelesaikan tugas komputer multi-langkah, seperti spreadsheet dan otomasi formulir.
- Pekerjaan Pengetahuan Umum: Cocok bagi pekerja pengetahuan yang membutuhkan kepatuhan instruksi andal dan penalaran tanpa biaya model flagship.
Cara Mengakses dan Menggunakan API Claude Sonnet 4.6
Step 1: Sign Up for API Key
Masuk ke cometapi.com. Jika Anda belum menjadi pengguna kami, silakan daftar terlebih dahulu. Masuk ke konsol CometAPI. Dapatkan kredensial akses kunci API antarmuka. Klik “Add Token” pada token API di pusat pribadi, dapatkan kunci token: sk-xxxxx dan kirimkan.
Step 2: Send Requests to claude-sonnet-4-6 API
Pilih endpoint “claude-opus-4-6” untuk mengirim permintaan API dan atur body permintaan. Metode permintaan dan body permintaan diperoleh dari dokumen API situs web kami. Situs kami juga menyediakan pengujian Apifox untuk kenyamanan Anda. Ganti <YOUR_API_KEY> dengan kunci CometAPI Anda yang sebenarnya dari akun Anda. Where to call it: Anthropic Messages format dan Chat format.
Masukkan pertanyaan atau permintaan Anda ke dalam kolom content — inilah yang akan direspons oleh model. Proses respons API untuk mendapatkan jawaban yang dihasilkan.
Step 3: Retrieve and Verify Results
Proses respons API untuk mendapatkan jawaban yang dihasilkan. Setelah diproses, API merespons dengan status tugas dan data output.