Spesifikasi teknikal — Claude Sonnet 4.6
| Perkara | Claude Sonnet 4.6 (ringkasan awam) |
|---|---|
| Provider | Anthropic |
| Keluarga model | Sonnet (keluarga Claude v4.x) — varian Sonnet 4.6 |
| Model id (canonical) | claude-sonnet-4-6 |
| Jenis input | Teks (utama). Sokongan terhad/sekunder untuk I/O alat/JSON berstruktur. Tidak diposisikan sebagai model penjanaan imej utama. |
| Jenis output | Teks (bahasa semula jadi, JSON berstruktur, kod, dan payload panggilan alat) |
| Tetingkap konteks | ~200,000 token (anggaran) — direka untuk koheren berbilang dokumen dan sesi panjang |
| Panggilan fungsi / penggunaan alat | Ya — panggilan alat berstruktur, output berkekangan JSON, orkestrasi gaya ejen disokong |
| Multimodaliti | Terhad — Sonnet memfokuskan pada teks dan integrasi alat berstruktur; tidak dioptimumkan untuk penjanaan imej. |
| Sorotan nota keluaran | Kestabilan/penambahbaikan dalam penaakulan konteks panjang, varian Sonnet latensi lebih rendah ditala untuk pertukaran kelajuan–ketepatan, pematuhan arahan yang dipertingkat. |
Apakah Claude Sonnet 4.6
Claude Sonnet 4.6 ialah evolusi terkini rangkaian model Sonnet oleh Anthropic, direka untuk menyampaikan prestasi hampir setara Opus pada titik harga yang lebih mudah dicapai. Ia menaik taraf Sonnet daripada iterasi 4.5 terdahulu, membawa pematuhan arahan yang lebih kukuh, sokongan konteks yang jauh lebih besar, penambahbaikan dalam pengkodan dan penggunaan komputer, serta kebolehan penaakulan berbilang langkah yang lebih luas — sambil mengekalkan pariti harga dengan Sonnet 4.5.
Tidak seperti model Opus, yang merupakan model utama (flagship) dan dioptimumkan untuk beban kerja berorientasikan agen yang berat, Sonnet 4.6 menyasarkan pembangun dan kerja pengetahuan umum di mana keupayaan luas dan keberkesanan kos adalah penting.
Ciri Utama Claude Sonnet 4.6
- Tetingkap Konteks 1M Token (Beta): Sonnet 4.6 menyokong sehingga satu juta token konteks dalam beta — kira-kira mencukupi untuk memuatkan keseluruhan pangkalan kod, timbunan kontrak undang-undang, atau berbilang kertas akademik dalam satu permintaan.
- Prestasi Pengkodan Dipertingkat: Berbanding Sonnet 4.5, Sonnet 4.6 menunjukkan peningkatan ketara dalam tugasan pembangun dunia nyata dan penanda aras seperti SWE-Bench Verified (~79.6% skor dilaporkan), menjadikannya sesuai untuk tugasan pengkodan kompleks.
- Penggunaan Komputer Dipertingkat: Tahap kecekapan baharu dalam tugas yang melibatkan pengoperasian perisian (hamparan, aliran kerja borang web berbilang langkah, dll.) menghampiri prestasi setaraf manusia pada ujian OSWorld-Verified.
- Pemikiran Adaptif: Model ini menggabungkan strategi penaakulan yang dipertingkat dan boleh memperuntukkan pengiraan dalaman secara dinamik untuk menangani masalah kompleks langkah demi langkah.
- Pematuhan Arahan Lebih Kukuh: Pengguna melaporkan lebih konsisten dan tepat dalam mengikuti permintaan terperinci, dengan halusinasi yang lebih sedikit dan penyempurnaan tugasan yang lebih baik.
- Keselamatan & Rintangan Suntikan Prompt: Anthropic telah meningkatkan keteguhan berbanding Sonnet 4.5 dalam menahan serangan suntikan prompt dan kelemahan serupa.
Prestasi Penanda Aras Claude Sonnet 4.6
| Penilaian | Claude Sonnet 4.6 (anggaran) | Catatan |
|---|---|---|
| SWE-Bench Verified | ~79.6% | Prestasi pengkodan kukuh hampir kelas Opus. |
| OSWorld-Verified (Penggunaan Komputer) | ~72.5% | Prestasi tugas hampir setaraf manusia; berkuasa untuk aliran kerja. |
| ARC-AGI-2 | ~60.4% | Mencerminkan kekuatan penaakulan umum yang luas. |
Sebagai model pertengahan, Sonnet 4.6 memperkecil jurang prestasi dengan model Opus dengan ketara, menjadikannya sesuai untuk banyak tugas yang sebelum ini dikhususkan untuk kelas flagship.
Claude Sonnet 4.6 vs Model Claude Lain
| Model | Terbaik Untuk | Perbezaan Utama |
|---|---|---|
| Claude Sonnet 4.6 | Pengkodan seimbang, penaakulan, konteks besar | Tetingkap konteks besar dalam beta, kos efisien, kuat untuk tugas aliran kerja. |
| Claude Sonnet 4.5 | Tugas umum peringkat pertengahan | Penanda aras lebih rendah, tetingkap konteks lebih kecil sebelum 4.6. |
| Claude Opus 4.6 | Penaakulan mendalam & pengkodan beragensi | Keupayaan penaakulan mentah dan agen lebih kuat; lebih mahal. |
Berbanding Sonnet 4.5, keluaran 4.6 meningkatkan pemahaman konteks dan prestasi dalam tugasan gaya pejabat; berbanding model Opus, Sonnet berada sedikit di bawah dari segi kuasa penaakulan flagship tetapi selalunya lebih hampir daripada yang dijangka dalam penanda aras pengkodan dan tugas umum.
Batasan Claude Sonnet 4.6
- Tetingkap Konteks Beta: Konteks 1M token kini dalam beta — penggunaan dan kestabilan mungkin berbeza bergantung pada penggunaan API dan pelan.
- Kelewatan & Kos: Mengendalikan konteks yang sangat besar meningkatkan kos pengiraan dan mungkin memperkenalkan latensi lebih tinggi pada panggilan API berbanding konteks lebih kecil.
- Keterperincian Penanda Aras: Walaupun kukuh dalam ujian yang dilaporkan, Sonnet mungkin sedikit ketinggalan berbanding Opus pada penanda aras penaakulan paling kompleks atau merentas disiplin.
Kes Penggunaan Representatif Claude Sonnet 4.6
- Bantuan Pangkalan Kod Besar: Sesuai untuk memuatkan dan menaakul keseluruhan sistem perisian, penstrukturan semula, atau kebergantungan rentas fail.
- Sintesis Dokumen & Penyelidikan: Berguna untuk analisis dokumen panjang di mana konteks melampaui had tipikal.
- Automasi Aliran Kerja: Menyelesaikan tugas komputer berbilang langkah, seperti hamparan dan automasi borang.
- Kerja Pengetahuan Am: Sesuai untuk pekerja pengetahuan yang memerlukan pematuhan arahan boleh dipercayai dan penaakulan tanpa kos model flagship.
Cara mengakses dan menggunakan API Claude Sonnet 4.6
Langkah 1: Daftar untuk Kunci API
Log masuk ke cometapi.com. Jika anda belum menjadi pengguna kami, sila daftar terlebih dahulu. Log masuk ke CometAPI console. Dapatkan kelayakan akses kunci API bagi antara muka. Klik “Add Token” pada token API di pusat peribadi, dapatkan kunci token: sk-xxxxx dan hantar.
Langkah 2: Hantar Permintaan ke API claude-sonnet-4-6
Pilih titik akhir “claude-opus-4-6” untuk menghantar permintaan API dan tetapkan badan permintaan. Kaedah permintaan dan badan permintaan diperoleh daripada dokumen API laman web kami. Laman web kami juga menyediakan ujian Apifox untuk kemudahan anda. Gantikan <YOUR_API_KEY> dengan kunci CometAPI sebenar anda daripada akaun anda. Di mana untuk memanggilnya: format Anthropic Messages dan format Chat.
Masukkan soalan atau permintaan anda ke dalam medan content — inilah yang akan dijawab oleh model. Proses respons API untuk mendapatkan jawapan yang dijana.
Langkah 3: Dapatkan dan Sahkan Keputusan
Proses respons API untuk mendapatkan jawapan yang dijana. Selepas pemprosesan, API membalas dengan status tugasan dan data output.