Spesifikasi teknikal — Claude Sonnet 4.6
| Perkara | Claude Sonnet 4.6 (ringkasan umum) |
|---|---|
| Penyedia | Anthropic |
| Keluarga model | Sonnet (keluarga Claude v4.x) — varian Sonnet 4.6 |
| ID model (kanonik) | claude-sonnet-4-6 |
| Jenis input | Teks (utama). Sokongan terhad/sekunder untuk I/O alat/JSON berstruktur. Tidak diposisikan sebagai model penjanaan imej utama. |
| Jenis output | Teks (bahasa semula jadi, JSON berstruktur, kod, dan payload panggilan alat) |
| Tetingkap konteks | ~200,000 token (lebih kurang) — direka untuk koheren berbilang dokumen dan sesi panjang |
| Panggilan fungsi / penggunaan alat | Ya — pemanggilan alat berstruktur, output terhad-JSON, penyelarasan gaya ejen disokong |
| Multimodaliti | Terhad — Sonnet memfokus pada teks dan integrasi alat berstruktur; tidak dioptimumkan untuk penjanaan imej. |
| Sorotan nota keluaran | Kestabilan/peningkatan dalam penaakulan konteks panjang, varian Sonnet latensi lebih rendah ditala untuk pertukaran kelajuan–ketepatan, pematuhan arahan yang dipertingkat. |
Apakah Claude Sonnet 4.6
Claude Sonnet 4.6 ialah evolusi terkini bagi barisan model Sonnet oleh Anthropic, direka untuk memberikan prestasi hampir setara Opus pada titik harga yang lebih mampu. Ia menaik taraf Sonnet daripada iterasi 4.5 terdahulu, membawa pematuhan arahan yang lebih kukuh, sokongan konteks yang jauh lebih luas, kemahiran pengkodan dan penggunaan komputer yang dipertingkat, serta keupayaan penaakulan berbilang langkah yang lebih meluas — sambil mengekalkan pariti harga dengan Sonnet 4.5.
Tidak seperti model Opus, yang merupakan model unggulan dan dioptimumkan untuk beban kerja ejen yang berat, Sonnet 4.6 menyasarkan pembangun dan kerja pengetahuan umum di mana kebolehan luas dan kecekapan kos diutamakan.
Ciri Utama Claude Sonnet 4.6
- Tetingkap Konteks 1M Token (Beta): Sonnet 4.6 menyokong sehingga satu juta token konteks dalam beta — kira-kira mencukupi untuk memuatkan keseluruhan pangkalan kod, longgokan kontrak undang-undang, atau berbilang kertas akademik dalam satu permintaan.
- Prestasi Pengkodan Dipertingkat: Berbanding Sonnet 4.5, Sonnet 4.6 menunjukkan peningkatan ketara dalam tugasan pembangun dunia sebenar dan penanda aras seperti SWE-Bench Verified (~79.6% skor dilaporkan), menjadikannya sesuai untuk tugasan pengkodan yang kompleks.
- Penggunaan Komputer Dipertingkat: Tahap kecekapan baharu dalam tugasan yang melibatkan pengendalian perisian (hamparan, aliran kerja borang web berbilang langkah, dsb.) menghampiri prestasi setara manusia pada ujian OSWorld-Verified.
- Pemikiran Adaptif: Model ini menggabungkan strategi penaakulan yang dipertingkat dan boleh memperuntukkan pengiraan dalaman secara dinamik untuk menangani masalah kompleks langkah demi langkah.
- Pematuhan Arahan Lebih Kukuh: Pengguna melaporkan lebih konsisten dan tepat dalam mengikuti permintaan terperinci, dengan halusinasi yang lebih sedikit dan penyempurnaan tugasan yang lebih baik.
- Keselamatan & Rintangan Suntikan Prompt: Anthropic telah meningkatkan kekukuhan berbanding Sonnet 4.5 dalam menahan serangan suntikan prompt dan kelemahan serupa.
Prestasi Penanda Aras Claude Sonnet 4.6
| Penilaian | Claude Sonnet 4.6 (anggaran) | Catatan |
|---|---|---|
| SWE-Bench Verified | ~79.6% | Prestasi pengkodan yang kukuh, hampir kelas Opus. |
| OSWorld-Verified (Penggunaan Komputer) | ~72.5% | Prestasi tugasan hampir setara manusia; berkuasa untuk aliran kerja. |
| ARC-AGI-2 | ~60.4% | Mencerminkan kekuatan penaakulan yang luas. |
Sebagai model pertengahan, Sonnet 4.6 memperkecil jurang prestasi dengan model Opus secara ketara, menjadikannya sesuai untuk banyak tugasan yang sebelum ini dikhaskan untuk kelas unggulan.
Claude Sonnet 4.6 vs Model Claude Lain
| Model | Terbaik Untuk | Perbezaan Utama |
|---|---|---|
| Claude Sonnet 4.6 | Pengkodan seimbang, penaakulan, konteks besar | Tetingkap konteks besar (beta), cekap kos, kuat untuk tugasan aliran kerja. |
| Claude Sonnet 4.5 | Tugasan umum pertengahan | Penanda aras lebih rendah, tetingkap konteks lebih kecil sebelum 4.6. |
| Claude Opus 4.6 | Penaakulan mendalam & pengkodan beragen | Keupayaan penaakulan mentah dan ejen yang lebih kuat; lebih mahal. |
Berbanding Sonnet 4.5, keluaran 4.6 meningkatkan pemahaman konteks dan prestasi pada tugasan gaya pejabat; berbanding model Opus, Sonnet berada sedikit di bawah dari segi kuasa penaakulan kelas unggulan tetapi sering lebih hampir daripada yang dijangka dalam penanda aras pengkodan dan tugasan umum.
Had Claude Sonnet 4.6
- Tetingkap Konteks Beta: Konteks 1M token kini dalam beta — penerimaan dan kestabilan mungkin berbeza bergantung pada penggunaan API dan pelan.
- Kelewatan & Kos: Mengendalikan konteks yang sangat besar meningkatkan kos pengiraan dan boleh memperkenalkan latensi lebih tinggi pada panggilan API berbanding konteks yang lebih kecil.
- Kebutiran Penanda Aras: Walaupun kuat dalam ujian yang dilaporkan, Sonnet mungkin sedikit ketinggalan di belakang Opus pada penanda aras penaakulan paling kompleks atau pelbagai disiplin.
Kes Penggunaan Representatif Claude Sonnet 4.6
- Bantuan Pangkalan Kod Besar: Sesuai untuk memuatkan dan membuat penaakulan tentang keseluruhan sistem perisian, penstrukturan semula, atau kebergantungan merentas fail.
- Sintesis Dokumen & Penyelidikan: Berguna untuk analisis dokumen panjang di mana konteks melampaui had tipikal.
- Automasi Aliran Kerja: Menyelesaikan tugasan komputer berbilang langkah, seperti hamparan dan automasi borang.
- Kerja Pengetahuan Umum: Sesuai untuk pekerja pengetahuan yang memerlukan pematuhan arahan yang boleh dipercayai dan penaakulan tanpa kos model unggulan.
Cara mengakses dan menggunakan API Claude Sonnet 4.6
Langkah 1: Daftar untuk Kunci API
Log masuk ke cometapi.com. Jika anda belum menjadi pengguna kami, sila daftar terlebih dahulu. Log masuk ke CometAPI console. Dapatkan kunci API kelayakan akses untuk antara muka. Klik “Add Token” pada token API di pusat peribadi, dapatkan kunci token: sk-xxxxx dan hantar.
Langkah 2: Hantar Permintaan kepada API claude-sonnet-4-6
Pilih titik akhir “claude-opus-4-6” untuk menghantar permintaan API dan tetapkan badan permintaan. Kaedah permintaan dan badan permintaan diperoleh daripada dokumen API laman web kami. Laman web kami juga menyediakan ujian Apifox untuk kemudahan anda. Gantikan <YOUR_API_KEY> dengan kunci CometAPI sebenar anda daripada akaun anda. Di mana untuk memanggilnya: format Anthropic Messages dan format Chat.
Masukkan soalan atau permintaan anda ke dalam medan content—ini yang akan dijawab oleh model. Proses respons API untuk mendapatkan jawapan yang dihasilkan.
Langkah 3: Dapatkan dan Sahkan Keputusan
Proses respons API untuk mendapatkan jawapan yang dihasilkan. Selepas pemprosesan, API akan memberi respons dengan status tugasan dan data output.