Claude Opus 5.2 telah senyap-senyap memasuki ujian kelabu dalam Claude Code. Sejak 14 September 2026, pengguna melaporkan bahawa prestasinya jauh lebih baik daripada Opus 5 di web, dengan respons lebih pantas, output lebih kemas, dan ketekunan yang lebih kuat pada tugasan pengaturcaraan jangka panjang.
Bukti awam masih awal: banyak perbincangan berpunca daripada ujian awal yang sama dan set kecil perbandingan secara sisi-ke-sisi. Tingkah laku ujian kelabu dapat dilihat, tetapi Anthropic belum menerbitkan titik akhir stabil dan dokumentasi teknikal yang diperlukan pembangun untuk penggunaan produksi.
Status:
Ujian kelabu dalam Claude Code
Ketersediaan API rasmi:
Belum diumumkan
ID model API awam:
Belum diterbitkan
Harga dan spesifikasi awam:
Belum diterbitkan
Semakan terakhir:
15 September 2026
Apakah Claude Opus 5.2?
Claude Opus 5.2 ialah titik semak Opus seterusnya oleh Anthropic yang kini muncul melalui penghalaan selektif dalam Claude Code. Sesetengah permintaan yang dibuat kepada "Opus 5" dalam Claude Code sedang sampai ke laluan 5.2 baharu manakala Claude di web dan sesetengah persekitaran pihak ketiga terus menyajikan model Opus 5 sedia ada. Itu menerangkan mengapa UI boleh memaparkan nama model yang sama sementara hasil kelihatan sangat berbeza.
Oleh kerana ujian kelabu menukar trafik secara selektif, tidak setiap akaun atau sesi akan menerima model yang sama. Perbezaan juga boleh dipergiat oleh prompt sistem, konfigurasi alat, dan tetapan usaha penaakulan. Justeru, isyarat paling berguna ialah gabungan maklumat laluan dan perubahan tingkah laku yang boleh diulang:
- penjanaan lebih pantas di bawah laluan Claude Code;
- pelaksanaan yang lebih kemas dan lebih lengkap pada percubaan pertama;
- kerja autonomi lebih lama tanpa gesaan "teruskan" berulang; dan
- gelung semakan dan pengujian berulang pada tugasan pengaturcaraan.
Slug 5.2 dan isyarat penghalaan
Sesetengah penguji melaporkan bahawa label yang kelihatan dalam Claude Code kekal "Opus 5" sementara paparan status atau slug permintaan menunjuk kepada 5.2.
Ini akan menjadi bukti yang jauh lebih kukuh jika respons mentah, rekod permintaan, atau output /status yang boleh diulang menunjukkan pengecam tersebut dan boleh disahkan secara bebas. Pada masa ini, siaran awam kebanyakannya mengulangi dakwaan itu; artifak asasnya belum diautentikasi.
Ciri Utama Dilihat dalam Ujian Kelabu Claude Opus 5.2
Penguji awal secara konsisten menumpukan pada tingkah laku berbanding spesifikasi formal.
Respons lebih pantas
Model yang dirutekan ini ketara lebih pantas daripada pengalaman Opus 5 yang didokumentasikan dalam ujian pengguna awal. Latensi akhir masih perlu diukur selepas akses API awam tiba kerana tetapan usaha, beban sistem, dan infrastruktur penghalaan juga mempengaruhi kelajuan.
Output lebih kemas dan lebih lengkap
Perbandingan komuniti mendakwa bahawa laluan baharu menghasilkan SVG yang lebih digilap dan pelaksanaan yang lebih lengkap daripada satu prompt. Dalam ujian pengaturcaraan anekdot, dilaporkan memerlukan kurang ulang-aling untuk mencapai hasil yang boleh digunakan.
Kurang tingkah laku "malas"
Beberapa penguji berkata model ini kurang cenderung mengembalikan hanya rangka, meminta pengguna untuk meneruskan, atau berhenti sebelum menyiapkan tugasan kompleks. Sebaliknya, ia dilaporkan bekerja melalui urutan lebih panjang dan melakukan beberapa lintasan tambahan atas outputnya sendiri.
Gelung pengaturcaraan autonomi lebih panjang
Satu pemerhatian yang banyak diulang ialah model memulakan "gauntlet loop": ia terus menguji, menyemak, dan menambah baik kod tanpa memerlukan arahan berulang. Jika boleh diulang, ini akan sangat relevan untuk agen pengaturcaraan berskala repositori dan tugasan perisian berjulat panjang.
Pengetahuan lebih baharu
Pengguna mencadangkan "ujian Tibo": dengan carian web dilumpuhkan, tanya model sama ada ia mengetahui "Tibo, the reset guy." Dokumentasi Opus 5 sedia ada memberikan tarikh potongan pengetahuan yang boleh dipercayai pada Mei 2026, jadi pengetahuan tentang rujukan dalam talian yang lebih baru boleh mencadangkan titik semak yang lebih baharu.
Ujian ini tidak boleh mengenal pasti versi model dengan sendirinya. Respons yang betul juga mungkin datang daripada pengambilan tersembunyi, memori perbualan, prompt sistem, atau sumber konteks lain. Ia ialah siasatan pengetahuan—bukan bukti nama "Opus 5.2."
Prestasi Penanda Aras Claude Opus 5.2
Tiada hasil penanda aras Claude Opus 5.2 yang disahkan, kerana Anthropic belum menerbitkan kad sistem atau jadual penilaian.
Skor 62.8% yang dilaporkan pada CoBench v2 adalah milik model dalaman Anthropic berasingan yang dikenali sebagai "Model 2" yang dilaporkan mengatasi Mythos 5 sebanyak 12.5 mata dan digunakan secara meluas untuk pengaturcaraan dalaman. Sistem RSI yang lebih berkeupayaan juga telah dibincangkan.
Claude Opus 5.2 vs Claude Opus 5 vs Claude Fable 5.1
Tiga model ini menyasar keperluan yang bersebelahan tetapi berbeza. Opus 5 ialah lalai kos lebih rendah Anthropic untuk pengaturcaraan kompleks dan kerja perusahaan. Fable 5.1 ialah pilihan mewah yang mapan untuk penaakulan paling sukar dan tugasan agen berjulat panjang. Opus 5.2 ialah laluan ujian kelabu baharu yang kelihatan membawa Opus lebih hampir—atau berpotensi melampaui—sempadan itu sambil menambah baik kelajuan dan ketekunan yang dialami pengguna dalam Claude Code.
| Kategori | Claude Opus 5.2 | Claude Opus 5 | Claude Fable 5.1 |
|---|---|---|---|
| Status semasa | Ujian kelabu dalam Claude Code | Tersedia secara awam | Tersedia secara awam |
| ID Cometapi | claude-opus-5-2 | claude-opus-5 | claude-fable-5-1 |
| Kesesuaian terbaik | Pengaturcaraan agen generasi seterusnya, iterasi autonomi, output mantap sekali buat | Pengaturcaraan kompleks umum dan beban kerja perusahaan pada kos seimbang | Penaakulan paling sukar, penyelidikan, dan kerja agen berjulat panjang |
| Tingkah laku yang diperhati | Lebih pantas, lebih kemas, lebih sedia untuk mengiterasi dan menyiapkan tugasan panjang | Mampu dan ekonomik, tetapi pengguna melapor lebih perlahan atau kurang tekun pada sesetengah tugasan panjang | Keputusan Claude terkuat yang diterbitkan pada penanda aras penyelidikan dan agen yang menuntut; boleh jadi bertele-tele |
| Tingkap konteks | Belum diterbitkan | 1M tokens | 1M tokens |
| Keluaran maksimum | Belum diterbitkan | 128K tokens | 128K tokens |
| Tarikh potongan pengetahuan yang boleh dipercayai | Pengetahuan lebih baharu diperhati dalam ujian; tarikh tidak diterbitkan | Mei 2026 | Jun 2026 |
| Harga input/output rasmi | Belum diterbitkan | $5 / $25 per MTok | $10 / $50 per MTok |
| Independent AA Intelligence Index | Belum diuji | 51 | 53 |
| Kelajuan keluaran yang diperhatikan secara bebas | Belum diuji | 51.7 tokens/s | 65.1 tokens/s |
Angka bebas di atas datang daripada Artificial Analysis pada varian penaakulan adaptif yang diuji. Ia menunjukkan bahawa Fable 5.1 mendahului Opus 5 sebanyak dua mata pada Intelligence Index dan menjana output kira-kira 26% lebih pantas dalam konfigurasi yang diukur, tetapi harga senarainya adalah dua kali ganda. Keputusan ini belum termasuk Opus 5.2 kerana laluan ujian kelabu tidak mendedahkan titik akhir awam yang stabil untuk penanda arasan bebas.
Opus 5.2 mengubah perbandingan praktikal. Sesi Claude Code awal mencadangkan model yang memberi respons lebih cepat daripada Opus 5, menyampaikan reka bentuk lebih lengkap daripada prompt yang sama, dan terus menguji serta menambah baik kod tanpa didorong. Sebaik sahaja API awamnya tersedia, soalan paling penting ialah sama ada penambahbaikan itu juga mengatasi Fable 5.1 pada penanda aras agen terkawal—dan pada harga berapa.
Kegunaan Terbaik Claude Opus 5.2
Berdasarkan tingkah laku yang sudah kelihatan dalam ujian kelabu, Claude Opus 5.2 amat menjanjikan untuk:
- pengaturcaraan berskala repositori dan pemodenan pangkalan kod;
- agen berjalan lama yang merancang, melaksana, menguji, dan menyemak merentas banyak langkah;
- nyahpepijat kompleks dan gelung QA autonomi;
- penjanaan antara muka, SVG, dan artifak berstruktur berkualiti tinggi;
- penyelidikan dan analisis yang memerlukan tumpuan berterusan merentasi konteks besar; dan
- aliran kerja perusahaan di mana kualiti penyempurnaan lebih penting daripada kos minimum.
Untuk penyebaran produksi hari ini, pasukan harus terus menggunakan titik akhir awam yang stabil dan memastikan lapisan model boleh diganti sehingga akses API Opus 5.2 dan terma perkhidmatan diterbitkan.
Bagaimana CometAPI Menyediakan Akses kepada API Claude Opus 5.2?
Apabila Claude Opus 5.2 menjadi tersedia secara rasmi melalui CometAPI, pembangun akan dapat menggunakan aliran kerja API bersatu yang sama seperti untuk model Anthropic lain yang disokong:
- Cipta akaun CometAPI dan jana kunci API.
- Tambah kredit ke akaun atau pilih pilihan pengebilan yang sesuai.
- Semak katalog model CometAPI untuk ID model dan harga yang tepat diterbitkan.
- Hantar permintaan melalui Anthropic Messages yang disokong atau titik akhir sembang serasi.
- Sahkan kualiti keluaran, latensi, dan kos dengan beban kerja ujian kecil sebelum penggulungan ke produksi.
Sementara itu, CometAPI sudah menyokong model Fable 5.1 terkini daripada Claude. Pembangun boleh mengakses model Claude menggunakan format permintaan API Claude asli, memudahkan pengujian model semasa dan migrasi ke Opus 5.2 selepas dikeluarkan.
Mengapa Memilih CometAPI untuk Claude Opus 5.2?
Sebaik sahaja model ini disokong secara rasmi, CometAPI boleh mengurangkan kerja operasi yang diperlukan untuk menambahkannya ke dalam tindanan AI sedia ada. Akaun dan lapisan API bersatu membolehkan pasukan menilai berbilang penyedia model tanpa mengekalkan integrasi berasingan dan hubungan pengebilan untuk setiap model.
Kelebihan berpotensi termasuk:
- satu kunci API dan aliran kerja pengebilan untuk katalog model yang luas;
- ujian sisi-ke-sisi yang lebih pantas berbanding model pengaturcaraan dan penaakulan alternatif;
- corak integrasi yang konsisten apabila versi model berubah;
- akses berasaskan penggunaan tanpa mereka bentuk semula aplikasi di sekitar satu penyedia; dan
- dokumentasi berpusat dan penemuan model.
Maklumat sebenar tentang harga, ketersediaan, throughput, dan diskaun Opus 5.2 hanya harus dinyatakan selepas model itu muncul dalam katalog langsung CometAPI.