Claude Opus 5 is now live on CometAPI โ†’

Cara Menggunakan API Claude Opus 5 dengan CometAPI

CometAPI
AnnaJul 29, 2026
Cara Menggunakan API Claude Opus 5 dengan CometAPI

TLDR: The Claude Opus 5 API menggunakan ID model claude-opus-5 dan menyokong kedua-dua permintaan Messages gaya Anthropic serta chat completions serasi OpenAI melalui CometAPI. Untuk aplikasi baharu yang asli Claude, gunakan endpoint Messages. Untuk aplikasi SDK OpenAI sedia ada, gunakan endpoint chat completions. Tambahkan kawalan usaha, cache, penstriman, dan penghalaan supaya model premium hanya mengendalikan kerja yang benar-benar memerlukannya.

Intipati Utama

  • Dikeluarkan 24 Julai 2026; ID API claude-opus-5.
  • Keupayaan hampir setara dengan Fable 5 pada harga Opus ($5 input / $25 output per MTok).
  • Peningkatan kukuh pada Frontier-Bench (lebih dua kali ganda Opus 4.8), CursorBench (dalam ~0.5% daripada Fable 5), ARC-AGI-3 (3ร— berbanding terbaik seterusnya), OSWorld 2.0 (mengatasi Fable 5 pada ~1/3 kos), dan penanda aras kerja pengetahuan.
  • Konteks 1M, output maksimum 128K (sehingga 300K melalui Batch API beta), pemikiran adaptif dihidupkan secara lalai, Mod Pantas (~2.5ร— kelajuan pada 2ร— harga).
  • Ciri API baharu: perubahan alat pertengahan perbualan (beta), fallback lalai, ambang minimum cache prompt lebih rendah (512 token).
  • Terbaik untuk pembangun, perusahaan, dan pasukan yang memerlukan keupayaan tinggi tanpa kos atau kekangan pengekalan data Fable 5.
  • Tersedia pada Claude API, claude.ai (Pro/Max/Team/Enterprise), Amazon Bedrock, Google Cloud, Microsoft Foundry โ€” dan melalui gateway bersatu seperti CometAPI.

Apakah Claude Opus 5?

Claude Opus 5 ialah keluaran terbaru Anthropic dalam tier Opus bagi keluarga Claudeโ€”kelas saiz โ€œpaling berkeupayaanโ€ yang ditujukan untuk beban kerja profesional dan agen yang menuntut. Ia menggantikan Claude Opus 4.8 (dikeluarkan 28 Mei 2026) dan berada di bawah model kelas Mythos yang terhad (Mythos 5 dan rakan awamnya Fable 5) sambil kekal di atas tier Sonnet dan Haiku.

Anthropic menyifatkannya sebagai โ€œmodel yang berhati-hati dan proaktif yang menghampiri kecerdasan frontier Claude Fable 5 pada separuh harga.โ€ Ia direka jelas sebagai model kecerdasan tinggi harian dan bukannya pakar yang dikhaskan hanya untuk projek agen jangka panjang yang paling ekstrem (di mana Fable 5 atau Mythos 5 masih mempunyai kelebihan, terutamanya dalam beberapa penilaian berkaitan keselamatan siber).

Ciri utama termasuk:

  • Tingkah laku agen yang lebih kukuh: ia mengesahkan kerjanya sendiri, mengiterasi dengan teliti, mendiagnosis punca akar bukannya tampalan dangkal, dan tekal melalui tugas berbilang langkah.
  • Kecekapan yang dipertingkat: laporan penggunaan token lebih rendah untuk hasil setara atau lebih baik berbanding model Opus sebelumnya (contohnya, ~26% token lebih sedikit dalam sesetengah beban kerja profesional).
  • Keselamatan dan penjajaran yang dipertingkat: Anthropic memanggilnya โ€œmodel paling selaras setakat ini,โ€ dengan kadar tingkah laku mengelirukan paling rendah dan kurang intervensi keselamatan yang tidak perlu pada tugas pengkodan dan semakan keselamatan yang sah (dikira pengkelasan dijangka campur tangan ~85% lebih jarang daripada pada Fable 5 bagi banyak aliran kerja pembangun).
  • Sokongan input multimodal yang luas (teks + imej/PDF) dengan output teks, konsisten dengan model Claude kebelakangan ini.
  • Sokongan natif untuk alat, penggunaan komputer, dan penaakulan konteks panjang merentas keseluruhan tetingkap 1M token pada harga standard (tiada caj tambahan konteks panjang).

Ringkasnya, Claude Opus 5 menutup banyak jurang praktikal antara generasi Opus sebelumnya dan penawaran frontier sebenar Anthropic sambil mengekalkan struktur kos yang menjadikan Opus popular untuk kegunaan produksi.

Claude Opus 5 Sekilas Pandang

FeatureDetails
Release Date24 Julai 2026
API Model IDclaude-opus-5
PositioningModel premium harian untuk pengkodan agen kompleks & kerja perusahaan
Pricing$5 / MTok input, $25 / MTok output (sama seperti Opus 4.8)
Fast Mode~2.5ร— kelajuan pada $10 / $50 per MTok (Claude API sahaja, pratonton penyelidikan)
Context Window1M token (lalai & maksimum)
Max Output128K token (sehingga 300K melalui Message Batches API beta)
Knowledge CutoffMei 2026 (model Claude paling terkini)
ThinkingPemikiran adaptif dihidupkan secara lalai
Effort Levelslow / medium / high (lalai) / xhigh / max
AvailabilityClaude API, claude.ai, Bedrock, Vertex AI, Microsoft Foundry
Data RetentionMenyokong pengekalan data sifar (tidak seperti kekangan Fable 5)

Apa Yang Baharu dalam API?

Claude Opus 5 memperkenalkan beberapa penambahbaikan API praktikal dan perubahan tingkah laku yang mempengaruhi penggunaan produksi.

Spesifikasi Teras

  • Model ID: claude-opus-5
  • Konteks: 1M token (tiada varian lebih kecil)
  • Output maksimum: 128K token (segerak); sehingga 300K melalui Message Batches API dengan header beta output-300k-2026-03-24
  • Pemikiran adaptif didayakan secara lalai
  • Parameter usaha lebih berkesan (low โ†’ max)

Ciri Baharu

  1. Perubahan alat pertengahan perbualan (beta) Tambah atau keluarkan alat antara giliran sambil mengekalkan cache prompt. Gunakan header beta mid-conversation-tool-changes-2026-07-01. Ini mengurangkan kos dan meningkatkan keselamatan dengan membenarkan alat dinyahdaya apabila tidak lagi diperlukan.
  2. Mod fallback lalai (beta) Parameter baharu fallbacks menyokong mod "default" dalam beta dengan header server-side-fallback-2026-07-01. Jika pengkelasan keselamatan menolak permintaan dan Anthropic mempunyai model fallback yang disyorkan untuk kategori penolakan itu, API boleh cuba semula pada model fallback dan mengembalikan satu respons. Ini untuk penolakan pengkelasan keselamatan, bukan had kadar, beban, atau ralat pelayan.
  3. Minimum cache prompt lebih rendah Panjang prompt yang boleh dicache turun kepada 512 token (daripada 1,024 pada Opus 4.8).
  4. Mod pantas (pratonton penyelidikan) Tersedia hanya pada Claude API. Menyampaikan kira-kira 2.5ร— kelajuan lalai pada dua kali ganda harga ($10/$50 per MTok).

Perubahan Tingkah Laku (Penting untuk Migrasi)

  • Pemikiran Tidak Boleh Dinyahtaktif pada xhigh atau max. Ini ialah perubahan tingkah laku yang memecahkan keserasian. Pada Opus 5, thinking: {"type": "disabled"} diterima hanya pada usaha high atau di bawahnya. Jika anda menyahdayakan pemikiran dengan xhigh atau max, permintaan akan memulangkan ralat 400. Anthropic mengesyorkan kekalkan pemikiran didayakan jika boleh dan mengawal kos dengan usaha lebih rendah sebaliknya.
  • Pemikiran Dihidupkan Secara Lalai: Opus 5 berjalan dengan pemikiran adaptif secara lalai. Ini bermakna model memutuskan berapa banyak penaakulan tersembunyi untuk dibelanjakan setiap giliran, dikawal terutamanya oleh parameter usaha. Memandangkan max_tokens ialah siling keras untuk kedua-dua pemikiran dan output yang kelihatan, aplikasi produksi harus menyemak semula max_tokens apabila berpindah dari Opus 4.8 ke Opus 5.
  • Model menerangkan kemajuan lebih banyak dalam sesi agen, mendelegasikan kepada subagen dengan lebih mudah, mengesahkan kerjanya sendiri dengan lebih teliti, dan menghasilkan respons lalai yang lebih panjang.
  • Keluarkan arahan verifikasi legasi daripada prompt lama โ€” ia boleh menyebabkan pengesahan berlebihan.

Migrasi adalah mudah: tukar ID model daripada claude-opus-4-8 (atau lebih awal) kepada claude-opus-5 dan semak tetapan usaha/pemikiran serta max_tokens (kerana token pemikiran kini dikira ke atas had).

Sumber: Whatโ€™s New in Claude Opus 5, Models Overview.

Langkah demi langkah: Cara Menggunakan API Claude Opus 5 dengan CometAPI

Langkah 1: Daftar dan Dapatkan Kunci API Anda

  1. Lawati https://www.cometapi.com/ dan cipta akaun percuma (tiada kad kredit diperlukan untuk kredit ujian).
  2. Navigasi ke bahagian token API / konsol.
  3. Jana kunci API baharu (format biasanya bermula dengan sk-).
  4. Simpan dengan selamat sebagai pemboleh ubah persekitaran: export COMETAPI_KEY="your-key-here"

Jangan sesekali mengkodkan kunci secara keras dalam kod sisi-klien atau repositori awam.

Langkah 2: Pilih Gaya Endpoint Anda

  • Serasi OpenAI (/v1/chat/completions): Terbaik untuk kod mudah alih dan penghalaan berbilang model.
  • Messages asli Anthropic (/v1/messages): Akses penuh kepada parameter khusus Claude (usaha, kawalan pemikiran, alat, perubahan pertengahan perbualan).

Base URL untuk kedua-duanya: https://api.cometapi.com/v1

Langkah 3: Pasang SDK

Python (disyorkan untuk kebanyakan contoh):

Bash
pip install openai

atau SDK rasmi Anthropic jika menggunakan format Messages asli secara meluas.

JavaScript/TypeScript:

Bash
npm install openai

Langkah 4: Buat Panggilan Pertama Anda

Contoh Messages Asli Anthropic:

Gunakan laluan Messages asli apabila anda mahukan tingkah laku asli Claude dan akses yang lebih baik kepada kawalan khusus Claude.

import os
import anthropic

client = anthropic.Anthropic(
    base_url="https://api.cometapi.com",
    api_key=os.environ["COMETAPI_KEY"],
)

message = client.messages.create(
    model="claude-opus-5",
    max_tokens=2000,
    output_config={"effort": "high"},
    messages=[
        {
            "role": "user",
            "content": "Review this rollout plan and list the top three technical risks."
        }
    ],
)

print(message.content[0].text)

Mengapa ini tetapan lalai yang baik:

  • Ia mengekalkan tingkah laku Claude paling hampir dengan API asli.
  • Ia berfungsi dengan baik untuk aliran kerja yang berat alat.
  • Ia lebih mudah untuk menilai usaha dan bajet output.

Contoh Chat Completions Serasi OpenAI:

Jika aplikasi anda sudah menggunakan SDK OpenAI, laluan ini mengurangkan kerja migrasi.

import os
from openai import OpenAI

client = OpenAI(
    api_key=os.environ["COMETAPI_KEY"],
    base_url="https://api.cometapi.com/v1",
)

response = client.chat.completions.create(
    model="claude-opus-5",
    messages=[
        {
            "role": "system",
            "content": "You are a precise assistant. Be concise and verify claims."
        },
        {
            "role": "user",
            "content": "Summarize this incident and propose the next three actions."
        }
    ],
    max_tokens=1200,
)

print(response.choices[0].message.content)

Gunakan laluan ini apabila kebolehgunaan merentas platform lebih penting daripada kawalan khusus Claude.

Untuk sokongan penuh API Messages asli, rujuk dokumentasi CometAPI dan rujukan API Messages Anthropic. Usaha boleh dikawal melalui output_config atau parameter setara (low โ†’ max). Usaha lebih tinggi meningkatkan kualiti dan penggunaan token pada tugas sukar.

Langkah 6: Respons Penstriman

Penstriman berguna untuk jawapan panjang, pembantu, dan alat pengkodan.

const response = await fetch("https://api.cometapi.com/v1/messages", {
  method: "POST",
  headers: {
    Authorization: `Bearer ${process.env.COMETAPI_KEY}`,
    "Content-Type": "application/json",
  },
  body: JSON.stringify({
    model: "claude-opus-5",
    max_tokens: 2500,
    stream: true,
    messages: [
      {
        role: "user",
        content: "Draft a root-cause analysis from these incident notes.",
      },
    ],
  }),
});

if (!response.ok) {
  throw new Error(await response.text());
}

Untuk produksi, huraikan stream sebagai acara dan bukan cebisan mentah. Tambahkan pembatalan, cubaan semula, dan pengendalian respons separa.

Langkah 7: Penggunaan Alat dan Aliran Kerja Agen

Claude Opus 5 sangat kuat dalam panggilan alat, perancangan berbilang langkah, pengesahan diri, dan tingkah laku agen jangka panjang. Takrifkan alat dalam permintaan, biarkan model memutuskan bila untuk memanggilnya, dan laksanakan gelung eksekusi dalam aplikasi anda. Perubahan alat pertengahan perbualan (beta) membolehkan set alat dinamik tanpa menjejaskan cache prompt.

Langkah 8: Cache Prompt dan Pengoptimuman Kos

  • Cache prompt sistem, definisi alat, dan konteks besar (panjang minimum cache dikurangkan kepada 512 token pada Opus 5).
  • Gunakan usaha lebih rendah untuk tugas yang lebih mudah.
  • Gabungkan dengan pemprosesan kelompok di mana tersedia untuk diskaun tambahan.
  • Pantau penggunaan melalui papan pemuka CometAPI.

Ciri Lanjutan dan Amalan Terbaik

Tahap Usaha

Mulakan pada high lalai. Turun kepada medium atau low apabila kualiti masih boleh diterima. Rizabkan xhigh/max untuk tugas agen atau penyelidikan yang paling sukar. Usaha lebih tinggi meningkatkan perancangan, pengesahan, dan kadar kejayaan pada kerja kompleks tetapi meningkatkan token dan kependaman.

Usaha ialah salah satu tombol utama untuk Claude Opus 5.

EffortGood forTradeoff
lowpengekstrakan, penghalaan, ringkasan mudahkos paling rendah, kedalaman penaakulan terendah
mediumanalisis rutin dan pengkodanseimbang
highkerja kompleks dan penggunaan premium lalaikualiti kuat, kos sederhana
xhighgelung agen sukar dan sintesis mendalamlebih perlahan dan lebih mahal
maxmasalah premium paling sukarpotensi kualiti tertinggi, kos dan kependaman tertinggi

Jika tugas ringkas, jangan paksa usaha premium. Jika tugas sukar, jangan bajetkan token output terlalu rendah.

Panduan Prompting

Opus 5 mendapat manfaat daripada skop tugas yang jelas, kriteria kejayaan yang eksplisit, dan arahan untuk mengesahkan kerjanya sendiri. Ia lebih proaktif dan teliti berbanding model Opus sebelumnya. Lihat panduan prompting Anthropic untuk Opus 5 bagi corak khusus model.

Cadangan Penghalaan Multi-Model (Kelebihan CometAPI)

Hala trafik rutin atau volum tinggi ke Claude Sonnet 5 (atau model lebih murah). Tingkatkan kepada Claude Opus 5 untuk pengkodan kompleks, analisis mendalam, atau tugas berisiko tinggi. Corak ini memaksimumkan kecekapan kos sambil mengekalkan kualiti di tempat yang paling penting.

Integrasi

CometAPI berfungsi dengan Claude Code, Cursor, n8n, Zapier, Dify, Open WebUI, dan banyak agen pengkodan. Kemas kini base URL dan kunci sekali untuk mendapat akses kepada katalog model penuh.

Batasan dan Bila Perlu Memilih Alternatif

  • Tetapan usaha yang lebih tinggi meningkatkan kependaman dan kos โ€” tidak ideal untuk chat ultra-rendah kependaman.
  • Masih ketinggalan di belakang model kelas Mythos/Fable pada penilaian keupayaan dwiguna tertentu mengikut reka bentuk.
  • Verbositi boleh muncul lebih tinggi pada sesetengah tugas; arahan yang jelas membantu.
  • Untuk tugas ringkas volum tinggi, Sonnet 5 atau model lebih ringan lebih ekonomik.

Sentiasa nilai pada beban kerja khusus anda dan bukan bergantung semata-mata pada penanda aras awam.

Kes Penggunaan Dunia Sebenar dan Data Sokongan

  • Pengkodan & penyahpepijatan agen: Keputusan kukuh pada Frontier-Bench dan CursorBench; pengguna awal melaporkan analisis punca akar lebih baik dan konsistensi berbilang fail.
  • Automasi perusahaan: Kadar lulus tinggi pada Zapier AutomationBench.
  • Kerja saintifik & pengetahuan: Prestasi bertambah baik pada biologi, kimia, dan tugas analitik kompleks.
  • Analisis konteks panjang: Konteks penuh 1M membolehkan aliran kerja skala repositori atau berbilang dokumen tanpa pemotongan agresif.
  • Penggunaan komputer & agen: Kompetitif pada penilaian gaya OSWorld pada nisbah kos-prestasi yang menguntungkan.

Petikan pelanggan Anthropic dan penanda aras bebas (Artificial Analysis, ARC Prize) secara konsisten menunjukkan peningkatan bermakna berbanding Opus 4.8 pada titik harga sama, dengan Opus 5 menghampiri hasil setara Fable pada banyak beban kerja praktikal pada separuh kos.

Kesilapan Lazim

Terlalu Sedikit Konteks

Jika anda hanya berkata "betulkan pepijat," model mungkin meneka salah. Berikan tingkah laku yang gagal, fail berkaitan, dan kriteria penerimaan.

Terlalu Banyak Konteks

Mencurahkan keseluruhan repositori ke setiap prompt adalah mahal dan bising. Gunakan pengambilan semula, cache, atau pemilihan fail yang disasarkan.

Bajet Output Terlalu Rendah

Tetapan max_tokens yang rendah boleh memotong pemikiran atau output yang kelihatan. Tingkatkan bajet untuk tugas sukar.

Mengabaikan Usaha

Jika anda tidak melaras usaha mengikut kelas tugas, anda mungkin terlebih bayar untuk kerja mudah dan kekurangan kuasa untuk kerja sukar.

Jadual Perbandingan Kaedah API

EndpointBest forProsCons
Messages aslialiran kerja asli Claudeakses ciri Claude terbaikkerja integrasi sedikit lebih banyak
chat serasi OpenAIaplikasi dan router sedia adamigrasi lebih mudahmungkin menyembunyikan beberapa penalaan khusus Claude
PenstrimanUX interaktifkependaman yang dirasai lebih pantaskerumitan klien lebih tinggi

Matriks Penghalaan yang Disyorkan

WorkloadRecommended primary modelEscalation modelWhy
Chat rutin dan sokonganClaude Sonnet 5 atau Gemini FlashClaude Opus 5Kekalkan kependaman dan kos rendah; tingkatkan kes sukar
Agen pengkodan kompleksClaude Opus 5Claude Fable 5Opus 5 mempunyai prestasi agen pengkodan yang kukuh pada separuh harga Fable
Triage kod asas besarClaude Sonnet 5Claude Opus 5Sonnet mengendalakan imbasan meluas; Opus mengendalakan punca akar dan tampalan
Analisis undang-undang atau kewanganClaude Opus 5Claude Fable 5Lebih baik untuk kerja dokumen panjang berketepatan tinggi
Pemprosesan dokumen kelompok luar talianClaude Opus 5 Batch API atau aliran kerja kelompok CometAPIClaude Sonnet 5 untuk lintasan lebih murahKelompok dan cache boleh mendominasi penjimatan
Pembantu UI masa nyataClaude Sonnet 5, Haiku, atau model pantasMod pantas Opus 5Opus 5 mungkin terlalu perlahan pada usaha maksimum untuk giliran interaktif mudah

Kesimpulan

Claude Opus 5 harus dianggap sebagai lalai premium baharu untuk aliran kerja Claude kompleks, terutamanya jika anda sudah menggunakan Opus 4.8. Ia menawarkan laluan peningkatan paling bersih: harga rasmi sama, penaakulan lebih kuat, tingkah laku agen lebih baik, tetingkap konteks 1M token, dan kawalan lebih kaya untuk usaha, fallback, cache, dan kelajuan.

Langkah seterusnya yang disyorkan:

  1. Cipta akaun CometAPI percuma dan dapatkan kunci.
  2. Uji Claude Opus 5 berbanding model semasa anda dalam playground.
  3. Laksanakan klien serasi OpenAI dengan konfigurasi berasaskan persekitaran.
  4. Tambahkan kawalan usaha dan pemantauan.
  5. Bina penghalaan berbilang model untuk kos/prestasi optimum.

Mulakan pembinaan hari ini di CometAPI. Untuk butiran model dan harga terkini, sentiasa semak silang dokumentasi rasmi Anthropic dan halaman model CometAPI.

Soalan Lazim (FAQ)

Adakah Claude Opus 5 tersedia sekarang?

Ya. Anthropic mengumumkan Claude Opus 5 pada 24 Julai 2026 dan menyenaraikannya sebagai tersedia pada Claude API, AWS, Google Cloud, dan Microsoft Foundry.

Berapakah kos Claude Opus 5?

Harga rasmi Anthropic ialah $5 per juta token input dan $25 per juta token output. Mod pantas berharga $10 per juta token input dan $50 per juta token output.

Adakah Claude Opus 5 lebih baik daripada Claude Opus 4.8?

Untuk kebanyakan kerja kompleks, ya. Ia mengekalkan harga token rasmi yang sama seperti Opus 4.8 tetapi menambah prestasi penanda aras lebih kuat, penskalaan usaha lebih baik, pemikiran dihidupkan secara lalai, tingkah laku agen lebih baik, dan penambahbaikan API.

Patutkah saya gunakan Claude Opus 5 atau Claude Sonnet 5?

Gunakan Opus 5 untuk pengkodan sukar, agen jangka panjang, analisis perusahaan, dan penaakulan bernilai tinggi. Gunakan Sonnet 5 untuk aliran kerja produksi volum lebih tinggi di mana kelajuan dan kos lebih penting.

Bolehkah saya menggunakan Claude Opus 5 dengan CometAPI?

Halaman utama CometAPI menyenaraikan Claude Opus 5 antara model yang disokong dan menyediakan base URL API serasi OpenAI. Sebelum penggunaan produksi, sahkan ketersediaan model langsung, endpoint, dan harga dalam papan pemuka CometAPI.

Bersedia untuk mengurangkan kos pembangunan AI sebanyak 20%?

Mulakan secara percuma dalam beberapa minit. Kredit percubaan percuma disertakan. Tiada kad kredit diperlukan.

Baca Lagi