Apa itu Claude Opus 4.5
Claude Opus 4.5 adalah LLM kelas “Opus” terbaru dari Anthropic dalam keluarga Claude 4.5, dibuat untuk penalaran kompleks, rekayasa perangkat lunak profesional, dan alur kerja agen yang berjalan lama. Anthropic memosisikan Opus 4.5 sebagai opsi kelas atas yang menyeimbangkan kapabilitas maksimum dengan kinerja praktis serta harga yang lebih terjangkau dibanding rilis Opus sebelumnya. Rilis ini melengkapi keluarga Claude 4.5 bersama Sonnet 4.5 dan Haiku 4.5.
Keluarga model / pengenal: Claude Opus 4.5 (nama API yang dicatat oleh Anthropic sebagai claude-opus-4-5-20251101).
Fitur inti Claude Opus 4.5
- Tujuan / kekuatan utama: Rekayasa perangkat lunak profesional, agen tingkat lanjut, pemodelan spreadsheet/keuangan, alur kerja multi-giliran yang diperluas, dan “computer use” (berinteraksi dengan GUI, spreadsheet, browser).
- Effort parameter: Parameter permintaan baru (rendah / sedang / tinggi) yang menukar komputasi/token dengan kedalaman penalaran. Berguna untuk menyetel latensi/biaya vs kelengkapan jawaban.
- Penggunaan komputer & visi yang ditingkatkan: Aksi zoom baru dan inspeksi layar/UI yang ditingkatkan sehingga model dapat membaca elemen UI halus dan visual detail sebelum mengambil tindakan.
- Kontinuitas pemikiran: “Thinking block preservation” — Opus 4.5 mempertahankan blok penalaran sebelumnya untuk menjaga kontinuitas di sesi panjang.
Rincian teknis Claude Opus 4.5
Pengenal model: claude-opus-4-5-20251101 (umumnya dirujuk untuk pemanggilan API).
Jendela konteks & batas token: input 200,000 token / output 64,000 token
Modalitas: mendukung input teks, kode, gambar, dan dokumen; output berupa teks (terstruktur dan tidak terstruktur). Integrasi mitra menambahkan fitur (prediksi batch, pemanggilan fungsi, cache prompt).
Kinerja benchmark & hasil empiris
Anthropic dan sejumlah pihak independen telah memublikasikan/melaporkan hasil benchmark dan perilaku uji untuk Opus 4.5. Berikut klaim dan angka paling menonjol:
- SWE-bench (tolok ukur rekayasa perangkat lunak) — SWE-bench ≈ 80.9% dalam evaluasi yang dilaporkan Anthropic. Opus 4.5 memimpin di 7/8 bahasa pemrograman pada uji SWE-bench Multilingual milik Anthropic.
- Ketahanan agen di dunia nyata — operasi agen berkelanjutan yang lebih baik dan penanganan alur kerja multi-langkah serta orkestrasi tool yang lebih baik.
- Aider Polyglot: peningkatan +10.6% dibanding Sonnet 4.5 pada tugas pengodean kompleks. Anthropic
- Terminal Bench: peningkatan +15% dibanding Sonnet 4.5 dalam alur kerja terminal/kode multi-langkah.
- Vending-Bench (perencanaan horizon panjang): peningkatan 29% dibanding Sonnet 4.5 pada tugas agen dengan horizon panjang.
- Pengodean otonom: Anthropic melaporkan kinerja konsisten selama sesi pengodean otonom 30 menit (dibanding model sebelumnya yang menurun lebih awal).
Penggunaan khas dan prioritas
- Rekayasa perangkat lunak kompleks & skrip panjang — pembuatan kode, debugging, refactor multi-berkas, dan agen pengodean otonom.
- Agen otonom dan orkestrasi tool — merangkai pemanggilan API, penjelajahan, otomatisasi spreadsheet, dan alur kerja multi-langkah panjang di mana state harus dipertahankan di banyak giliran.
- Sintesis dokumen besar & riset — memo hukum, laporan panjang, penulisan multi-bab, dan peringkasan atas korpus sangat besar berkat konteks yang diperluas dan pengompakan.
- Otomasi enterprise — tooling internal, ekstraksi data dari file/spreadsheet, dan agen yang mengoperasikan proses bisnis secara kontinu.
Claude Opus 4.5 vs Gemini 3.0 Pro vs GPT 5.1
| Dimensi | Claude Opus 4.5 (Anthropic) | Gemini 3.0 Pro (Google) | GPT 5.1 (OpenAI) |
|---|---|---|---|
| Nama model | claude-opus-4-5-20251101-thinking;claude-opus-4-5-20251101 | gemini-3-pro-preview-thinking;gemini-3-pro-preview | gpt-5.1-chat-latest;gpt-5.1 |
| Kekuatan utama | Keandalan agen horizon panjang, efisiensi token, pengodean & orkestrasi multi-agen, fokus pada keamanan. | Penalaran frontier, performa multimodal, skor papan peringkat teratas (LMArena, GPQA, MathArena); integrasi Google luas. | Penalaran adaptif, ergonomi pengembang, prompt caching diperpanjang (24 jam), interaktivitas cepat dan tooling kode. |
| Harga representatif (input/output per 1M token) | $5 / $25 (dinyatakan Anthropic untuk Opus 4.5). — harga pratinjau enterprise. | Tingkat pratinjau dilaporkan ≈ $2 / $12 atau tingkat lebih tinggi (bervariasi per wilayah / paket). | $1.25 / $10 (harga API GPT-5.1 yang dipublikasikan OpenAI). |
| Konteks / jendela & memori | Fokus pada pengompakan konteks, fitur memori, dan sesi panjang yang efisien; disetel untuk run multi-agen. | Jendela konteks sangat besar dilaporkan (1M token dalam pratinjau) dan input multimodal (teks, gambar, audio, video). | Prompt caching yang diperpanjang dan penalaran adaptif yang efisien; caching untuk mengurangi biaya & latensi lanjutan. |
| Paling cocok untuk | Agen enterprise, alur kerja kode otonom panjang, run panjang hemat biaya, lingkungan teregulasi dengan kontrol keamanan. | Riset/benchmark, penalaran multimodal, fitur ekosistem Google terintegrasi (Search/Ads/Apps). | Produk pengembang interaktif, asisten pengodean berlatensi rendah, alur iteratif yang diuntungkan oleh prompt caching. |
Cara mengakses API Claude opus 4.5
Langkah 1: Daftar untuk Kunci API
Masuk ke cometapi.com. Jika Anda belum menjadi pengguna kami, silakan daftar terlebih dahulu. Masuk ke CometAPI console. Dapatkan kredensial akses kunci API untuk antarmuka. Klik “Add Token” pada token API di pusat pribadi, dapatkan kunci token: sk-xxxxx dan kirimkan.
Langkah 2: Kirim Permintaan ke API Claude opus 4.5
Pilih endpoint “claude-opus-4-5-20251101-thinking;claude-opus-4-5-20251101” untuk mengirim permintaan API dan atur body permintaan. Metode permintaan dan body permintaan diperoleh dari dokumen API situs web kami. Situs kami juga menyediakan uji Apifox untuk kenyamanan Anda. Ganti <YOUR_API_KEY> dengan CometAPI key Anda yang sebenarnya dari akun Anda. base url is Anthropic Messages format and Chat format.
Masukkan pertanyaan atau permintaan Anda ke kolom content—ini yang akan direspons oleh model. Proses respons API untuk mendapatkan jawaban yang dihasilkan.
Langkah 3: Ambil dan Verifikasi Hasil
Proses respons API untuk mendapatkan jawaban yang dihasilkan. Setelah diproses, API merespons dengan status tugas dan data output.
Lihat juga Gemini 3 Pro Preview API