Spesifikasi Teknis gpt-realtime-1.5
| Item | gpt-realtime-1.5 (pemosisian publik) |
|---|---|
| Model family | GPT Realtime 1.5 (varian yang dioptimalkan untuk suara) |
| Primary modality | Ucapan-ke-ucapan (S2S) |
| Input types | Audio (streaming), teks |
| Output types | Audio (streaming), teks, pemanggilan alat terstruktur |
| API | Realtime API (WebRTC / sesi streaming persisten) |
| Latency profile | Dioptimalkan untuk latensi rendah, interaksi percakapan langsung |
| Session model | Sesi streaming stateful |
| Tool use | Pemanggilan fungsi dan integrasi alat didukung |
| Target use case | Agen suara langsung, asisten, sistem interaktif |
Catatan: Batas token dan ukuran jendela konteks yang tepat tidak disebutkan secara mencolok dalam ringkasan publik; model ini diposisikan untuk responsivitas waktu nyata alih-alih sesi konteks yang sangat panjang.
Apa itu gpt-realtime-1.5?
gpt-realtime-1.5 adalah model berlatensi rendah yang dioptimalkan untuk ucapan-ke-ucapan, dirancang untuk sistem percakapan langsung. Berbeda dengan model permintaan-respons tradisional, model ini beroperasi melalui sesi streaming persisten, memungkinkan pergiliran alami, penanganan interupsi, dan interaksi suara yang dinamis.
Model ini dibuat khusus untuk aplikasi di mana kecepatan alur percakapan lebih penting daripada panjang konteks maksimum.
Fitur Utama
- Interaksi ucapan-ke-ucapan sejati — Menerima input audio langsung dan mengalirkan respons lisan secara real time.
- Arsitektur berlatensi rendah — Dirancang untuk respons percakapan di bawah satu detik pada agen suara.
- Desain yang mengutamakan streaming — Bekerja melalui sesi persisten (WebRTC atau protokol streaming).
- Pergiliran alami dalam percakapan — Mendukung penanganan interupsi dan alur percakapan dinamis.
- Dukungan pemanggilan alat — Dapat memicu pemanggilan fungsi terstruktur selama sesi waktu nyata.
- Fondasi agen suara siap produksi — Dibangun khusus untuk asisten interaktif, kios, dan perangkat tertanam.
Tolok Ukur & Pemosisian Kinerja
OpenAI memosisikan gpt-realtime-1.5 sebagai evolusi dari model realtime sebelumnya dengan peningkatan pada kepatuhan terhadap instruksi, stabilitas selama sesi suara berkepanjangan, dan prosodi yang lebih alami dibandingkan rilis sebelumnya.
Tidak seperti model yang berfokus pada pengkodean (misalnya varian Codex), kinerja lebih diukur berdasarkan latensi percakapan, kealamian suara, dan stabilitas sesi daripada tolok ukur bergaya papan peringkat.
gpt-realtime-1.5 vs Model Terkait
| Fitur | gpt-realtime-1.5 | gpt-audio-1.5 |
|---|---|---|
| Tujuan utama | Interaksi suara langsung | Alur kerja chat yang mendukung audio |
| Latensi | Dioptimalkan untuk penundaan minimal | Keseimbangan kualitas/kecepatan |
| Jenis sesi | Sesi streaming persisten | Alur Chat Completions standar |
| Ukuran konteks | Dioptimalkan untuk responsivitas | Dukungan konteks lebih besar |
| Kasus penggunaan terbaik | Agen suara waktu nyata | Asisten percakapan dengan audio |
Kapan Memilih Masing-masing
- Pilih gpt-realtime-1.5 untuk pusat panggilan, kios, resepsionis AI, atau asisten tertanam langsung.
- Pilih gpt-audio-1.5 untuk aplikasi chat berkemampuan suara yang memerlukan memori percakapan lebih panjang atau alur kerja multimodal.
Kasus Penggunaan Representatif
- Agen pusat panggilan AI
- Asisten perangkat pintar
- Kios interaktif
- Sistem bimbingan langsung
- Alat latihan bahasa waktu nyata
- Aplikasi yang dikendalikan suara
- Cara mengakses API GPT realtime 1.5
Langkah 1: Daftar untuk Kunci API
Masuk ke cometapi.com. Jika Anda belum menjadi pengguna kami, silakan mendaftar terlebih dahulu. Masuk ke Konsol CometAPI. Dapatkan kredensial akses kunci API untuk antarmuka. Klik “Add Token” pada token API di pusat pribadi, dapatkan kunci token: sk-xxxxx dan kirim.

Langkah 2: Kirim Permintaan ke API GPT realtime 1.5
Pilih endpoint “gpt-realtime-1.5” untuk mengirim permintaan API dan atur badan permintaan. Metode permintaan dan badan permintaan diperoleh dari dokumen API di situs kami. Situs kami juga menyediakan pengujian Apifox untuk kenyamanan Anda. Ganti <YOUR_API_KEY> dengan kunci CometAPI Anda dari akun Anda. URL dasar adalah Chat Completions
Masukkan pertanyaan atau permintaan Anda ke bidang content—ini yang akan direspons oleh model. Proses respons API untuk mendapatkan jawaban yang dihasilkan.
Langkah 3: Ambil dan Verifikasi Hasil
Proses respons API untuk mendapatkan jawaban yang dihasilkan. Setelah diproses, API merespons dengan status tugas dan data keluaran.