GPT-Realtime-2.1 updates GPT-Realtime-2 with improved alphanumeric recognition, silence and noise handling, and interruption behavior. It supports speech-to-speech interactions with configurable reasoning effort, instruction following, and tool use for complex voice-agent workflows.
先參考上方的單次執行預估,再查看完整的 CometAPI 與官方價格比較。
探索 GPT-Realtime-2.1 的競爭性定價,專為滿足各種預算和使用需求而設計。我們靈活的方案確保您只需為實際使用量付費,讓您能夠隨著需求增長輕鬆擴展。了解 GPT-Realtime-2.1 如何在保持成本可控的同時提升您的專案效果。
| Model | Comet Price (USD / M Tokens) | Official Price (USD / M Tokens) | Discount |
|---|---|---|---|
| gpt-realtime-2.1 | 輸入:$3.2/M 輸出:$19.2/M | 輸入:$4/M 輸出:$24/M | -20% |
| gpt-realtime-2.1-mini | 輸入:$0.48/M 輸出:$2.88/M | 輸入:$0.6/M 輸出:$3.6/M | -20% |
複製可用的端點與程式碼範例,需要完整參數時再開啟完整 API 參考文件。
只需驗證一次,即可呼叫模型端點,並在各供應商間維持一致的計費與監控流程。
存取完整的範例程式碼和 API 資源,以簡化您的 GPT-Realtime-2.1 整合流程。我們詳盡的文件提供逐步指引,協助您在專案中充分發揮 GPT-Realtime-2.1 的潛力。
在選擇架構或評估正式環境負載前,先掌握模型的關鍵資訊。
將 GPT-Realtime-2.1 用於符合其 audio 能力的正式工作流程,並在長期整合前比較其他選項。
語音、音樂與音訊生成
語音體驗與媒體製作
大規模自動化音訊工作流程
比較 CometAPI 提供的其他模型,在品質、延遲、功能與價格間取得平衡。
搭配 Chat Completions 進行音訊輸入、音訊輸出的最佳語音模型。
GPT-Realtime-2 是我們最強大的即時語音模型。它支援語音對語音的互動,提供可調整的推理強度、更強的指令遵循能力,以及在複雜語音代理工作流程中更可靠的工具使用。
用於音訊輸入、音訊輸出的最佳語音模型。
OpenAI 文字轉語音
[語音合成] 全新上線:線上文字轉廣播級音訊,支援預覽功能 ● 可同時生成 audio_id,適用於任何 Keling API。
Kling 影片轉音訊
在正式上線前,查看即時心跳資料、端點可用性與實測回應時間。
在鎖定正式環境整合版本前,先查看可用的模型識別碼。