GPT-Realtime-2.1 updates GPT-Realtime-2 with improved alphanumeric recognition, silence and noise handling, and interruption behavior. It supports speech-to-speech interactions with configurable reasoning effort, instruction following, and tool use for complex voice-agent workflows.
上記の簡易見積もりを1回分の目安にし、CometAPIと公式価格の詳細な比較もご確認ください。
GPT-Realtime-2.1の競争力のある価格設定をご確認ください。さまざまな予算や利用ニーズに対応できるよう設計されています。柔軟なプランにより、使用した分だけお支払いいただけるため、要件の拡大に合わせて簡単にスケールアップできます。GPT-Realtime-2.1がコストを管理しながら、お客様のプロジェクトをどのように強化できるかをご覧ください。
| Model | Comet Price (USD / M Tokens) | Official Price (USD / M Tokens) | Discount |
|---|---|---|---|
| gpt-realtime-2.1 | 入力:$3.2/M 出力:$19.2/M | 入力:$4/M 出力:$24/M | -20% |
| gpt-realtime-2.1-mini | 入力:$0.48/M 出力:$2.88/M | 入力:$0.6/M 出力:$3.6/M | -20% |
動作するエンドポイントとコード例をコピーし、全パラメーターが必要な場合は完全なAPIリファレンスを開いてください。
一度認証すれば、モデルエンドポイントを呼び出し、プロバイダー間で同じ請求・モニタリングフローを維持できます。
GPT-Realtime-2.1の包括的なサンプルコードとAPIリソースにアクセスして、統合プロセスを効率化しましょう。詳細なドキュメントでは段階的なガイダンスを提供し、プロジェクトでGPT-Realtime-2.1の潜在能力を最大限に活用できるよう支援します。
アーキテクチャの選定や本番負荷の見積もり前に、重要なモデル情報を確認できます。
audioの機能に合った本番ワークフローにGPT-Realtime-2.1を活用し、長期的な統合前に他の選択肢とも比較してください。
音声・音楽・オーディオ生成
音声体験とメディア制作
大規模な自動音声ワークフロー
品質・レイテンシ・機能・料金のトレードオフに応じて、CometAPIで利用できる他のモデルと比較できます。
Chat Completions における音声入出力に最適な音声モデル。
GPT-Realtime-2 は、当社で最も高性能なリアルタイム音声モデルです。音声対音声のやり取り、推論の深さの調整、より強力な指示追従、複雑な音声エージェントのワークフローにおけるより信頼性の高いツール利用をサポートします。
音声入力・音声出力に最適な音声モデル。
OpenAI テキスト読み上げ
[音声合成] 新登場:テキストから放送用音声をオンラインで生成、プレビュー機能付き ● 同時にaudio_idを生成でき、任意のKeling APIで利用可能。
Kling 動画から音声に
本番投入前に、リアルタイムのハートビートデータ、エンドポイントの可用性、実測レスポンスタイムを確認できます。
本番統合を固定する前に、利用可能なモデル識別子を確認してください。