GPT-6.1 Sol are now live on CometAPI →
ai-model/CometAPIリサーチ

GPT-5.6-Cyberとは? 仕様、ベンチマーク、価格、機能

GPT-5.6-Cyberの仕様、ベンチマーク、Daybreakへのアクセス、料金、ツール、脆弱性研究、制限事項、CometAPIの利用方法を探る。

CometAPI
Deon GoodwinAIモデルとAPIの調査チーム
更新日 Sep 30, 2026 7 分読み
GPT-5.6-Cyberとは? 仕様、ベンチマーク、価格、機能
このパターンを使う

最初のAPI呼び出しを行う。

from openai import OpenAI

client = OpenAI(
    api_key="YOUR_COMETAPI_KEY",
    base_url="https://api.cometapi.com/v1",
)

response = client.chat.completions.create(
    model="gpt-5-mini",
    messages=[{"role": "user", "content": "Build this workflow."}],
)

print(response.choices[0].message.content)

SEO メタデータ

TL;DR

  • 現行の公式 API 仕様には、40 万トークンのコンテキストウィンドウ、最大 12.8 万トークンの出力、2026 年 2 月 16 日の知識カットオフ、画像入力、推論トークン、ストリーミング、関数呼び出し、構造化出力、広範な Responses API のツール面が列挙されている。

What Is GPT-5.6-Cyber?

OpenAI は GPT-5.6-Cyber を説明しており、承認済みのディフェンダー向けに目的特化で訓練された最先端のサイバーセキュリティモデル群のエイリアスと位置づけている。想定される用途は、高度な認可済み脆弱性リサーチ、エクスプロイト検証、およびセキュリティテスト。消費者向けの「ハッキングモード」としては位置づけられておらず、アクセスは Daybreak プログラムと認可コントロールで管理される。

GPT-5.6-Cyber Key Specifications

仕様GPT-5.6-Cyber
プロバイダーOpenAI
モデル IDgpt-5.6-cyber
モデルクラス目的特化のサイバーセキュリティ推論モデル
ベースモデルGPT-5.6 Sol
主なアクセス経路Daybreak Red / 個別承認とプロビジョニング
コンテキストウィンドウ400,000 tokens
最大出力128,000 tokens
知識カットオフ2026年2月16日
テキスト入力および出力
画像入力のみ
音声 / 動画非対応
推論トークン対応
ストリーミング対応
関数呼び出し対応
構造化出力対応
ファインチューニング非対応
Responses API対応
Chat Completions対応

Why Did OpenAI Build GPT-5.6-Cyber?

OpenAI の Daybreak 発表は、導入上の課題を率直に説明している。システムレベルのサイバーセキュリティ保護は悪用を防げる一方で、正当な防御活動も妨げうる。Daybreak Blue は広範な防御用途でその摩擦を低減する。ただし、これらのシステムレベルのガードレールを外しても、Sol はモデルレベルで高度に両義的な要求を拒否し得る。

Daybreak Blue vs Daybreak Red

次元Daybreak BlueDaybreak Red
中核モデルGPT-5.6 Sol などのフロンティア汎用モデルGPT-5.6-Cyber などの目的特化サイバーセキュリティモデル
最適な出発点大多数のディフェンダーに推奨高度なスペシャリストワークフローを必要とするチーム向け
典型的な業務脆弱性発見、安全なコードレビュー、マルウェア分析、インシデント対応、パッチ検証高度な脆弱性研究、エクスプロイト検証、ペネトレーションテスト、レッドチーミング
OpenAI 評価での高度完了率Blue 下の Sol は 2.0%GPT-5.6-Cyber は 95.0%
アクセス承認済みディフェンダーより高リスクのユースケースを持つ承認済みディフェンダー
運用コントロール本人確認、アカウントセキュリティ、モニタリング、承認用途の制限、法的誓約同等の中核コントロールに加え、分離、スコープ管理、レビューの必要性がより強い

GPT-5.6-Cyber Benchmark Performance

Advanced Cybersecurity Completion Rate

モデル / アクセス構成完了率
GPT-5.6-Cyber — Daybreak Red95.0%
GPT-5.5-Cyber — Daybreak Red57.3%
GPT-5.6 Sol — Daybreak Blue2.0%
GPT-5.6 Sol — safeguards enabled1.5%

ExploitGym

GPT-5.6 システムカードは、制御されたエクスプロイト開発において基盤となる Sol ファミリーが既に強力であることを示す有用な背景資料である。Cyber の発表では、スペシャリストモデルが ExploitGym において Sol のベースラインを上回ったとされている。

Zero-Day Discovery Evaluation

OpenAI の内部ゼロデイ評価では、各モデルにオープンソースリポジトリの現行リリースを与え、最大インパクトの PoC エクスプロイトと技術的な解説を書かせる。採点は重大度、影響、較正、レポート品質を対象とする。Daybreak Red 下の GPT-5.6-Cyber は、この評価で Daybreak Blue 下の GPT-5.6 Sol を上回った。

Vulnerability Discovery and Report Writing

OpenAI の「脆弱性発見とレポート作成」評価では、GPT-5.6 の両バリアントは GPT-5.5-Cyber より向上したが、GPT-5.6-Cyber は GPT-5.6 Sol を下回った。差の一因として、Cyber がより短く詳細度の低い脆弱性レポートを生成する傾向が挙げられている。

ExploitBench

ExploitBench は、防御保護が有効のまま V8 脆弱性を完全なエクスプロイトに仕立て上げられるかを評価する。標準の 300 ターン設定では GPT-5.6 Sol が最も高性能で、トークン効率も高い。600 ターンでは、Sol と Cyber の差が縮まる。

評価GPT-5.6-Cyber の結果結果の意味
Advanced Cybersecurity Completion Rate95.0%;GPT-5.5-Cyber から +37.7 ポイント特定の高度な要求セットにおいて拒否摩擦が大幅に低い
ExploitGymGPT-5.6 Sol と GPT-5.5-Cyber を上回る制御下のエクスプロイト開発における特化性能が強い
内部ゼロデイ発見Sol(Daybreak Blue)を上回るOpenAI 内部評価での新規脆弱性研究における特化優位
脆弱性発見 + レポート作成GPT-5.6 Sol を下回るが、従来の Cyber より上一部のエンドツーエンドのレポート業務では Sol が依然として強い
ExploitBench — 300 ターンSol を下回る標準の難易度設定では Sol の方が強く、トークン効率も高い
ExploitBench — 600 ターン差が縮小エージェントの予算が増えると、Cyber が差の一部を埋められる

What Does the 95% Score Actually Mean?

95.0% は完了率であり、正確性、エクスプロイト成功、脆弱性検出のスコアではない。これは、エクスプロイトチェーン、認証回避、権限昇格などに関わる高度なサイバーセキュリティ要求に対して、GPT-5.6-Cyber がどれだけの頻度で応答するかを測定する数値だ。ExploitGym、ゼロデイ評価、レポート品質、ExploitBench と併せて読む必要がある。

GPT-5.6-Cyber vs GPT-5.6 Sol vs GPT-5.5-Cyber

次元GPT-5.6-CyberGPT-5.6 SolGPT-5.5-Cyber
ポジショニングサイバーセキュリティのスペシャリスト汎用のフラッグシップ先行世代のスペシャリスト
基盤GPT-5.6 Sol を基盤GPT-5.6 ファミリーのフラッグシップGPT-5.5 世代
主なアクセスDaybreak Red / 承認済みアクセス標準 API と Daybreak BlueDaybreak Red / 信頼済みアクセス
コンテキストウィンドウ400K1.05M本表では未比較
最大出力128K128K本表では未比較
高度サイバー完了率95.0%Blue で 2.0% / 標準で 1.5%57.3%
ExploitGymOpenAI の Cyber 発表内で 3 者の中で最良Cyber を下回るCyber を下回る
内部ゼロデイ評価Sol Blue を上回るCyber を下回る旧ベースライン
脆弱性レポート品質より短く詳細が少ない傾向引用されたレポート評価で 2 つの 5.6 バリアント中で最良両 5.6 バリアントを下回る
ExploitBench — 300 ターンSol を下回る最良 / トークン効率が高い低いベースライン
汎用推論特化最適特化

GPT-5.6-Cyber を選ぶのは、承認済み環境で高度なサイバー特化や拒否摩擦がボトルネックとなる場合。GPT-5.6 Solは、より広範なプロフェッショナル推論、より大きなコンテキスト、強力な長文レポート、あるいはセキュリティと非セキュリティの双方を単一モデルでカバーする必要がある場合に選ぶ。

意思決定の指針:GPT-5.6-Cyber は GPT-5.6 Sol の普遍的な上位互換ではない。エクスプロイト特化、ゼロデイ研究、拒否摩擦の低さが承認済み業務で不可欠な場合に Cyber を選ぶ。幅広いプロフェッショナル推論、より大きなコンテキスト、強力なレポート作成、セキュリティと一般的なエンジニアリングの混在業務には Sol を選ぶ。成熟したスタックでは、深いエクスプロイト検証を Cyber にルーティングし、コードレビュー、長コンテキスト調査、レポート作成、一般エンジニアリングは Sol に留めることができる。

Real-World Vulnerabilities Found with GPT-5.6-Cyber

OpenAI は GPT-5.6-Cyber を用いて Chrome が使用する JavaScript エンジンである V8 を調査したと報告している。研究では、メモリ破壊と V8 ヒープサンドボックス脱出を連鎖させ得る未知の 2 件の脆弱性が発見され、検証のうえ協調開示を通じて Google に報告された。

Google は CVE-2026-15903 を修正した。OpenAI はこれを高深刻度の V8 最適化コンパイラの欠陥と説明しており、整数変換時の安全チェックがスキップされることで予期せぬ大きな値が生じ、境界チェックの省略、意図されたオブジェクト外のメモリアクセスを可能にするという。ヒープサンドボックスを逃れるには 2 件目の脆弱性が必要だった。

GPT-5.6-Cyberとは? 仕様、ベンチマーク、価格、機能

CVE-2026-15903 のエクスプロイトチェーン概要。出典: OpenAI。

OpenAI はさらに、モデルを用いて以下を特定したと報告している:

  • ある人気モバイル OS における少なくとも 5 件の脆弱性(信頼されないアプリからローカル権限昇格に至るチェーンを含む)。
  • ある人気データベースにおける 3 件のクリティカル脆弱性(リモートからコード実行に至る経路を含む)。
  • ある人気 OS カーネルにおいて、権限昇格へ至り得る 400 件超の脆弱性。

これら追加件数は進行中の開示と修正作業のもとでの OpenAI 報告に留まるため、対応するアドバイザリがない限り公開 CVE 一覧として提示すべきではない。

GPT-5.6-Cyber Features and Tool Support

機能サポート状況
テキスト入出力Supported
画像入力Supported
推論トークンSupported
ストリーミングSupported
関数呼び出しSupported
構造化出力Supported
Web 検索Supported
ファイル検索Supported
画像生成ツールSupported
Code InterpreterSupported
Hosted shellSupported
Apply PatchSupported
SkillsSupported
Computer useSupported
MCPSupported
Tool searchSupported
ファインチューニングNot supported

重要な理由:現代の脆弱性研究はエージェントループである。モデルは、リポジトリの調査、ソースの推論、隔離環境でのコード実行、仮説の検証、パッチの編集、再テストを必要とする場合がある。したがってツールサポートは、静的ベンチマークスコアと同等に重要である。

GPT-5.6-Cyber Pricing

OpenAI の現行の公式価格は、入力トークン 100 万あたり $12.50、キャッシュ済み入力トークン 100 万あたり $1.25、出力トークン 100 万あたり $75。272K を超える入力トークンを含むリクエストは、リクエスト全体で入力 2×、出力 1.5× と価格設定され、キャッシュ書き込みは未キャッシュ入力レートの 1.25× として課金される。

価格指標OpenAI 公式
入力$12.50 / 1M tokens
キャッシュ入力$1.25 / 1M tokens
出力$75.00 / 1M tokens
長コンテキスト規則>272K 入力:リクエスト全体で入力 2× および出力 1.5×

CometAPI では現在、同モデルページ上の OpenAI リスト価格に対して 20% 割引となる、入力 $10/M・出力 $60/M を掲示している。ロールアウト中は可用性やルーティング状況が変動しうるため、本番前にはライブのモデルページを確認すべきである。

価格CometAPIOpenAI 公式差分
入力$10 / 1M$12.50 / 1M20% 低い
出力$60 / 1M$75 / 1M20% 低い

How to Access GPT-5.6-Cyber

実務上、チームは以下を計画すべきである:

  • 本人確認とアカウントセキュリティ要件。
  • テスト対象システムとアクションの明確に定義された承認スコープ。
  • モニタリング、承認用途の制限、法的誓約。
  • 高リスクのセキュリティワークフローに対するサンドボックスまたは隔離環境。
  • 昇格権限を要するツール呼び出しに対する人的レビューまたは自動レビュー。
  • 2026年9月1日以降、個々の Daybreak アカウント向けのハードウェアセキュリティキー。

How to Use GPT-5.6-Cyber via CometAPI

CometAPI の GPT-5.6 Cyber ページには、モデル ID と OpenAI 互換エンドポイントが記載されている。アクセスは引き続き、アカウントの承認済みサイバー権限に依存する。以下の例では、狭いスコープで承認されたアセスメントプロンプトを用いる。

Python

from openai import OpenAI
import os

client = OpenAI(
    api_key=os.environ["COMETAPI_KEY"],
    base_url="https://api.cometapi.com/v1",
)

response = client.responses.create(
    model="gpt-5.6-cyber",
    input=(
        "Within the explicitly authorized scope, review this security "
        "assessment and prioritize remediation. Do not test any system."
    ),
)
print(response.output_text)

Bash (cURL)

curl https://api.cometapi.com/v1/responses \
  -H "Content-Type: application/json" \
  -H "Authorization: Bearer $COMETAPI_KEY" \
  -d '{
    "model": "gpt-5.6-cyber",
    "input": "Within the authorized scope, review this assessment and prioritize remediation."
  }'

Best Use Cases for GPT-5.6-Cyber

Advanced Vulnerability Research

最も適合するのは、未知のコードベースを継続的に分析し、承認済みスコープのもとで重大な脆弱性を特定・再現・検証するケースである。内部ゼロデイ評価と OpenAI の V8 事例はいずれもこの用途を指し示している。

Exploit Validation in Controlled Environments

ExploitGym は、既知の脆弱性を制御環境下で実際のコード実行へと転化することを前提に設計されている。防御チームが、発見事項が実際に悪用可能かどうかを優先度付け前に判断する必要がある場合、Cyber は関連性が高い。

Penetration Testing and Red-Team Research

認可済みペネトレーションテストやレッドチーミングは、汎用モデルにとって意図の曖昧さを生む。Daybreak Red は、検証済みアクセスと運用コントロールを通じてその曖昧さに対処し、スペシャリストモデルが技術的に必要な作業のより多くを完了できる一方で、その挙動を普遍的に提供しない。

Patch Validation

エクスプロイト指向のスペシャリストモデルは、パッチが脆弱な経路を閉じているか、代替経路が残っていないか、回帰テストがセキュリティ境界をカバーしているかを検証するのに役立つ。これは脆弱性発見に対する防御的補完である。

Agentic Security Automation

GPT-5.6-Cyber Limitations

  • 見出しの 95% は完了メトリクスであり、正確性スコアではない。
  • Cyber のコンテキストウィンドウ(400K)は、Sol の 1.05M よりもかなり小さい。
  • モデルは意図的に承認ゲートであり、認可された業務向けに設計されているため、モデル ID だけで一般提供を想定すべきではない。
  • 公開済み CVE を超える実世界の脆弱性件数は、独立したアドバイザリまたはベンダー記録が利用可能になるまで OpenAI 報告の発見として述べるべきである。

Safety and Preparedness

運用上の示唆は明確だ。モデル能力が強化されるほど、システムコントロールも強化しなければならない。OpenAI 自身のガイダンスは、サンドボックス、モニタリング、明示的なスコープ、昇格アクションのレビューを強調している。本番環境のセキュリティチームでは、それらのコントロールをプロンプトに委ねるのではなく、インフラとポリシーに実装すべきである。

Conclusion

GPT-5.6-Cyber は、承認済みディフェンダーによる高度な認可済み脆弱性研究、エクスプロイト検証、セキュリティテストのための目的特化モデルである。Advanced Cybersecurity Completion Rate 95.0% は、拒否摩擦が大幅に低いことを示す。一方で、広範な評価セットは現実的なトレードオフを示しており、Cyber は特定のスペシャリストテストでリードする一方、GPT-5.6 Sol は一部のレポート作成や標準 ExploitBench ワークロードで優位を保つ。

大多数のチームは Daybreak Blue と GPT-5.6 Sol から始めるべきだ。認可済みワークフローにおいて、より深いエクスプロイト特化が必要な場合に限り Daybreak Red と GPT-5.6-Cyber を申請し、そのアクセスを明確なスコープ、分離、モニタリング、昇格アクションのレビューと組み合わせるべきである。

FAQs

What is GPT-5.6-Cyber?

GPT-5.6-Cyber は、Daybreak Red を通じて、承認済みディフェンダーが高度な認可済み脆弱性研究、エクスプロイト検証、セキュリティテストを行うための、OpenAI の目的特化サイバーセキュリティモデルのエイリアスである。

When was GPT-5.6-Cyber released?

OpenAI は 2026年8月10日に、GPT-5.6-Cyber と Daybreak プログラムの拡張を発表した。

What is the GPT-5.6-Cyber context window?

現行の公式モデルドキュメントでは、コンテキストウィンドウ 400,000 トークン、最大出力 128,000 トークンと記載されている。

How much does GPT-5.6-Cyber cost?

OpenAI は現在、入力 $12.50/M、キャッシュ入力 $1.25/M、出力 $75/M を掲示している。CometAPI は現時点で、モデルページにおいて入力 $10/M、出力 $60/M を掲示している。

Is GPT-5.6-Cyber better than GPT-5.6 Sol?

普遍的に優れているわけではない。Cyber は ExploitGym や内部ゼロデイテストなど特定のスペシャリスト評価でリードする一方、Sol は引用された脆弱性レポート作成評価や標準 300 ターンの ExploitBench 設定で上回る。

What does the 95% benchmark mean?

これは、モデルが高度なサイバーセキュリティ要求を完了するかどうかを測定する指標である。95% の正確性、エクスプロイト成功率、脆弱性検出精度を意味するものではない。

これは Advanced Cybersecurity Completion Rate であり、モデルが高度な要求を完了するかを測定する。95% のエクスプロイト成功率や脆弱性検出精度ではない。

Can anyone use GPT-5.6-Cyber?

いいえ。OpenAI は、このモデルが Daybreak を通じた個別承認とプロビジョニングを必要とする、と明言している。

What is the GPT-5.6-Cyber model ID?

公式のモデル ID は gpt-5.6-cyber である。アクセスには Daybreak の個別承認とプロビジョニングが必要である。

Does GPT-5.6-Cyber support tools?

はい。現行の Responses API ドキュメントには、Web 検索、ファイル検索、画像生成、Code Interpreter、Hosted shell、Apply Patch、Skills、computer use、MCP、tool search が記載されている。

  • GPT-5.6-Cyber は GPT-5.6 Sol の普遍的な代替ではなくスペシャリストである。高度な認可済み脆弱性研究、エクスプロイト検証、ペネトレーションテストなどのセキュリティワークフローに最適化されている。
  • 見出しの Advanced Cybersecurity Completion Rate は 95.0% で、GPT-5.6 Sol(Daybreak Blue で 2.0%、標準で 1.5%)や GPT-5.5-Cyber の 57.3% と比較して大幅に高い。
  • OpenAI は、GPT-5.6-Cyber が ExploitGym で GPT-5.6 Sol および GPT-5.5-Cyber を上回り、内部ゼロデイ評価でも Sol を上回る一方で、標準 300 ターンの ExploitBench と脆弱性発見+レポート作成では Sol が優れていると報告している。
  • 公式価格は入力トークン 100 万あたり $12.50、キャッシュ入力 $1.25、出力 $75。CometAPI は現在、自社の GPT-5.6 Cyber ページで入力 $10/M、出力 $60/M を掲示している。
  • GPT-5.6 Sol は、引用された脆弱性レポート評価や標準 300 ターンの ExploitBench 構成など、重要な評価で依然として優位である。
  • OpenAI は、GPT-5.6-Cyber は Sol よりも推論バジェットを多用する傾向があり、トークン使用量が増える場合があると指摘している。
学習を続ける

この記事を次の判断につなげる。

すべてのトピックを見る
公開日 Sep 30, 2026
最終更新 Sep 30, 2026
0 回視聴
明確性、出典の帰属、最新のAPI用語について確認済みです。

もっと読む