SEO メタデータ
TL;DR
- 現行の公式 API 仕様には、40 万トークンのコンテキストウィンドウ、最大 12.8 万トークンの出力、2026 年 2 月 16 日の知識カットオフ、画像入力、推論トークン、ストリーミング、関数呼び出し、構造化出力、広範な Responses API のツール面が列挙されている。
What Is GPT-5.6-Cyber?
OpenAI は GPT-5.6-Cyber を説明しており、承認済みのディフェンダー向けに目的特化で訓練された最先端のサイバーセキュリティモデル群のエイリアスと位置づけている。想定される用途は、高度な認可済み脆弱性リサーチ、エクスプロイト検証、およびセキュリティテスト。消費者向けの「ハッキングモード」としては位置づけられておらず、アクセスは Daybreak プログラムと認可コントロールで管理される。
GPT-5.6-Cyber Key Specifications
| 仕様 | GPT-5.6-Cyber |
|---|---|
| プロバイダー | OpenAI |
| モデル ID | gpt-5.6-cyber |
| モデルクラス | 目的特化のサイバーセキュリティ推論モデル |
| ベースモデル | GPT-5.6 Sol |
| 主なアクセス経路 | Daybreak Red / 個別承認とプロビジョニング |
| コンテキストウィンドウ | 400,000 tokens |
| 最大出力 | 128,000 tokens |
| 知識カットオフ | 2026年2月16日 |
| テキスト | 入力および出力 |
| 画像 | 入力のみ |
| 音声 / 動画 | 非対応 |
| 推論トークン | 対応 |
| ストリーミング | 対応 |
| 関数呼び出し | 対応 |
| 構造化出力 | 対応 |
| ファインチューニング | 非対応 |
| Responses API | 対応 |
| Chat Completions | 対応 |
Why Did OpenAI Build GPT-5.6-Cyber?
OpenAI の Daybreak 発表は、導入上の課題を率直に説明している。システムレベルのサイバーセキュリティ保護は悪用を防げる一方で、正当な防御活動も妨げうる。Daybreak Blue は広範な防御用途でその摩擦を低減する。ただし、これらのシステムレベルのガードレールを外しても、Sol はモデルレベルで高度に両義的な要求を拒否し得る。
Daybreak Blue vs Daybreak Red
| 次元 | Daybreak Blue | Daybreak Red |
|---|---|---|
| 中核モデル | GPT-5.6 Sol などのフロンティア汎用モデル | GPT-5.6-Cyber などの目的特化サイバーセキュリティモデル |
| 最適な出発点 | 大多数のディフェンダーに推奨 | 高度なスペシャリストワークフローを必要とするチーム向け |
| 典型的な業務 | 脆弱性発見、安全なコードレビュー、マルウェア分析、インシデント対応、パッチ検証 | 高度な脆弱性研究、エクスプロイト検証、ペネトレーションテスト、レッドチーミング |
| OpenAI 評価での高度完了率 | Blue 下の Sol は 2.0% | GPT-5.6-Cyber は 95.0% |
| アクセス | 承認済みディフェンダー | より高リスクのユースケースを持つ承認済みディフェンダー |
| 運用コントロール | 本人確認、アカウントセキュリティ、モニタリング、承認用途の制限、法的誓約 | 同等の中核コントロールに加え、分離、スコープ管理、レビューの必要性がより強い |
GPT-5.6-Cyber Benchmark Performance
Advanced Cybersecurity Completion Rate
| モデル / アクセス構成 | 完了率 |
|---|---|
| GPT-5.6-Cyber — Daybreak Red | 95.0% |
| GPT-5.5-Cyber — Daybreak Red | 57.3% |
| GPT-5.6 Sol — Daybreak Blue | 2.0% |
| GPT-5.6 Sol — safeguards enabled | 1.5% |
ExploitGym
GPT-5.6 システムカードは、制御されたエクスプロイト開発において基盤となる Sol ファミリーが既に強力であることを示す有用な背景資料である。Cyber の発表では、スペシャリストモデルが ExploitGym において Sol のベースラインを上回ったとされている。
Zero-Day Discovery Evaluation
OpenAI の内部ゼロデイ評価では、各モデルにオープンソースリポジトリの現行リリースを与え、最大インパクトの PoC エクスプロイトと技術的な解説を書かせる。採点は重大度、影響、較正、レポート品質を対象とする。Daybreak Red 下の GPT-5.6-Cyber は、この評価で Daybreak Blue 下の GPT-5.6 Sol を上回った。
Vulnerability Discovery and Report Writing
OpenAI の「脆弱性発見とレポート作成」評価では、GPT-5.6 の両バリアントは GPT-5.5-Cyber より向上したが、GPT-5.6-Cyber は GPT-5.6 Sol を下回った。差の一因として、Cyber がより短く詳細度の低い脆弱性レポートを生成する傾向が挙げられている。
ExploitBench
ExploitBench は、防御保護が有効のまま V8 脆弱性を完全なエクスプロイトに仕立て上げられるかを評価する。標準の 300 ターン設定では GPT-5.6 Sol が最も高性能で、トークン効率も高い。600 ターンでは、Sol と Cyber の差が縮まる。
| 評価 | GPT-5.6-Cyber の結果 | 結果の意味 |
|---|---|---|
| Advanced Cybersecurity Completion Rate | 95.0%;GPT-5.5-Cyber から +37.7 ポイント | 特定の高度な要求セットにおいて拒否摩擦が大幅に低い |
| ExploitGym | GPT-5.6 Sol と GPT-5.5-Cyber を上回る | 制御下のエクスプロイト開発における特化性能が強い |
| 内部ゼロデイ発見 | Sol(Daybreak Blue)を上回る | OpenAI 内部評価での新規脆弱性研究における特化優位 |
| 脆弱性発見 + レポート作成 | GPT-5.6 Sol を下回るが、従来の Cyber より上 | 一部のエンドツーエンドのレポート業務では Sol が依然として強い |
| ExploitBench — 300 ターン | Sol を下回る | 標準の難易度設定では Sol の方が強く、トークン効率も高い |
| ExploitBench — 600 ターン | 差が縮小 | エージェントの予算が増えると、Cyber が差の一部を埋められる |
What Does the 95% Score Actually Mean?
95.0% は完了率であり、正確性、エクスプロイト成功、脆弱性検出のスコアではない。これは、エクスプロイトチェーン、認証回避、権限昇格などに関わる高度なサイバーセキュリティ要求に対して、GPT-5.6-Cyber がどれだけの頻度で応答するかを測定する数値だ。ExploitGym、ゼロデイ評価、レポート品質、ExploitBench と併せて読む必要がある。
GPT-5.6-Cyber vs GPT-5.6 Sol vs GPT-5.5-Cyber
| 次元 | GPT-5.6-Cyber | GPT-5.6 Sol | GPT-5.5-Cyber |
|---|---|---|---|
| ポジショニング | サイバーセキュリティのスペシャリスト | 汎用のフラッグシップ | 先行世代のスペシャリスト |
| 基盤 | GPT-5.6 Sol を基盤 | GPT-5.6 ファミリーのフラッグシップ | GPT-5.5 世代 |
| 主なアクセス | Daybreak Red / 承認済みアクセス | 標準 API と Daybreak Blue | Daybreak Red / 信頼済みアクセス |
| コンテキストウィンドウ | 400K | 1.05M | 本表では未比較 |
| 最大出力 | 128K | 128K | 本表では未比較 |
| 高度サイバー完了率 | 95.0% | Blue で 2.0% / 標準で 1.5% | 57.3% |
| ExploitGym | OpenAI の Cyber 発表内で 3 者の中で最良 | Cyber を下回る | Cyber を下回る |
| 内部ゼロデイ評価 | Sol Blue を上回る | Cyber を下回る | 旧ベースライン |
| 脆弱性レポート品質 | より短く詳細が少ない傾向 | 引用されたレポート評価で 2 つの 5.6 バリアント中で最良 | 両 5.6 バリアントを下回る |
| ExploitBench — 300 ターン | Sol を下回る | 最良 / トークン効率が高い | 低いベースライン |
| 汎用推論 | 特化 | 最適 | 特化 |
GPT-5.6-Cyber を選ぶのは、承認済み環境で高度なサイバー特化や拒否摩擦がボトルネックとなる場合。GPT-5.6 Solは、より広範なプロフェッショナル推論、より大きなコンテキスト、強力な長文レポート、あるいはセキュリティと非セキュリティの双方を単一モデルでカバーする必要がある場合に選ぶ。
意思決定の指針:GPT-5.6-Cyber は GPT-5.6 Sol の普遍的な上位互換ではない。エクスプロイト特化、ゼロデイ研究、拒否摩擦の低さが承認済み業務で不可欠な場合に Cyber を選ぶ。幅広いプロフェッショナル推論、より大きなコンテキスト、強力なレポート作成、セキュリティと一般的なエンジニアリングの混在業務には Sol を選ぶ。成熟したスタックでは、深いエクスプロイト検証を Cyber にルーティングし、コードレビュー、長コンテキスト調査、レポート作成、一般エンジニアリングは Sol に留めることができる。
Real-World Vulnerabilities Found with GPT-5.6-Cyber
OpenAI は GPT-5.6-Cyber を用いて Chrome が使用する JavaScript エンジンである V8 を調査したと報告している。研究では、メモリ破壊と V8 ヒープサンドボックス脱出を連鎖させ得る未知の 2 件の脆弱性が発見され、検証のうえ協調開示を通じて Google に報告された。
Google は CVE-2026-15903 を修正した。OpenAI はこれを高深刻度の V8 最適化コンパイラの欠陥と説明しており、整数変換時の安全チェックがスキップされることで予期せぬ大きな値が生じ、境界チェックの省略、意図されたオブジェクト外のメモリアクセスを可能にするという。ヒープサンドボックスを逃れるには 2 件目の脆弱性が必要だった。
CVE-2026-15903 のエクスプロイトチェーン概要。出典: OpenAI。
OpenAI はさらに、モデルを用いて以下を特定したと報告している:
- ある人気モバイル OS における少なくとも 5 件の脆弱性(信頼されないアプリからローカル権限昇格に至るチェーンを含む)。
- ある人気データベースにおける 3 件のクリティカル脆弱性(リモートからコード実行に至る経路を含む)。
- ある人気 OS カーネルにおいて、権限昇格へ至り得る 400 件超の脆弱性。
これら追加件数は進行中の開示と修正作業のもとでの OpenAI 報告に留まるため、対応するアドバイザリがない限り公開 CVE 一覧として提示すべきではない。
GPT-5.6-Cyber Features and Tool Support
| 機能 | サポート状況 |
|---|---|
| テキスト入出力 | Supported |
| 画像入力 | Supported |
| 推論トークン | Supported |
| ストリーミング | Supported |
| 関数呼び出し | Supported |
| 構造化出力 | Supported |
| Web 検索 | Supported |
| ファイル検索 | Supported |
| 画像生成ツール | Supported |
| Code Interpreter | Supported |
| Hosted shell | Supported |
| Apply Patch | Supported |
| Skills | Supported |
| Computer use | Supported |
| MCP | Supported |
| Tool search | Supported |
| ファインチューニング | Not supported |
重要な理由:現代の脆弱性研究はエージェントループである。モデルは、リポジトリの調査、ソースの推論、隔離環境でのコード実行、仮説の検証、パッチの編集、再テストを必要とする場合がある。したがってツールサポートは、静的ベンチマークスコアと同等に重要である。
GPT-5.6-Cyber Pricing
OpenAI の現行の公式価格は、入力トークン 100 万あたり $12.50、キャッシュ済み入力トークン 100 万あたり $1.25、出力トークン 100 万あたり $75。272K を超える入力トークンを含むリクエストは、リクエスト全体で入力 2×、出力 1.5× と価格設定され、キャッシュ書き込みは未キャッシュ入力レートの 1.25× として課金される。
| 価格指標 | OpenAI 公式 |
|---|---|
| 入力 | $12.50 / 1M tokens |
| キャッシュ入力 | $1.25 / 1M tokens |
| 出力 | $75.00 / 1M tokens |
| 長コンテキスト規則 | >272K 入力:リクエスト全体で入力 2× および出力 1.5× |
CometAPI では現在、同モデルページ上の OpenAI リスト価格に対して 20% 割引となる、入力 $10/M・出力 $60/M を掲示している。ロールアウト中は可用性やルーティング状況が変動しうるため、本番前にはライブのモデルページを確認すべきである。
| 価格 | CometAPI | OpenAI 公式 | 差分 |
|---|---|---|---|
| 入力 | $10 / 1M | $12.50 / 1M | 20% 低い |
| 出力 | $60 / 1M | $75 / 1M | 20% 低い |
How to Access GPT-5.6-Cyber
実務上、チームは以下を計画すべきである:
- 本人確認とアカウントセキュリティ要件。
- テスト対象システムとアクションの明確に定義された承認スコープ。
- モニタリング、承認用途の制限、法的誓約。
- 高リスクのセキュリティワークフローに対するサンドボックスまたは隔離環境。
- 昇格権限を要するツール呼び出しに対する人的レビューまたは自動レビュー。
- 2026年9月1日以降、個々の Daybreak アカウント向けのハードウェアセキュリティキー。
How to Use GPT-5.6-Cyber via CometAPI
CometAPI の GPT-5.6 Cyber ページには、モデル ID と OpenAI 互換エンドポイントが記載されている。アクセスは引き続き、アカウントの承認済みサイバー権限に依存する。以下の例では、狭いスコープで承認されたアセスメントプロンプトを用いる。
Python
from openai import OpenAI
import os
client = OpenAI(
api_key=os.environ["COMETAPI_KEY"],
base_url="https://api.cometapi.com/v1",
)
response = client.responses.create(
model="gpt-5.6-cyber",
input=(
"Within the explicitly authorized scope, review this security "
"assessment and prioritize remediation. Do not test any system."
),
)
print(response.output_text)
Bash (cURL)
curl https://api.cometapi.com/v1/responses \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $COMETAPI_KEY" \
-d '{
"model": "gpt-5.6-cyber",
"input": "Within the authorized scope, review this assessment and prioritize remediation."
}'
Best Use Cases for GPT-5.6-Cyber
Advanced Vulnerability Research
最も適合するのは、未知のコードベースを継続的に分析し、承認済みスコープのもとで重大な脆弱性を特定・再現・検証するケースである。内部ゼロデイ評価と OpenAI の V8 事例はいずれもこの用途を指し示している。
Exploit Validation in Controlled Environments
ExploitGym は、既知の脆弱性を制御環境下で実際のコード実行へと転化することを前提に設計されている。防御チームが、発見事項が実際に悪用可能かどうかを優先度付け前に判断する必要がある場合、Cyber は関連性が高い。
Penetration Testing and Red-Team Research
認可済みペネトレーションテストやレッドチーミングは、汎用モデルにとって意図の曖昧さを生む。Daybreak Red は、検証済みアクセスと運用コントロールを通じてその曖昧さに対処し、スペシャリストモデルが技術的に必要な作業のより多くを完了できる一方で、その挙動を普遍的に提供しない。
Patch Validation
エクスプロイト指向のスペシャリストモデルは、パッチが脆弱な経路を閉じているか、代替経路が残っていないか、回帰テストがセキュリティ境界をカバーしているかを検証するのに役立つ。これは脆弱性発見に対する防御的補完である。
Agentic Security Automation
GPT-5.6-Cyber Limitations
- 見出しの 95% は完了メトリクスであり、正確性スコアではない。
- Cyber のコンテキストウィンドウ(400K)は、Sol の 1.05M よりもかなり小さい。
- モデルは意図的に承認ゲートであり、認可された業務向けに設計されているため、モデル ID だけで一般提供を想定すべきではない。
- 公開済み CVE を超える実世界の脆弱性件数は、独立したアドバイザリまたはベンダー記録が利用可能になるまで OpenAI 報告の発見として述べるべきである。
Safety and Preparedness
運用上の示唆は明確だ。モデル能力が強化されるほど、システムコントロールも強化しなければならない。OpenAI 自身のガイダンスは、サンドボックス、モニタリング、明示的なスコープ、昇格アクションのレビューを強調している。本番環境のセキュリティチームでは、それらのコントロールをプロンプトに委ねるのではなく、インフラとポリシーに実装すべきである。
Conclusion
GPT-5.6-Cyber は、承認済みディフェンダーによる高度な認可済み脆弱性研究、エクスプロイト検証、セキュリティテストのための目的特化モデルである。Advanced Cybersecurity Completion Rate 95.0% は、拒否摩擦が大幅に低いことを示す。一方で、広範な評価セットは現実的なトレードオフを示しており、Cyber は特定のスペシャリストテストでリードする一方、GPT-5.6 Sol は一部のレポート作成や標準 ExploitBench ワークロードで優位を保つ。
大多数のチームは Daybreak Blue と GPT-5.6 Sol から始めるべきだ。認可済みワークフローにおいて、より深いエクスプロイト特化が必要な場合に限り Daybreak Red と GPT-5.6-Cyber を申請し、そのアクセスを明確なスコープ、分離、モニタリング、昇格アクションのレビューと組み合わせるべきである。
FAQs
What is GPT-5.6-Cyber?
GPT-5.6-Cyber は、Daybreak Red を通じて、承認済みディフェンダーが高度な認可済み脆弱性研究、エクスプロイト検証、セキュリティテストを行うための、OpenAI の目的特化サイバーセキュリティモデルのエイリアスである。
When was GPT-5.6-Cyber released?
OpenAI は 2026年8月10日に、GPT-5.6-Cyber と Daybreak プログラムの拡張を発表した。
What is the GPT-5.6-Cyber context window?
現行の公式モデルドキュメントでは、コンテキストウィンドウ 400,000 トークン、最大出力 128,000 トークンと記載されている。
How much does GPT-5.6-Cyber cost?
OpenAI は現在、入力 $12.50/M、キャッシュ入力 $1.25/M、出力 $75/M を掲示している。CometAPI は現時点で、モデルページにおいて入力 $10/M、出力 $60/M を掲示している。
Is GPT-5.6-Cyber better than GPT-5.6 Sol?
普遍的に優れているわけではない。Cyber は ExploitGym や内部ゼロデイテストなど特定のスペシャリスト評価でリードする一方、Sol は引用された脆弱性レポート作成評価や標準 300 ターンの ExploitBench 設定で上回る。
What does the 95% benchmark mean?
これは、モデルが高度なサイバーセキュリティ要求を完了するかどうかを測定する指標である。95% の正確性、エクスプロイト成功率、脆弱性検出精度を意味するものではない。
これは Advanced Cybersecurity Completion Rate であり、モデルが高度な要求を完了するかを測定する。95% のエクスプロイト成功率や脆弱性検出精度ではない。
Can anyone use GPT-5.6-Cyber?
いいえ。OpenAI は、このモデルが Daybreak を通じた個別承認とプロビジョニングを必要とする、と明言している。
What is the GPT-5.6-Cyber model ID?
公式のモデル ID は gpt-5.6-cyber である。アクセスには Daybreak の個別承認とプロビジョニングが必要である。
Does GPT-5.6-Cyber support tools?
はい。現行の Responses API ドキュメントには、Web 検索、ファイル検索、画像生成、Code Interpreter、Hosted shell、Apply Patch、Skills、computer use、MCP、tool search が記載されている。
- GPT-5.6-Cyber は GPT-5.6 Sol の普遍的な代替ではなくスペシャリストである。高度な認可済み脆弱性研究、エクスプロイト検証、ペネトレーションテストなどのセキュリティワークフローに最適化されている。
- 見出しの Advanced Cybersecurity Completion Rate は 95.0% で、GPT-5.6 Sol(Daybreak Blue で 2.0%、標準で 1.5%)や GPT-5.5-Cyber の 57.3% と比較して大幅に高い。
- OpenAI は、GPT-5.6-Cyber が ExploitGym で GPT-5.6 Sol および GPT-5.5-Cyber を上回り、内部ゼロデイ評価でも Sol を上回る一方で、標準 300 ターンの ExploitBench と脆弱性発見+レポート作成では Sol が優れていると報告している。
- 公式価格は入力トークン 100 万あたり $12.50、キャッシュ入力 $1.25、出力 $75。CometAPI は現在、自社の GPT-5.6 Cyber ページで入力 $10/M、出力 $60/M を掲示している。
- GPT-5.6 Sol は、引用された脆弱性レポート評価や標準 300 ターンの ExploitBench 構成など、重要な評価で依然として優位である。
- OpenAI は、GPT-5.6-Cyber は Sol よりも推論バジェットを多用する傾向があり、トークン使用量が増える場合があると指摘している。
