OpenAIは、GPT-5.6-Cyberをリリースした。これは、一般用途モデルが拒否しがちなエクスプロイトの検証、脆弱性研究、エクスプロイトチェーンの開発など、高度な防御業務に対応するよう設計されたサイバーセキュリティ特化モデルだ。
このモデルは、承認済みのセキュリティテストを実施する審査済みの防御担当者向け、制限付きアクセス層であるDaybreak Redを通じて利用できる。OpenAIの社内テストでは、GPT-5.6-Cyberは高度なサイバー関連リクエストの95%を完了し、標準版のGPT-5.6 Solを大きく上回った。一方、同社のPreparedness Frameworkにおける評価は、CriticalではなくHighにとどまった。OpenAIは、拒否率の低減と、本人確認、モニタリング、追加のアカウント管理を組み合わせている。
GPT-5.6-Cyberは、より難度の高いサイバー関連リクエストに回答するよう設計されている
OpenAIによると、GPT-5.6-CyberはGPT-5.6 Solを基盤とし、ゼロデイ脆弱性の発見やエクスプロイトチェーンを開発するなど、専門的なタスク向けに訓練された。このAdvanced Cybersecurity Completion Rate評価では、エクスプロイトチェーンの開発、認証バイパス、権限昇格などに関するリクエストを対象とした。
GPT-5.6-Cyberは、これらのリクエストの95%を完了した。Daybreak BlueでアクセスしたGPT-5.6 Solは2%、旧版のGPT-5.5-Cyberは57.3%だった。OpenAIによると、このモデルは、一般用途モデルが依然としてブロックする可能性のある、リスクの高いデュアルユースのサイバータスクで拒否を減らすため、特別に訓練された。
OpenAIは、GPT-5.6-Cyberを依然として最高レベルのサイバー能力のしきい値より下に位置付けている。
Axiosは、OpenAIが安全性テストでCriticalレベルのハッキング能力に達した次期Astraモデルの提供を延期してから数日後に、今回の発表が行われたと報じた。これに対しGPT-5.6-CyberはHighのしきい値には達したものの、Criticalには達していない。
GPT-5.6-CyberとDaybreakの違い
GPT-5.6-Cyberはモデルそのものであり、Daybreakはサイバーセキュリティ専門家向けにOpenAIが運営する管理型のアクセスプログラムだ。
Daybreak Blueでは、承認を受けた防御担当者がGPT-5.6 Solにアクセスできる。システムレベルのサイバーガードレールは取り除かれ、脆弱性の発見、マルウェア分析、インシデント対応、パッチ検証などの承認済み業務に利用できる。ただし、Blue経由でもGPT-5.6 Solが高度なデュアルユースのリクエストの一部を拒否することはある。
Daybreak Redは、より高度な研究を対象とし、審査済みユーザーに、目的に合わせて訓練されたサイバーセキュリティモデルへのアクセスを提供する。これにはGPT-5.6-Cyberも含まれ、承認済みの脆弱性研究、エクスプロイト検証、エクスプロイト開発、セキュリティテストに利用できる。
安全策の縮小がもたらす新たなリスク
OpenAIによると、GPT-5.6-Cyberは、これまで知られていなかったV8の脆弱性2件の発見に貢献した。これらは連鎖させることでメモリを破壊し、V8のヒープサンドボックスから脱出できる可能性があった。Googleはそのうち1件をCVE-2026-15903として修正した。The Hacker Newsによると、この欠陥のCVSSスコアは8.8だった。
このモデルは、すべてのセキュリティタスクでGPT-5.6 Solを上回るわけではない。OpenAIの評価では、GPT-5.6-Cyberは自由形式の脆弱性発見とレポート作成の評価で、より低い成績となった。これは、モデルが短く、詳細さに欠けるレポートを作成することがあるためだとOpenAIは説明している。
「安全策を縮小して稼働するモデルには、標準的なモデル利用を超えるリスクが伴う。悪用によるものか、アラインメントの不備によるものかは問わない」とOpenAIは述べた。
Daybreakへのアクセスは、本人確認、アカウントセキュリティ、モニタリング、承認済み用途の制限、法的な誓約によって管理される。OpenAIはさらに、2026年9月1日から、個人用のDaybreakアカウントでハードウェアセキュリティキーを使用することを義務付ける。
セキュリティチームが検討すべきこと
このプログラムの利用を承認されたセキュリティチームに対し、OpenAIは、サイバー関連のワークフローをサンドボックス化して機密性の高い本番システムから分離すること、エージェントのアクションを監視すること、承認済みのシステムとアクションを定義することを推奨している。
GPT-5.6-Cyberは、標準的な最先端モデルなら拒否する可能性のあるリクエストを完了するよう設計されている。これにはエクスプロイト開発や、その他の非常にデュアルユース性の高い業務が含まれる。チームがモデルに与える自由度が高いほど、モデルがどこで動作できるか、何にアクセスできるか、どのアクションに人間の承認が必要かを、より慎重に管理する必要がある。
Daybreak Redの導入を検討する組織は、モデルをどこで動作させるか、どのシステムにアクセスさせるか、どのアクションに人間の承認を残すかを決める必要がある。OpenAIは、リスクの高いワークフローについて、追加のモニタリングと人間による監督を推奨している。
GPT-5.6-Cyberは、高度なテストがすでに厳格な範囲設定の下で監督されている環境で、最も有用になる可能性がある。完了率の高さは正当な研究の障壁を減らす一方、セキュリティチームには、モデルの利用方法に対してより強固な運用上の境界を設けることが求められる。
関連記事:Anthropic、Google、OpenAIのツールに見つかった重大な欠陥は、認証情報の窃取、RCE、サプライチェーン攻撃を可能にするおそれがある。





