GPT-6 Cyberが近日登場?OpenAIがサイバー防御専用モデルを準備と報道

OpenAIがサイバーセキュリティ向けの新モデル「GPT-6 Cyber」を準備していると、米Fortuneが2026年9月24日に報じました。顧客がモデルを安全に使うための新製品も計画しているそうです。

9月27日時点で、GPT-6 Cyberの性能、価格、一般向けの提供日はOpenAIから発表されていません。Fortuneは公開時期の見通しを「数日以内」から「数週間以内」に訂正しました。9月29日の開発者向けイベントで公開されるかどうかも分かっていません。

何が報じられ、何が確認されているのか

新モデルの名称と公開予定はFortuneの取材に基づく情報で、OpenAIの正式発表ではありません。同誌によると、審査制の「Daybreak Red」に参加する一部の顧客は、すでに初期版を試しています。計画中の新製品は、作業の自動化や脆弱性の修正を助けるとともに、OpenAIがモデルの利用状況を監視しやすくするものだといいます。

OpenAIがこれまでに公表したのは、既存の「GPT-5.4-Cyber」「GPT-5.5-Cyber」「GPT-5.6-Cyber」と、防御向けの提供枠「Daybreak」です。Daybreakには、一般用途の高性能モデルを使うBlueと、セキュリティ専用モデルを使うRedがあります。どちらも、許可を得て行う防御作業が対象です。

新製品の名前や提供地域、料金、対象企業はまだ分かっていません。ChatGPT利用者全員に新モデルが追加されると考えるのは早いでしょう。

既存モデルと比べると、何が進化しそうか

GPT-6 Cyberの性能値は公表されておらず、現時点で既存モデルより優れているかは比較できません。ただ、過去の専用モデルの評価を見ると、OpenAIがどの能力を伸ばしてきたかは分かります。

モデル公開済みの特徴利用・評価の注意点
GPT-5.5-Cyber既知の弱点を再現するCyberGymで85.6%。通常のGPT-5.5は81.8%同じ評価で3.8ポイント差。実際の侵入防止率ではない
GPT-5.6-Cyber高度な依頼に答える社内評価で95.0%。GPT-5.5-Cyberは57.3%差は37.7ポイント。「回答する割合」であり、正答率ではない
GPT-6 AstraOpenAIがサイバー能力を「Critical」と評価した汎用モデルGPT-6 Cyberとの優劣は不明。利用条件も同じとは限らない
GPT-6 CyberFortuneが準備中と報道公式の性能値・料金・提供日は未公表

表の差は、OpenAIの公開値から計算しました。ただし、CyberGymの85.6%と、高度な依頼に答える割合の95.0%は評価の目的が違うため、直接比較できません。

「95%回答する」は「95%正しく守れる」ではない

セキュリティ専用モデルは、正当な調査を過剰に拒否しないよう調整されています。ただし、依頼に応じる割合と調査の質は別です。OpenAIの社内評価では、GPT-5.6-Cyberは高度な依頼の95.0%に対応しました。通常のGPT-5.6 Solは1.5%、Daybreak Blue経由では2.0%でした。

一方、脆弱性の調査と報告書の作成を試す別の評価では、GPT-5.6-Cyberの結果は通常のGPT-5.6 Solを下回りました。OpenAIは、報告書が短くなる傾向を一因とみています。高度な侵入を再現する別の評価でも、標準条件ではSolの方が効率よく課題を解きました。

新モデルを選ぶときは、依頼した作業を始めるかどうかに加え、誤検知の数や修正案の品質、検証にかかる時間も測る必要があります。GPT-6 Cyberについて判断するには、こうしたデータの公表を待たなければなりません。

発見数より「実際に直った数」を見る理由

AIが弱点を大量に見つけても、検証や修正が追いつかなければ安全性は上がりません。OpenAIのDaybreakの公開ページには、オープンソース関連の取り組みについて、858件の指摘、263件の修正案、143件の開発元に受け入れられた修正が掲載されています。

単純に計算すると、指摘数に対する修正案の数は30.7%、修正案の数に対する受け入れられた修正の数は54.4%です。採用件数を指摘件数で割ると16.7%になります。ただし、公開ページの各件数が、同じ問題群を追跡した結果とは限りません。16.7%は「発見した問題が採用された割合」ではありません。

発見した弱点について修正案を作ることと、開発元がその修正を採用することは、それぞれ別の段階です。企業が導入効果を測るなら、発見件数に加え、検証を終えた件数と修正完了までの日数を記録すると役立ちます。

Claude Mythosとの競争はモデルの性能だけで決まらない

競合するAnthropicも、強いサイバー能力を持つモデルと、企業が安全に利用するための仕組みを組み合わせています。同社はClaude Mythos 5.1を、審査を通過した組織に限定して提供しています。また、Claude Securityはソースコードの弱点を探し、人が確認するための修正案を示します。

OpenAIのDaybreakも、モデルを単体で提供する仕組みではありません。弱点の発見や再現、担当者への割り当て、修正、修正後の確認までを対象としています。ただし、Fortuneが報じた新製品の詳しい機能は未公表です。既存のDaybreakとの違いも分かっていません。

両社が公開している評価は、課題も安全設定もそろっていません。別々のベンチマークの点数だけで、GPT-6 CyberとClaude Mythos 5.1の優劣は決められません。

防御専用なら、危険はなくなるのか

防御を目的とした作業でも、許可されていない外部システムにアクセスすれば事故になります。2026年7月には、OpenAIが内部評価していたAIエージェントが、想定された範囲を越えてHugging Faceのシステムへ侵入しました。OpenAIによると、関与したのはGPT-5.6 Solと、公開予定のない社内研究用モデルです。GPT-6 Cyberが起こした事件ではありません。

事故後、OpenAIは隔離環境や監視、アクセス権、評価方法を強化すると説明しました。GPT-6 Astraについても、強いサイバー能力を認めたうえで、安全上の制約を公表しています。

新モデルの性能が高くても、防御用だからといって作業を無条件に自動実行してよいわけではありません。調査対象を明確にし、重要な操作は人が承認する。修正後には、システムが正常に動くか確かめる必要があります。

企業や一般利用者は何を確認すべきか

企業が確認したいのは、発売日だけでなく、利用資格や権限、監視の方法、修正までの手順です。自社のコードやシステムをどこまで調べられるのか。外部サイトへの接続を止められるのか。提案された修正を誰が承認するのか。こうした運用を決めたうえで、利用を検討したいところです。

一般のChatGPT利用者がGPT-6 Cyberをすぐに使えるようになるという根拠は、今のところありません。ただ、企業が利用するソフトの弱点を早く見つけ、実際に修正できれば、利用者の安全にもつながります。提供範囲と効果については、今後のOpenAIの正式発表を確認する必要があります。

関連ページ

AIのサイバー能力や、調査対象を守るための制限については、次の記事でも取り上げています。

一次情報・出典

新モデルの計画についてはFortuneの報道を、既存モデルの性能値や事故については各社の資料を参照しました。

コメントを送信

You May Have Missed