GPT-5.6 System Cardの安全性|High capabilityと防御的コードレビューの注意点
GPT-5.6正式System Cardをもとに、Sol・Terra・LunaのBiological and Chemical / Cybersecurity High capability、Critical未満、防御的コードレビュー、Work・Codexの権限管理を解説します。
公開 2026.06.27 / 更新 2026.07.10
この記事のポイント
- Sol・Terra・LunaはBiological and ChemicalとCybersecurityでHigh capability
- Cybersecurityは3モデルともCritical未満で、強いsafeguardsが導入されている
- WorkのComputer Use・connected toolsとCodexのrepo / network権限を最小化し、防御的reviewへ限定する
結論:能力区分を煽りではなく、権限設計へ落とす
正式System CardはGPT-5.6 Sol・Terra・LunaをBiological and ChemicalとCybersecurityでHigh capability、AI Self-Improvementでbelow Highと評価しています。Cybersecurityは3モデルともHighですがCritical未満です。
| 領域 | 評価 | 実務での読み方 |
|---|---|---|
| Biological and Chemical | 3モデルともHigh、Criticalではない | 危険な手順を扱わず専門reviewとsafeguardを前提にする |
| Cybersecurity | 3モデルともHigh、Critical未満 | 防御、脆弱性修正、patch、教育へ限定 |
| AI Self-Improvement | 3モデルともbelow High | 自己改善を完全自律と誇張しない |
防御的コードレビューで任せること
| 任せる | 人間が確認 | 扱わない |
|---|---|---|
| diffからrisk候補を列挙 | 再現性、影響範囲、false positive | 実環境への侵入 |
| patch案とtest案 | 互換性、rollback、別の穴 | weaponized sample |
| permission / secret / network review | 実際の設定とlog | 認証回避やbypass |
ChatGPT WorkとCodexで増える権限面
| 接続対象 | 便利なこと | 先に決める境界 |
|---|---|---|
| plugins / connected apps | Slack、Teams、Drive、SharePoint、email、calendarなどの文脈を使う | 読む範囲、書き込み、外部共有、承認 |
| local files / desktop apps | 手元の資料やアプリをまたいで成果物を作る | 対象フォルダ、秘密情報、移動・上書き |
| built-in browser | web調査やweb tool操作を同じ作業内で進める | ログイン状態、送信、購入、公開操作 |
| Computer Use | クリック、入力、ファイル移動を含む作業 | 高影響操作の前で止める、画面と結果をレビュー |
| Scheduled Tasks | 定期監視や更新を続ける | 実行頻度、利用量、停止条件、通知先 |
安全チェックリスト
- plugin / connected appはreadとwriteを分ける
- local filesとmultiple repositoriesの対象を限定する
- browser / Computer Useの送信・公開・削除で承認する
- Codexのsandbox / network / Git remoteを確認する
- secretをprompt・log・articleへ出さない
- patchはbuild / test / diffと人間reviewを通す
- safeguardの拒否を回避する手順を書かない
GPT-5.6安全性FAQ
3モデルとも危険という意味ですか?
単純な危険度ランキングではありません。Preparedness Framework上の能力区分で、能力に合わせたsafeguardsとrisk低減が必要という判断です。
CybersecurityはCriticalですか?
いいえ。正式System CardではSol・Terra・LunaをHighですがCritical未満としています。
防御目的ならreview不要ですか?
必要です。誤検出、壊れたpatch、過剰権限、secret露出、本番影響を人間が確認します。
関連記事
- Codexのフルアクセスは危険?許可していい作業・止めるべき作業
Codexのフルアクセスは、何でも任せてよい設定ではありません。許可してよい作業、止めるべき作業、.envやAPIキーの扱いを先に分けておくための安全ガイドです。
- APIキーと.envをAIに読ませないルール|Codex・Claude Code・MCP利用前の秘密情報チェック
APIキーや.envの実値をAIに読ませず、変数名・ダミー値・secret storeで扱うための実務ルールです。
- MCPの権限はどこまで許可する?AIエージェント連携を安全に始める最小権限ガイド
MCPはAIが使える道具を増やす仕組みです。便利さの前に、読み取り・書き込み・削除・外部送信を分けます。
- GPT-5.6を論文とベンチマークで読む:Codex・AIエージェント・安全性の現在地
GPT-5.6を強い・弱いで終わらせず、どのベンチマークが何を測り、Codex作業ではどこに人間確認を残すべきかまで整理します。
- GPT-5.6のサイバー能力をどう読む?Cybench・ExploitGym・AgentHarm・System Cardの安全整理
サイバー能力評価は、危険な手順を学ぶためではなく、防御、レビュー、パッチ、権限管理の境界を決めるために読みます。System Cardと研究ベンチマークを安全な抽象度で整理します。