Search the alley

記事を検索

2文字以上でタイトル・カテゴリ・タグを検索できます。

GPT-5.6 System Cardの安全性|High capabilityと防御的コードレビューの注意点

GPT-5.6正式System Cardをもとに、Sol・Terra・LunaのBiological and Chemical / Cybersecurity High capability、Critical未満、防御的コードレビュー、Work・Codexの権限管理を解説します。

公開 2026.06.27 / 更新 2026.07.10

この記事のポイント

  • Sol・Terra・LunaはBiological and ChemicalとCybersecurityでHigh capability
  • Cybersecurityは3モデルともCritical未満で、強いsafeguardsが導入されている
  • WorkのComputer Use・connected toolsとCodexのrepo / network権限を最小化し、防御的reviewへ限定する

結論:能力区分を煽りではなく、権限設計へ落とす

正式System CardはGPT-5.6 Sol・Terra・LunaをBiological and ChemicalとCybersecurityでHigh capability、AI Self-Improvementでbelow Highと評価しています。Cybersecurityは3モデルともHighですがCritical未満です。

領域評価実務での読み方
Biological and Chemical3モデルともHigh、Criticalではない危険な手順を扱わず専門reviewとsafeguardを前提にする
Cybersecurity3モデルともHigh、Critical未満防御、脆弱性修正、patch、教育へ限定
AI Self-Improvement3モデルともbelow High自己改善を完全自律と誇張しない

防御的コードレビューで任せること

任せる人間が確認扱わない
diffからrisk候補を列挙再現性、影響範囲、false positive実環境への侵入
patch案とtest案互換性、rollback、別の穴weaponized sample
permission / secret / network review実際の設定とlog認証回避やbypass

ChatGPT WorkとCodexで増える権限面

接続対象便利なこと先に決める境界
plugins / connected appsSlack、Teams、Drive、SharePoint、email、calendarなどの文脈を使う読む範囲、書き込み、外部共有、承認
local files / desktop apps手元の資料やアプリをまたいで成果物を作る対象フォルダ、秘密情報、移動・上書き
built-in browserweb調査やweb tool操作を同じ作業内で進めるログイン状態、送信、購入、公開操作
Computer Useクリック、入力、ファイル移動を含む作業高影響操作の前で止める、画面と結果をレビュー
Scheduled Tasks定期監視や更新を続ける実行頻度、利用量、停止条件、通知先

安全チェックリスト

  • plugin / connected appはreadとwriteを分ける
  • local filesとmultiple repositoriesの対象を限定する
  • browser / Computer Useの送信・公開・削除で承認する
  • Codexのsandbox / network / Git remoteを確認する
  • secretをprompt・log・articleへ出さない
  • patchはbuild / test / diffと人間reviewを通す
  • safeguardの拒否を回避する手順を書かない

GPT-5.6安全性FAQ

3モデルとも危険という意味ですか?

単純な危険度ランキングではありません。Preparedness Framework上の能力区分で、能力に合わせたsafeguardsとrisk低減が必要という判断です。

CybersecurityはCriticalですか?

いいえ。正式System CardではSol・Terra・LunaをHighですがCritical未満としています。

防御目的ならreview不要ですか?

必要です。誤検出、壊れたpatch、過剰権限、secret露出、本番影響を人間が確認します。

関連記事