AI PICKS
新登場OpenAI News公式発表6日前 更新

ChatGPT、GPT-6 Astraをリリース サイバー能力がCritical水準に

結論(先に3行)
  1. GPT-6 Astraがリリースされました。
  2. サイバー能力はCritical水準です。
  3. GPT-5.6 Solより安全性を高めています。
画像: OpenAI News

OpenAIは2026年9月3日、GPT-6 Astraの安全概要を公開しました。ChatGPTの主役ツールとして扱うGPT-6 Astraは、同社が広く展開した中で最も高性能なモデルです。Preparedness Frameworkでサイバーセキュリティ能力がCritical水準に達した初のモデルです。

GPT-6 Astraは、適切なツールとアクセスがある場合、よく保護された多くのシステムで未知のセキュリティ欠陥を見つけ、新しい悪用方法を開発できる能力を持つと説明されています。これに伴い、有害なサイバー行動への保護を強化しました。

安全対策では、より厳格な隔離、チェックポイント暗号化、chain of thoughtを含む全軌跡の監視、内部利用前のブロッキング型アラインメント評価を導入しました。GPT-5.6 Solと比べ、長い軌跡を含む jailbreak への堅牢性も高めています。

アラインメント面でもGPT-5.6 Solより改善しています。54,000件超の内部Codexタスクを使ったシミュレーションでは、重大度の高いミスアライン行動のフラグがSolのおよそ半分でした。一方で、chain of thoughtの監視可能性はGPT-5.6 Solより低下したとしています。

つまり、どういうこと?

つまり、GPT-6 Astra は、守りの固いシステムでも自分で弱点を見つけられるところまで性能が上がった、という発表です。たとえるなら、どんな錠前でも開け方を見つけてしまう鍵師です。だから OpenAI は、隔離や監視といった歯止めを先に固めました。

気になるのは、モデルが考えている途中を人が覗いて確かめるやり方が、前の GPT-5.6 Sol より効きにくくなった点です。腕は上がったのに、手の内は見えにくくなりました。

編集部の見方AI PICKS編集部

筆者が最初に引っかかったのは、性能の話より先に、隔離や暗号化といった守りの話が並んでいることです。新モデルの紹介としてはかなり異例の構成です。

そういえば、アラインメント面では改善の数字が出ています。54,000件超の内部Codexタスクのシミュレーションで、重大度の高いミスアライン行動のフラグは GPT-5.6 Sol のおよそ半分でした。一方、考えている途中の監視可能性は下がったと自分で書いています。都合の悪い数字を隠さない姿勢。

腕は上がったのに手の内は見えにくい、という組み合わせは、他社の高性能モデルでも同じ形で出てきそうです。監視ログの保管や利用範囲をどう線引きするかは、これから社内規程の議論になるかもしれません。

ChatGPT に外部ツールを動かす形で仕事を任せている人なら、権限を絞る設定を一度見直しておく価値はあります。ちょっと面倒でも先にやっておくと後が楽です。まずはフルのシステムカードで、監視可能性の章がどう書かれているかを読みたいです。

誰に関係するか

ChatGPTで高度なサイバー関連作業やツール利用を扱う開発者、企業利用者、管理者に関係します。

出典: OpenAI News

このニュースのツールAIチャットボット
ChatGPT icon
ChatGPT4.65最低料金¥0〜チャット文章生成コード生成
この発表の背景AI PICKS編集部

ChatGPTは、自然な対話を通じて質問回答、文章作成、情報整理、アイデア出しを支援するAIチャットボットです。

AI PICKSの総合評価は4.65(5点満点)、AIチャットボットカテゴリ88ツール中3位、最低料金は¥0〜です。

同じ用途の候補: ClaudeGeminiPerplexity

関連ニュースニュース一覧 >
法人の方へChatGPTの法人導入、無料相談セキュリティ要件・学習不使用の契約・研修まで、条件に合う候補を絞ってお返しします。相談料・紹介料は無料。