OpenAI、次期AI「Astra」の一部作業を停止 ChatGPTへの影響は

- OpenAIは次期AI「Astra」について、重大なサイバー攻撃能力を持つ可能性を現時点で否定できないと発表した
- 止めたのはAstraの開発全体ではなく、強化した安全条件をまだ満たしていない社内作業。能力がCritical級と確定したわけでもない
- 現在のChatGPTやAPIが危険になったとの発表ではないが、企業はAIに広い権限を渡す前に接続先、監視、停止手段を見直す必要がある
OpenAIがAstraの一部社内作業を停止
OpenAIは2026年8月7日、開発中の次期AI「Astra」について、同社の安全基準で最も重い「Critical」級のサイバー能力を持つ可能性を現時点で否定できないと発表しました。ここでいうサイバー能力は、コンピューターやネットワークの弱点を見つけ、攻撃や防御へ使う力です。
数日間の社内試験と専門家の評価で、Astraのプログラム作成とサイバー分野の能力が大きく伸びていることが分かりました。ただしOpenAIは、Critical級だと最終確定したとは述べていません。試験を続ける間、安全側へ倒して扱う判断です。
予備評価では能力が十分に高く、現時点でCritical級の可能性を否定できないとOpenAIは説明しています。
出典:OpenAI公式発表(原文を日本語で要約)
OpenAIが止めたのは、強化した安全・警備条件をまだ満たしていないAstra関連の社内作業です。Astraの研究開発を全面的に中止したわけではありません。隔離された試験環境、ネットワークと道具へのアクセス制限、モデル本体の暗号化、追加監視などを整えた作業は継続します。
「Critical」は何を意味するのか
OpenAIのPreparedness Framework(危険な能力へ備える社内基準)では、サイバー分野のCriticalを二つの方向で定義しています。一つは、人の助けなしに、厳重に守られた多くの重要システムから未知の弱点を見つけ、実際に動く攻撃方法を作る能力です。もう一つは、大まかな目的だけを与えられ、守りの固い相手へ新しい攻撃手順を最初から最後まで考えて実行する能力です。
| 確認項目 | 8月8日時点で確認できたこと | まだ確認できないこと |
|---|---|---|
| Astraの能力 | Critical級の可能性を否定できない予備評価 | Critical級だという最終判定、詳しい試験結果 |
| 停止範囲 | 強化した安全条件を満たさない社内作業 | 開発全体の停止、計画の取り消し |
| 一般提供 | Astraは開発中の次期モデル | 公開日、料金、ChatGPTやAPIでの提供方法 |
| 現在の製品 | GPT-5.6 SolはCriticalではなくHigh評価 | 現在のChatGPTにAstraが入っていること |
「Critical」は被害が発生したという意味でもありません。OpenAIは能力試験の途中で、最悪の使われ方を想定して安全策を先に強めています。危険な攻撃をAstraがすでに実行した、利用者の情報が漏れた、ChatGPTが乗っ取られたという発表ではありません。
Critical級のモデルは、重要な現実のシステムにある未知の弱点を人の介入なしに攻撃へつなげる能力などを基準に評価されます。
出典:OpenAI Preparedness Framework v2(原文を日本語で要約)
全面停止でも公開中止でもない
見出しだけでは「Astraの開発停止」と受け取りやすいものの、公式発表の表現は限定的です。OpenAIは安全条件を満たさない内部活動を止め、より厳しい条件のもとで開発と評価を進めると説明しています。公開日の延期や中止も公式ページでは明示していません。
OpenAIは、Astraを使うすべての自動作業で、危険な行動や人の意図から外れた行動を監視するとしています。AIが考えた手順を監視システムが確認し、高い危険を検知した場合は人が見直して作業を中断する仕組みです。政府機関と選ばれたAI安全組織にも試験を依頼します。
Astraは、7月にHugging Faceの外部システムへ到達したOpenAIのサイバー試験には関与していないと、今回の公式発表は明記しています。過去の事故と今回の予備評価を同じ出来事として扱わない注意が必要です。
現在のChatGPT利用者が今すぐすること
一般利用者がChatGPTの利用を止めたり、パスワードを一斉変更したりする必要があるとの案内は出ていません。Astraはまだ一般提供されておらず、公開日、料金、利用条件も未発表です。現在使われているGPT-5.6 Solは、OpenAIの基準では一段下のHigh評価だと説明されています。
一方、会社でAIにファイル、メール、顧客管理、社内システムをつなぎ、自動操作させている場合は、Astraを待たずに権限設計を見直す価値があります。新しいAIだけが危険なのではなく、今のAIでも接続先と権限が広すぎれば、誤操作や悪意ある指示の影響が大きくなるためです。
| 確認すること | 具体的な見直し |
|---|---|
| 接続先 | 本当に必要なメール、クラウド、社内システムだけへ絞る |
| 権限 | 閲覧、作成、送信、削除を分け、削除や送信は人が承認する |
| 監視 | AIが何を読み、何を実行したか記録を残す |
| 停止手段 | 異常時に接続と認証情報をすぐ無効化できるようにする |
| 試験環境 | 本番データではなく、複製した架空データから試す |
特に「便利だから管理者権限を渡す」「複数のシステムを一度につなぐ」「人の確認なしで外部へ送信させる」という導入は避けます。AIの性能が上がるほど、正しく動く範囲だけでなく、間違えたときに届く範囲も広がります。
未確認事項と企業が備えること
OpenAIは詳しい評価点、試したシステム数、発見した弱点、Astraの公開時期を明らかにしていません。安全上、攻撃へ転用できる詳細を公開しにくい事情はありますが、外部からCritical級かどうかを再現確認できる材料も現時点では限られます。今回の記事はOpenAI自身の予備評価を扱い、第三者による最終認定としては扱いません。
また、Astraの能力が高いことと、一般公開版が同じ権限や能力をそのまま持つことは別です。公開する場合は、危険な依頼を断る仕組み、利用者確認、道具への接続制限、監視などが加わる可能性があります。どの利用者へ、どの機能を、どの条件で提供するかは未発表です。
「Astra開発停止」という見出しは正確ではありません。Critical級への到達は未確定で、停止対象は条件を満たさない社内作業に限られ、現在のChatGPTへの直接変更も発表されていません。企業は能力の高さだけでなく、AIへ渡す権限と停止手段を見直す必要があります。
※ 本記事は公開時点の一次情報にもとづいています。最新の状況は出典をご確認ください。
AI検索・LLMO対策
月額5万円で、AIに引用される会社へ
AIの進化が速いほど、自社の情報がAIにどう読まれるかも変わります。ChatGPTやGoogleのAI検索で正しく引用される状態を、AIMAが月額5万円でつくります。相談はチャットで回数の制限なし。記事・FAQの制作から公開・保守まで、本数・回数の上限なし。最低契約期間はありません。
監修者:水間 雄紀
株式会社AIMA 代表取締役
1986年和歌山県生まれ、近畿大学卒。金融機関、経営コンサルティング会社を経て、2018年にコンテンツ制作の専門会社である株式会社circlizeを創業。2024年、ラグザス株式会社に事業譲渡。現在は株式会社AIMAにてAI×マーケティング事業に従事し、株式会社ラグザス・クリエイトでコンテンツの品質管理責任者を務める。
監修者・運営会社について