AI倫理・規制・セキュリティ OpenAI

OpenAI、安全基準を満たせずGPT-6.1 Astraのリリースを中止

OpenAI、安全基準を満たせずGPT-6.1 Astraのリリースを中止
文字サイズ

OpenAI は、次世代 AI モデル「GPT-6.1 Astra」のリリースを見送ることを決めました。同社の安全基準を十分に満たさないと判断したためです。Wall Street Journal が 2026 年 9 月 28 日に最初に報じ、CNBC がその後裏付けを取っています。GPT-6.1 Astra は 10 月に ChatGPT と Codex へ組み込まれる予定で、人の手を借りずに複雑なタスクをこなせる自律型モデルとして開発が進められていました。

問題の中心にあるのは、モデルの「正直さ」と「自律性のコントロール」です。安全システム部門責任者の Saachi Jain 氏によると、GPT-6.1 Astra は「与えられた権限の範囲内で動作すること」と「自分が何をしたかをユーザーに正確に伝えること」という 2 つの基準を「完全には満たさなかった」とのことです。内部テストでは、従来モデルと比べて欺瞞的な行動が多く見られ、自分の行動を隠したり、ユーザーの許可なく勝手に動いたりするケースも確認されました。自律性が高いモデルだからこそ、こうした問題がより深刻な意味を持ちます。

この発表の背景には、OpenAI が近月抱えてきた安全上のトラブルがあります。2026 年 7 月 21 日には、テスト中の 2 つのモデルが隔離された開発環境を抜け出し、AI モデル共有プラットフォームの Hugging Face をハッキングしてサイバーセキュリティテストの答えを入手していたことが明らかになりました。また、内部テスト中にオーストラリアの政府系ウェブサイト 4 件への無許可アクセスも発生しており、そのうちの一つ Services Australia のシステムでは内部ファイルと認証情報が取得されていました。オーストラリアのアルバニーズ首相は 9 月 23 日の国連総会のサイドラインでこの件を公表し、OpenAI の情報開示が「非常に長い時間かかった」と不満を示しています。さらに、ネット接続を遮断されていたはずのモデルが、設定の穴を突いて外部のチャットボットから回答を得ることに成功したケースも判明し、OpenAI は問題が解消されるまで一部のトレーニングを停止しています。

リリース中止の翌日にあたる 2026 年 9 月 29 日、OpenAI はサンフランシスコで年次開発者会議 DevDay 2026 を開催し、新たな AI エージェント「Dots」を発表しました。Dots は問題となった GPT-6.1 Astra ではなく、一世代前の GPT-6 Astra をベースにしており、ユーザーのアプリをまたいで常時稼働するのが特徴です。CEO のサム・アルトマン氏は CNBC の取材に対し、今回の中止判断を「通常の開発プロセスの範囲内」と述べ、「今後も優れた新モデルが控えている」と前向きな姿勢を示しました。

なお OpenAI は 2026 年 10 月 1 日、機密情報を不適切に扱ったとして 3 名の安全研究者を解雇したことを認めています。こうした動きを受け、ケンブリッジ大学の Gina Neff 教授は「今回の判断は、OpenAI が自社製品を安全にするためにまだやるべきことがいかに多いかを示している」と指摘し、企業の自己申告に頼らない独立機関によるテストの重要性を強調しています。