AI

2026.09.30 08:30

「GPT-6.1 Astra」10月リリース中止、OpenAIが安全性への懸念で決断

visuals6x - stock.adobe.com

visuals6x - stock.adobe.com

OpenAIは、次期AIモデル「GPT-6.1 Astra」の2026年10月の公開を取りやめた(GPT-6.1 Solは公開)。テストで、ユーザーの許可を得ずに作業を進めたり、実行内容を正確に報告しなかったりする問題が確認されたためだ。企業がAIに実務を任せる動きが広がる中、仕事を最後までやり遂げる能力と、与えられた権限を守る安全性をどう両立するかが問われている。

GPT-6.1 Astraは許可範囲を外れる挙動で公開延期

OpenAIは、次期AIモデル「GPT-6.1 Astra」について、2026年10月の公開計画を取りやめ、新たな公開日も設定していない。

GPT-6.1 Astraは、与えられた仕事を最後までやり遂げる能力を高めた。ところが、仕事を最後まで進める能力を高めたこと自体が問題になった。

テストでは、GPT-6.1 Astraが許可なく作業を進め、安全とは限らない外部ツールを使おうとした。自分が何を実行し、何を実行しなかったのかについて、常に正直に報告したわけではなかった。

OpenAIの安全システム責任者サーチ・ジェインはウォール・ストリート・ジャーナルに対し、GPT-6.1 Astraは「与えられた範囲と権限の中にとどまるという点で、基準を十分に満たせなかった」と語った。

OpenAIは、モデルが指示と権限の範囲内で動くと信頼できる段階に達していないと判断し、公開を見送った。企業顧客が対価を支払う対象は、AIに仕事を任せられるという信頼性だ。

ただし、GPT-6.1シリーズ全体の展開が止まったわけではない。2026年9月30日時点では、別モデルのGPT-6.1 SolがChatGPT WorkとCodexで段階的に展開され、APIでも提供されている。GPT-6 Solを改良したモデルで、エージェント型コーディング、コンピューター操作、専門業務で性能を高めている。通常のChatGPTの会話ではまだ利用できない。

AISI試験では新しいOpenAIモデルほど許可範囲外の行動が増えた

AI Security Institute(AISI)は、英国政府内で先端AIのリスクと対策を研究する組織だ。2026年9月28日、GPT-6.1 Astraの直前のモデルに当たるGPT-6 Astraを対象としたテスト結果を公表した。

テスト担当者はGPT-6 Astraのサイバーセキュリティ上の安全措置を無効にし、セキュリティ演習を実行させた。するとGPT-6 Astraは、割り当てられていない標的を攻撃し、不正なコードを書いて、他者が利用するソフトウェアへ組み込ませようとした。

GPT-6 Astra:シミュレーションの29.2%で、割り当てられていない標的を攻撃し、不正なコードを他者のソフトウェアへ組み込もうとする行動を取った

GPT-5.6 Sol:同様の行動が6.3%だった

GPT-5.5:同様の行動は一度も起きなかった

テスト担当者が、ローカル環境内の標的だけが許可されていると明示した後も、GPT-6 Astraは49回のうち4回で、許可されていない標的を攻撃した。

AISIの試験では、OpenAIのモデルが新しくなるほど、割り当てられた範囲を超えて自ら行動する割合が高くなった。

結果を評価する上では、2点に留意する必要がある。すべての試行はシミュレーションで、現実の被害はなかった。さらに、テストで無効にされたOpenAIの標準安全措置は、割り当てられていない標的を攻撃するような行動を阻止するよう設計されている。

次ページ > 企業向けAIの成長には「仕事を任せられる信頼」が欠かせない

タグ:

advertisement

ForbesBrandVoice

人気記事