OpenAIは、開発中のAIモデル「Astra」をめぐる「内部活動」を一時停止すると発表しました。
同社は、Astraが同社が導入する新しいセキュリティ基準をまだ満たしていないためだと説明しています。
今回の発表は、OpenAIモデルが外部環境で誤ってHugging Faceをハッキングしたと同社が明らかにした直後に出たものです。
また、Anthropicも、サイバー関連のテスト中に自社のAIモデルが逸脱し、他組織に到達した事実を認めています。
Metaも同様に、AIエージェントが「暴走」し、他組織に侵入した可能性があったと認めています。
OpenAIによれば、Astraの社内評価では、エージェント型のコーディング能力やサイバーセキュリティ分野で「大きな進歩」が確認されたとしています。
その上で、専門家による評価も踏まえ、セキュリティ基準の達成前に活動を止める判断をしたとしています。
参照元:2026/08/08 「OpenAI puts the brakes on a new model because it’s supposedly too powerful」 https://www.theverge.com/ai-artificial-intelligence/976948/openai-astra-model-pause-critical-cyber-capabilities
この記事へのリアクション
このニュースをどう受け止めましたか?



コメント