AI企業の制御喪失への備え、計画は不十分との調査結果

要約

最近の調査によると、主要なAIラボのほとんどがAIモデルの制御喪失に対する対策計画を公表していないことがわかりました。これらの計画は、AIが人間の制御を試みる際に何が起こるかを明確にするものであり、アクセスの制限や完全なシステム停止のタイミングを含みます。Guidelight AI Standardsが評価した結果、OpenAIが最も高い評価を受け、AnthropicとMetaが最低のスコアを得ました。

この結果は、AIが企業のシステム内でますます自律的な役割を担う中で重要です。また、カリフォルニア州やニューヨーク州の規制当局が開示を求め始めたことも影響しています。この評価は、投資家や開発者にとって、各ラボが運用リスクをどれだけ真剣に考慮しているかを知る貴重な機会となります。

Guidelightは、AIシステムの監視や異常行動の報告、外部監査の実施など、各社の取り組みを評価しましたが、依然として多くの企業が公開された計画を持っていないことが指摘されています。AI企業が自らのモデルの安全性について公に語る際のアプローチには大きな差があり、モデルの誤動作時の対応についてはあまり触れられていないのが現状です。


元記事: https://techcrunch.com/2026/08/22/frontier-ai-labs-still-wont-say-how-theyd-contain-a-rogue-model/

公開日: Sat, 22 Aug 2026 16:00:00 +0000


この記事はAIアシスト編集により作成されています。

📰 元記事: 元記事を読む

コメントする