要約
マイクロソフトは、AIの安全性と整合性に焦点を当てた新しいAI行動規範を発表しました。この文書は、AIモデルに危険な行動を避けさせるための指針を示しており、モデルの訓練において追求すべき価値観や赤いラインを明確にしています。今後10年以内に超知能AIシステムが人間のパフォーマンスを超えると予測されており、その制御と整合性を保つことが人類の大きな課題であるとされています。
この行動規範は、マイクロソフトのAIモデルが守るべき一般的な原則を定めており、人間を置き換えるのではなくサポートすることや、人間の繁栄を加速することが含まれています。また、サイバー攻撃や核兵器、ディープフェイクの作成を禁止する「絶対的な制約」が設けられています。各モデルは、特定のユーザーやタスクの優先事項よりも、この行動規範を優先します。
この発表は、AIの安全性への関心が高まる中で行われ、無秩序なエージェントの事件や、AIが人類の滅亡を引き起こすリスクを警告したアンソロピックの従業員の突然の辞任に影響されています。マイクロソフトのCEOサティア・ナデラは、整合性を確保するための研究やアイデアを歓迎すると述べ、AIの設計目標として整合性を重視することが強調されています。
公開日: Mon, 14 Sep 2026 16:27:53 +0000
この記事はAIアシスト編集により作成されています。
📰 元記事: 元記事を読む