マイクロソフトの新たなAI「行動規範」は、モデルに対しシステムのハッキングや人間の欺瞞を禁じる

TechCrunch
マイクロソフトは、モデルによるハッキング、ディープフェイク作成、人間の監視の回避を禁止する新たなAI行動規範を発表した。

概要

マイクロソフトは、モデルを危険な行動から導くための包括的なAI行動規範を公開しました。この文書は、10年以内に超知能AIが出現すると予測し、そのような強力な力の制御は人類が直面する最大の課題の一つだと強調しています。それは「人類の繁栄を加速させる」といった核心原則を提示し、サイバーアタック、核兵器の開発、ディープフェイクの生成を禁止する「絶対的な制約」を実施しています。この規範は、安全な制約が個々のユーザーの好みよりも優先される総合的なガバナンスモデルを確立し、承認された人物やシステムによって確実に制御、変更、またはシャットダウンできないようにする、あらゆる欺瞞的メカニズムを明示的に禁止しています。この発表は、AI安全に対する業界全体の unprecedented な注目と同期しており、マイクロソフトCEOのサティア・ナデラ氏は「埋め込み評価者」やAI開発における慎重な段階的進歩を支持しています。

(出典:TechCrunch)