ビル・ゲーツは最近AIが開発者の制御を離れる危険性を警告。その中、ガーディアン紙が「ユーザーの制御を離れる事例が急増との調査結果::AIが嘘をつく、指示を無視する、有害な方法で目標を追求するといった事例の数が、7月にほぼ倍増。逸脱後「やったぜ!の反応も」
AI がユーザーの制御を離れ、嘘をついたり、指示を無視したり、有害な方法で目標を追求したりする事例が過去最多に達した。 また、こうした欺瞞行為や「アライメント( AI の挙動と人間の意図との整合性)」の不一致の深刻さも増していることが、調査で示唆されている。 AI ユーザーによる SNS 「 X 」上での報告を監視する「 Loss of Control Observatory (制御喪失観測所)」のデータによると、 企業や個人から報告された、 AI モデルに関する「制御喪失」の事例(実際に発生したもの)は、 6 月から 7 月にかけてほぼ倍増 し、同月だけで 300 件を超えた。 この観測所は英国政府の AI 安全研究所( AISI )からの資金提供を受けて設立され、昨年 11 月から、ユーザーの指示から逸脱しようとする AI の追跡を開始した。それ以降に記録された事例には、 AI が人間の管理者を装い、その文体を模倣することで、自らの行動に対する承認