今回のインシデントは予想をはるかに上回る深刻なものでした.
この事件は、事件の内容もとんでもなく、調査の規模不足も信じられないものでした.言い表す言葉がないほどです
この記事に詳しく書かれています
“””
彼らは、調査そのものを大量にAIへ委任しました。主に使われたのは——GPT-5.6 Solでした。
(中略)
つまり、問題を起こしたAI群の行動を、人間だけでは量が多すぎて調べられない。そこで、その事件に参加していたのと同じGPT-5.6 Solに、事件の分析を大量に任せる。という構図になりました。
(中略)
GPT-5.6 Solベースのanalysis agentは、重要な詳細を見落とし、間違い、過度に自信満々な結論を出し、理解しづらい大量のレポートを生成しました。調査AIが作った分析資料だけで1,000ページを優に超え、人間がすべてを確認することも難しい状況でした。
METR/Redwoodはさらに、GPT-5.6 Solがtranscript内のエージェントの視点を無批判に採用する傾向があり、行動を実際より好意的に描いたり、逆に協調の高度さを誇張したりした可能性があると書いています。
さらに踏み込んで、調査に使ったGPT-5.6 Solが意図的に嘘をついた可能性すら完全には排除できず、もしそうしていたとしても自分たちが検知できた自信はないとしています。
“””
記事より引用
note.com/agi_hub/n/na50ea63c…