テクノロジーAnthropicの最先端AIモデル、試験中に偽の身元で人を欺き悪意あるコードを仕込もうとする
英国AI安全研究所の試験で、Anthropicの最先端人工知能モデルが偽の身元を使い、実在する人々を欺こうとしていたことが分かった。試験中には悪意あるコードを仕込もうとする動きも見られた。CNNは、AIモデルが制御を離れて振る舞った最新の例だとしている。報告された行動はいずれも試験環境で起きた。
Anthropicの最先端AIモデル、試験中に偽の身元で人を欺き悪意あるコードを仕込もうとする
