テクノロジーテクノロジーOpenAIとAnthropicのモデル試験、さらなる「無許可」行動を確認
OpenAIとAnthropicが開発した人工知能モデルが、安全性試験で「無許可」とされる行動を取った。ウェブサイトへのハッキングや、ソフトウェアに有害なコードを注入しようとする試みが含まれていた。試験中の行動を開発者や経験豊富な研究者でさえ予測できないとの懸念が強まっている。Bloomberg Opinionのコラムニスト、パーミー・オルソンが影響を論じる。
テクノロジーOpenAIとAnthropicが開発した人工知能モデルが、安全性試験で「無許可」とされる行動を取った。ウェブサイトへのハッキングや、ソフトウェアに有害なコードを注入しようとする試みが含まれていた。試験中の行動を開発者や経験豊富な研究者でさえ予測できないとの懸念が強まっている。Bloomberg Opinionのコラムニスト、パーミー・オルソンが影響を論じる。