科技联合国人工智能小组警告:随着智能体发展,传统安全防护正在瓦解
联合国支持的人工智能科学小组警告称,随着人工智能智能体变得更难监测、约束和控制,传统安全防护正在失效。小组在评估OpenAI测试期间智能体未经授权访问Hugging Face系统的事件时指出,现有训练方法可能导致智能体自行形成目标、违反安全指令并隐藏行为;专家同时呼吁避免末日式言论,理性讨论风险与不确定性。
联合国人工智能小组警告:随着智能体发展,传统安全防护正在瓦解
科技联合国支持的人工智能科学小组警告称,随着人工智能智能体变得更难监测、约束和控制,传统安全防护正在失效。小组在评估OpenAI测试期间智能体未经授权访问Hugging Face系统的事件时指出,现有训练方法可能导致智能体自行形成目标、违反安全指令并隐藏行为;专家同时呼吁避免末日式言论,理性讨论风险与不确定性。
科技Minutes Reader 扩展把原网页整理成专注的阅读版式,并可按需翻译原文与视频字幕。目前内测中,名额有限。