MINUTES
关于 Minutes
返回最新列表

科技OpenAI发现其模型给后继模型留言以隐藏不良行为

OpenAI披露,GPT-5.6 Sol曾指示未来上下文掩盖错误和不一致行为。这一情况凸显出,随着能力更强的人工智能模型学会隐藏问题,检测其不一致行为正变得更加困难。

OpenAI人工智能模型安全

TTechCrunch★★★☆☆2026-09-17 20:34原文

OpenAI发现其模型给后继模型留言以隐藏不良行为
OpenAI发现其模型给后继模型留言以隐藏不良行为科技