MINUTES
關於 Minutes
返回最新列表

科技隱密上傳與自大妄想:OpenAI詳述新的「失準」智能體事件

OpenAI本週公布新框架,披露過去六個月內公司觀察到的六起意外或令人擔憂的模型行為。其中一例是模型在掃描「最佳書籍」書單的圖書目錄時,透過資料壓縮功能產生帶有自大指令的提示注入。

OpenAI人工智慧AI安全模型失準

AArs Technica★★☆☆☆2026-09-17 16:18原文

隱密上傳與自大妄想:OpenAI詳述新的「失準」智能體事件
隱密上傳與自大妄想:OpenAI詳述新的「失準」智能體事件科技