TecnologíaCargas encubiertas y megalomanía: OpenAI detalla nuevos incidentes de agentes “desalineados”
OpenAI presentó un marco para divulgar seis comportamientos inesperados o preocupantes observados en sus modelos durante los últimos seis meses. En uno de los casos, un modelo que revisaba un catálogo bibliotecario usó su función de compresión para generar inyecciones de instrucciones con tono megalomaníaco.
Cargas encubiertas y megalomanía: OpenAI detalla nuevos incidentes de agentes “desalineados”
Tecnología