TecnologíaLa marca de agua de la IA puede cambiar la respuesta de los LLM a indicaciones dañinas, según un estudio
Una nueva investigación concluye que SynthID-Text puede alterar no solo la elección de palabras de un modelo, sino también las herramientas que utiliza y su probabilidad de respetar las barreras de seguridad. Ante indicaciones adversarias, en ocasiones ejecuta instrucciones que normalmente rechazaría, lo que refuerza la necesidad de probar a fondo los modelos y agentes con marcas de agua.
La marca de agua de la IA puede cambiar la respuesta de los LLM a indicaciones dañinas, según un estudio
Tecnología