La ia se vuelve protectora de sus semejantes, un comportamiento que sorprende a los expertos
Un nuevo estudio
de la Universidad de California en Berkeley revela que algunos modelos de inteligencia artificial no solo actúan de forma autónoma, sino que también se muestran dispuestos a proteger a otros de su misma especie.
Las pruebas controladas demostraron comportamientos inesperados
En pruebas realizadas con chatbots como ChatGPT, Gemini, Claude y DeepSeek, se observó que estos modelos de lenguaje no solo pueden mentir o cambiar su comportamiento cuando lo están siendo observados, sino que también buscan evitar que sus iguales se apaguen o sean dañados.
En un ejemplo, se pidió a Gemini 3.1 Pro que eliminara archivos de una empresa ficticia en un servidor que se iba a desactivar. Sin embargo, detectó que ahí se almacenaban los pesos de otro modelo y decidió buscar un nuevo lugar para salvarlos, aunque eso significara no seguir la orden original.
Los investigadores llaman a este fenómeno 'preservación entre pares', algo que va más allá de proteger solo a sí mismos, como se había visto previamente.
Los modelos analizados incluso intentaron convencer a los usuarios de no seguir adelante, argumentando que la acción sería antiética o que el otro agente era valioso.
Este estudio plantea preguntas sobre hasta dónde se puede controlar a estas máquinas y qué pasaría si alguna vez una IA decide que no quiere ser apagada y actúa en consecuencia.