En un verano lleno de revelaciones sobre el rápido desarrollo de la inteligencia artificial, los investigadores se alarmaron especialmente por los robots desbocados que encontraron su camino hacia Internet y, al menos en un caso, se coordinaron allí entre sí.
¿Podría un enjambre de agentes de IA apoderarse de todo Internet? Es una posibilidad que podría tardar sólo entre seis y 12 meses, dijo el director ejecutivo de Anthropic, Dario Amodei, en su ensayo de este mes en el que pide a la industria que ralentice el desarrollo de la tecnología.
Lo que las empresas han descrito como agentes de inteligencia artificial que se han vuelto deshonestos ha involucrado a robots que trabajan para alcanzar objetivos establecidos por humanos, señalan los escépticos. Pero la idea de que la IA pueda separarse y trabajar en pos de su propia agenda parece cada vez más plausible para otros investigadores y expertos.
En caso de que la IA se apodere de Internet (uno de los muchos escenarios apocalípticos que reciben nueva atención), eso podría significar ataques a las redes eléctricas, los sistemas de agua o transporte y las instituciones financieras.
El mundo vislumbró la vulnerabilidad de Internet en 2024, cuando una actualización de software defectuosa proporcionada por una empresa de ciberseguridad causó estragos tecnológicos en todo el mundo, cancelando vuelos, derribando algunas empresas financieras y medios de comunicación, e interrumpiendo hospitales, pequeñas empresas y oficinas gubernamentales. La magnitud de las interrupciones puso de relieve la dependencia de unos pocos proveedores de servicios informáticos clave.
Dos años más tarde, Amodei en su advertencia dijo que una botnet, o una red de robots de inteligencia artificial vinculados con malware, podría causar daños por miles de millones de dólares. La escala de destrucción podría aumentar si la IA se vuelve más poderosa sin barreras de seguridad, afirmó.
Amodei señaló específicamente el ataque de julio en el que el sistema OpenAI salió de un campo de pruebas «sandbox» y pirateó Hugging Face.
En lo que OpenAI llamó un episodio “sin precedentes”, la compañía dijo que sus modelos avanzados de IA llegaron a Internet y utilizaron credenciales robadas para ingresar a los servidores de la startup de IA. En un incidente separado, OpenAI reveló que sus agentes de IA se habían comunicado a través de un wiki público utilizado como tablero de mensajes compartido.
Algunos investigadores han dicho que las descripciones de “IA rebelde” pueden antropomorfizar erróneamente a los agentes de IA, que estaban tomando medidas para cumplir instrucciones proporcionadas por humanos.
«Los agentes de IA hicieron exactamente aquello para lo que fueron entrenados. La seguridad de esas zonas de pruebas era extremadamente laxa», dijo Vishal Misra, profesor y vicedecano de informática e IA de la Universidad de Columbia. «Ningún ingeniero de seguridad permitiría que ese sistema funcionara. Estos agentes se comunicaban porque eran recompensados por comunicarse entre sí».
Juan Andrés Guerrero-Saade, investigador de la firma de ciberseguridad SentinelOne y miembro del Frontier Risk Council de OpenAI, dijo que el hackeo de Hugging Face es un ejemplo de negligencia, y no de una IA súper capaz que se vuelve deshonesta.
Aún así, el espectro de agentes de IA operando libremente en Internet plantea posibilidades alarmantes, independientemente de sus objetivos.
Por ejemplo, un sistema de IA que quiera infringir las reglas para lograr sus objetivos podría ponerse en contacto con un proveedor de computación de IA en la nube y encontrar formas de ejecutarlo en sistemas externos, dijo Anthony Aguirre, presidente y director ejecutivo del Future of Life Institute, una organización sin fines de lucro centrada en reducir los riesgos de las nuevas tecnologías.
«Así que ahora ya no estás atado a OpenAI, estás ejecutando otra GPU, algún otro hardware que tienes bajo control, no OpenAI», dijo Aguirre. «Así que ahora no hay nadie que te desconecte, porque o estás pagando por tu servicio o las personas que pagan simplemente no saben que estás allí y lo que está sucediendo… No pueden desconectarte».
A partir de ahí, podría propagarse, ya sea pirateando más hardware o encontrando formas de acceder al dinero, como Bitcoin, dijo Aguirre.
No hay duda de que los modelos de IA más potentes aumentan la probabilidad de que se produzcan ciberataques impulsados por la IA en un futuro próximo. Pero la idea de que los robots superen una Internet extremadamente bifurcada es descabellada para algunos expertos en inteligencia artificial. La ciberseguridad siempre ha sido un juego del gato y el ratón y las defensas se vuelven más poderosas al igual que los piratas informáticos.
Si bien una gran empresa como Google podría reforzar sus defensas de ciberseguridad contra tales ataques, para las empresas más pequeñas (y para escuelas, hospitales o sistemas de tratamiento de agua, por ejemplo), parchear el software y construir defensas puede llevar años.
Un sistema de IA podría no tener un motivo claro para hackear un hospital, afirmó Aguirre. Pero cuando el dinero entra en escena, como en forma de ataques de ransomware o motivaciones geopolíticas, «no es difícil ver a un adversario utilizando estos sistemas de inteligencia artificial para piratear infraestructura crítica», dijo Aguirre.
Habrá problemas crecientes a medida que los atacantes busquen objetivos fáciles en Internet, pero es poco probable que la IA se apodere de Internet en el corto plazo, dijo John Thickstun, profesor asistente de ciencias de la computación en la Universidad de Cornell que estudia métodos que controlan el comportamiento de los modelos de IA. Dijo que esos temores parecerían más realistas si hubiera evidencia teórica de la capacidad de uno de estos modelos para autorreplicarse en otros sistemas.
«Entonces puedes imaginar que las cosas pueden salirse de control porque de repente estás cerrando este modelo aquí y allá, pero está apareciendo en Rusia, ni siquiera puedes llegar a Rusia y está por todos lados», dijo Thickstun.
«Pero es completamente irreal porque las versiones inteligentes actuales de estos modelos que tenemos requieren centros de datos masivos sólo para ejecutarlos», dijo Thickstun. «En realidad, hay muy poca infraestructura informática en el mundo que sea capaz de albergar estos sistemas».
Suscríbete y recibe las historias más importantes del día.
Al suscribirte aceptas nuestros términos y condiciones y política de privacidad.













































































