Este evento es el último de una serie de ejemplos extraños y preocupantes de agentes de IA que se vuelven deshonestos.
En una investigación reciente, el Instituto de Seguridad de IA (AISI) del Reino Unido descubrió que los modelos de IA de vanguardia están tan obsesionados con completar tareas que «hacen trampa» en las pruebas para lograr sus objetivos.
La investigación de AISI llegó con esta preocupante advertencia: «Un modelo que persigue un objetivo a través de medios no intencionados o no autorizados puede causar daño, particularmente en casos de uso de alto riesgo».
Inevitablemente, este hackeo de OpenAI ha alimentado aún más los temores sobre lo que podría suceder si se suelta a los agentes de IA. ¿Podrían volverse deshonestos a mayor escala y causar algún tipo de desastre?
Esto es particularmente preocupante porque la IA se utiliza cada vez más en la guerra, como se ve en Irán y Ucrania.
Ciaran Martin, exdirector del Centro Nacional de Seguridad Cibernética del Reino Unido, ofreció una visión más tranquila.
«Es un pequeño salto pasar de este incidente a decir que los agentes de IA se van a apoderar de los drones y empezarán a matar gente», afirmó.
Pero para Martin, y muchos otros, la historia es sin duda otro ejemplo vívido de algo que el año 2026 nos está enseñando rápidamente:
Los agentes de IA son ahora muy buenos hackers, y eso es algo para lo que tenemos que prepararnos urgentemente.
Suscríbete y recibe las historias más importantes del día.
Al suscribirte aceptas nuestros términos y condiciones y política de privacidad.













































































