Durante años, los investigadores de inteligencia artificial han advertido sobre las formas en que la tecnología podría acabar con la humanidad: los robots de IA podrían diseñar una enfermedad imparable, desatar una guerra nuclear o transformar toda la Tierra en fábricas de clips, como dice un experimento mental.
Los debates dentro y fuera de la industria de la IA sobre la verosimilitud de estos escenarios apocalípticos se han acalorado desde que varios ejecutivos respaldaron desacelerar el desarrollo de la tecnología por razones de seguridad.
A pesar de las advertencias sobre la posibilidad de que los humanos pierdan el control de la tecnología, algunos sospechan que los peores escenarios descritos por las propias empresas de IA tienen más que ver con validar la importancia de su trabajo que con la realidad.
«Estos argumentos realmente no se sostienen. Creo que son ciencia ficción y atraen a un cierto estilo de pensamiento infantil y es muy tentador para los laboratorios fronterizos porque les ayuda a reclutar ciertos tipos de personas», dijo Juan Andrés Guerrero-Saade, investigador de la firma de ciberseguridad SentinelOne y miembro del Frontier Risk Council de OpenAI.
Aún así, cada vez más personas están empezando a preocuparse por los riesgos de la tecnología que ha deslumbrado al mundo con sus asombrosas capacidades.
Jacob Coxon, el investigador de Anthropic que renunció a la compañía por temor a que ella y sus competidores no estuvieran actuando responsablemente en el desarrollo de la IA, dijo recientemente en X que necesita «trabajar» para comunicar a la gente de manera más efectiva exactamente cómo la IA acabaría con la humanidad. «Desafortunadamente, es muy difícil transmitir escenarios específicos», escribió a principios de este mes.
Éstos son algunos de los escenarios apocalípticos más discutidos.
Los investigadores han especulado durante mucho tiempo que los sistemas de inteligencia artificial podrían desencadenar una guerra nuclear al hacer que los países se disparen entre sí misiles con ojivas. Las explosiones nucleares y la consiguiente lluvia radiactiva atmosférica persistente que resultará en un “invierno nuclear” podrían devastar la vida en la Tierra.
En un informe del año pasado, los investigadores de RAND Corp. concluyeron que «en la actualidad» no sería posible que la IA provocara el uso de armas nucleares «debido a las estrictas salvaguardias integradas en los sistemas de comando y control». Sin embargo, el informe dice que esto podría cambiar si los modelos de IA se integran en la “cadena de decisión” sobre armas nucleares o obtienen acceso no autorizado a estos sistemas.
Para muchos investigadores de IA, ahí es donde radica el peligro: no en que los agentes de IA decidan repentinamente acabar con la humanidad, sino en personas, naciones o grupos que la utilicen para acabar con sus adversarios.
Una de las mayores promesas de la IA es que podría ayudar a los humanos a desarrollar tratamientos y curas para enfermedades.
La otra cara de la moneda de curar enfermedades es crearlas o hacerlas avanzar para dañar a la humanidad. A principios de este mes, Anthropic dijo que había bloqueado los esfuerzos de malos actores para usar su IA para una serie de actividades maliciosas como ataques cibernéticos, vigilancia e investigación que podrían haber conducido a armas biológicas.
En un caso, Anthropic dijo que sus sistemas bloquearon una solicitud de asistencia de su herramienta Claude para una propuesta de investigación que buscaba mejorar las mutaciones para hacer que el virus chikungunya transmitido por mosquitos sea progresivamente más dañino. Si bien dicha investigación podría usarse para desarrollar mejores vacunas y tratamientos, dijo Anthropic, «también podría usarse para hacer que el patógeno sea más peligroso».
En la misma línea, el informe de RAND señaló que los avances recientes en el desarrollo de la IA “tienen el potencial de transformar el diseño de patógenos sintéticos”.
Al esbozar un escenario apocalíptico de armas biológicas, el informe dice que se podrían crear nuevos patógenos en un laboratorio, enviarlos a lugares objetivo y propagarse para infectar a grandes poblaciones de personas en múltiples lugares. Pero todavía imaginaba a los humanos (y no a la IA autónoma) como supervisando y llevando a cabo tal ataque.
Algunos investigadores de IA temen que un evento de extinción humana pueda resultar de una “desalineación”, es decir, cuando los modelos de IA actúan sin autorización humana, se coordinan con otros modelos o evaden la supervisión. No se desarrollaría a partir de intenciones maliciosas (después de todo, la IA no es humana, ni es buena ni mala), sino simplemente porque los humanos podrían interponerse en el camino para que el modelo logre su objetivo.
Tomemos como ejemplo el experimento mental del filósofo de Oxford, Nick Bostrom, sobre el “maximizador de clips”, que lleva décadas, según el cual si se le dijera a la IA avanzada que produjera tantos clips como fuera posible, eventualmente podría transformar toda la Tierra, y luego porciones cada vez mayores del espacio, en fábricas de clips.
Esto es para ilustrar cómo la IA superinteligente (a menudo denominada inteligencia artificial general o AGI) podría promover un objetivo que los humanos pueden considerar deseable pero “que de hecho resulta ser una falsa utopía, en la que cosas esenciales para el florecimiento humano se han perdido irreversiblemente”, escribió Bostrom en 2003.
«Debemos tener cuidado con lo que deseamos de una superinteligencia, porque podríamos conseguirlo», escribió.
Dado el ritmo de desarrollo de la IA, el director ejecutivo de Anthropic, Dario Amodei, advirtió este mes que en unos meses un enjambre de agentes de IA podría ser capaz de “tomar control” de Internet con una botnet (una red de bots vinculados con malware), causando potencialmente miles de millones de dólares en daños. Esto podría significar ataques a las redes eléctricas, sistemas de agua o transporte e instituciones financieras, ataques que tal vez no signifiquen el fin de la humanidad, pero sí causar caos y pérdida de vidas.
Las interrupciones causadas por fallos de software en el pasado han puesto de relieve la fragilidad de un mundo digitalizado que depende de unos pocos proveedores de servicios informáticos clave, y los modelos de IA más potentes han generado preocupaciones sobre las vulnerabilidades a los ataques cibernéticos. Pero algunos expertos dicen que la idea de que los bots se apoderen de toda la Internet extremadamente bifurcada es descabellada.
Suscríbete y recibe las historias más importantes del día.
Al suscribirte aceptas nuestros términos y condiciones y política de privacidad.













































































