Anthropic anunció Project Glasswing, una iniciativa global de ciberseguridad que combina un modelo de inteligencia artificial no publicado —Claude Mythos Preview— con una alianza de grandes empresas tecnológicas y financieras para detectar y corregir vulnerabilidades críticas antes de que sean explotadas por atacantes.
El modelo, considerado por la propia empresa como demasiado peligroso para su liberación pública, ya ha identificado miles de fallos de seguridad de alta gravedad en sistemas clave, incluidos sistemas operativos, navegadores web y software crítico. Ante el rápido avance de la IA, Anthropic busca dar ventaja a los defensores antes de que estas capacidades lleguen a actores maliciosos.
Un modelo poderoso, pero restringido
Claude Mythos Preview es el núcleo del proyecto. Se trata de un modelo de propósito general capaz de descubrir vulnerabilidades “zero-day” —errores desconocidos incluso por los desarrolladores— y explotarlas de forma autónoma.
Anthropic ha decidido no hacerlo accesible al público. Según la empresa, el riesgo de uso indebido es demasiado alto y podría tener consecuencias graves para la economía, la seguridad pública y la seguridad nacional.
El modelo ha demostrado capacidades avanzadas: detectó una vulnerabilidad de 27 años en OpenBSD, otra de 16 años en FFmpeg, y logró encadenar fallos en el kernel de Linux para obtener control total de un sistema. Todas estas fallas ya han sido corregidas tras su notificación.
Alianza global y financiamiento millonario
El proyecto reúne a empresas como Amazon Web Services, Apple, Google, Microsoft, Nvidia y JPMorganChase, entre otras. Además, más de 40 organizaciones adicionales participan en el esfuerzo.
Anthropic ha comprometido hasta 100 millones de dólares en créditos de uso del modelo y 4 millones en donaciones a organizaciones de seguridad de código abierto.
Ventaja técnica y resultados
En pruebas de rendimiento, Mythos Preview superó ampliamente a modelos anteriores. Alcanzó un 83.1% en el benchmark CyberGym, frente al 66.6% de Claude Opus 4.6, y mostró mejoras significativas en pruebas de programación.
El modelo puede encontrar y explotar vulnerabilidades sin intervención humana, lo que representa un salto importante en la automatización de la ciberseguridad.
El reto de gestionar miles de vulnerabilidades
Detectar miles de fallos es solo una parte del problema. Gestionarlos sin colapsar a los desarrolladores —muchos de ellos voluntarios— es un desafío crítico.
Suscríbete y recibe las historias más importantes del día.
Al suscribirte aceptas nuestros términos y condiciones y política de privacidad.
Para ello, Anthropic implementó un sistema de clasificación que filtra los errores más graves y los valida manualmente antes de notificarlos. Además, evita saturar a los proyectos con reportes masivos y coordina los tiempos de divulgación.
Generalmente, la empresa espera 45 días tras publicar una solución antes de revelar los detalles técnicos, aunque este plazo puede variar según la complejidad del caso.
Problemas de confianza: errores internos recientes
El lanzamiento ocurre en medio de cuestionamientos a la seguridad interna de Anthropic. Recientemente, la empresa sufrió fallos como la filtración accidental de información estratégica y la exposición temporal de su código fuente.
Aunque la compañía asegura que no se comprometieron sistemas críticos, estos incidentes generan dudas sobre su capacidad para custodiar una tecnología tan sensible.
Evaluación de socios y resultados iniciales
Empresas como Microsoft, CrowdStrike y AWS ya han probado el modelo en sus infraestructuras. Los resultados apuntan a mejoras significativas en la detección de vulnerabilidades y reducción de tiempos de respuesta.
Expertos destacan que la IA puede cerrar la brecha entre el descubrimiento de fallos y su explotación, un proceso que ahora puede ocurrir en minutos.
Costos, infraestructura y estrategia empresarial
Tras la fase inicial, el modelo tendrá un costo elevado: 25 dólares por millón de tokens de entrada y 125 dólares por millón de salida.
Este precio refleja su alta demanda computacional. Anthropic ha asegurado acuerdos de infraestructura masiva con Google y Broadcom, con capacidad de procesamiento a escala de gigavatios.
La empresa también evalúa una posible salida a bolsa en 2026, respaldada por un crecimiento acelerado que ya supera los 30 mil millones de dólares en ingresos anualizados.
Una carrera contra el tiempo
Anthropic advierte que los defensores tienen meses, no años, antes de que estas capacidades lleguen a manos de actores maliciosos.
El proyecto busca adelantarse a ese escenario, pero la propia empresa reconoce que es solo un primer paso. La magnitud del desafío supera a cualquier organización individual.
Project Glasswing marca un punto de inflexión en la ciberseguridad impulsada por inteligencia artificial. Anthropic apuesta a que restringir y compartir estratégicamente una tecnología peligrosa puede inclinar la balanza a favor de la defensa.
Sin embargo, el éxito de esta estrategia dependerá de una carrera ya en marcha: si la transparencia y la colaboración logran adelantarse a la proliferación de estas capacidades en manos equivocadas.













































































