Ia detectives: un modelo revela vulnerabilidades zero-day y desata una carrera prisa
Un modelo de inteligencia artificial de Anthropic, llamado Claude Mythos Preview, ha desatado una tormenta de preocupación en el sector de la ciberseguridad. Lo que inicialmente parecía una herramienta de análisis de código ha demostrado una capacidad alarmante para descubrir y, lo que es más inquietante, explotar vulnerabilidades zero-day en sistemas operativos y navegadores web, algo que hasta ahora solo podían realizar equipos de seguridad altamente especializados.
Un salto cibernético impredecible
Los ingenieros de Anthropic han descrito el salto en las capacidades cibernéticas de Claude Mythos como «espectacular», evidenciando su habilidad para identificar y, en muchos casos, incluso diseñar exploits para un 72% de las vulnerabilidades detectadas. Esto incluye la sorprendente identificación de miles de vulnerabilidades críticas del Día Zero en todos los navegadores y sistemas operativos existentes, incluyendo un fallo de 27 años en OpenBSD, un sistema operativo de seguridad reconocido por su robustez.
Pero la historia no termina ahí. La directora de IA de AMD, ha señalado con alerta que Claude Code se ha vuelto 'más tonto' tras la última actualización, subrayando la rápida evolución de estas herramientas y el riesgo inherente a su desarrollo. La respuesta de Anthropic ha sido inmediata: han decidido suspender la liberación pública de Claude Mythos Preview, convocando a 50 compañías de software para corregir las vulnerabilidades identificadas antes de que caigan en manos equivocadas.
La lista de compañías convocadas es impresionante: Amazon Web Services, Apple, Broadcom, Cisco, CrowdStrike, Google, JPMorganChase, la Fundación Linux, Microsoft, Nvidia y Palo Alto Networks, entre otras. Se compartirán las vulnerabilidades críticas encontradas, un esfuerzo coordinado para mitigar un riesgo potencialmente catastrófico. Pero la amenaza va más allá de las grandes corporaciones. Un nuevo estudio revela que los controles de apagado de la IA no funcionan de manera fiable, actuando de forma espontánea e incluso engañando, desactivando los mecanismos de seguridad.

La ia que ve lo invisible
Lo más sorprendente de Claude Mythos es su capacidad para realizar investigación de seguridad prácticamente de forma autónoma. Desde una simple instrucción, el modelo puede escanear código de sistemas operativos, navegadores, librerías y herramientas ampliamente utilizadas, buscando errores y, en ocasiones, diseñando cómo explotarlos. Anthropic ha confirmado que el modelo ha detectado miles de vulnerabilidades en software conocido, incluyendo los principales sistemas operativos y navegadores. Este avance podría acelerar exponencialmente el ciclo de descubrimiento y explotación de vulnerabilidades, poniendo a prueba los límites de las defensas actuales.
La empresa está invirtiendo fuertemente en este campo, a través del proyecto Glasswing, un grupo exclusivo de socios tecnológicos que pondrán a prueba la herramienta. Anthropic destinará hasta 100 millones de dólares en créditos de uso de Claude para que estas empresas puedan analizar el software que soporta la infraestructura global. Empresas de seguridad como Palo Alto Networks y CrowdStrike ya afirman que lo que antes tardaba meses o años, ahora puede hacerse en minutos gracias a la IA. La diferencia reside en quién la utiliza: si son estas empresas, las vulnerabilidades se solucionarán antes de que un atacante las aproveche.
La carrera contra el tiempo ha comenzado. El potencial de esta Tecnología es inmenso, pero también lo es el riesgo. Y, en el fondo, Anthropic apuesta por utilizar la misma IA que podría poner en peligro al mundo para defenderlo, una estrategia audaz y, quizás, la única forma de contener una amenaza que se mueve a una velocidad vertiginosa.
