El sueño húmedo de todo hacker. Claude Mythos, en cuarentena. La nueva IA de Anthropic es tan peligrosa que no se atreve a lanzarla

Si eres el CIO de un medio o grupo de comunicación yo, que tú, leería esta alerta mundial por ciberseguridad. Es el sueño húmedo de todo hacker. Anthropic crea una inteligencia artificial tan peligrosa que no se atreve a lanzarla: Claude Mythos Preview.

Claude Mythos en cuarentena. Es el sueño húmedo de todo hacker. Foto: Unsplash
Anuncios
Claude Mythos en cuarentena. Es el sueño húmedo de todo hacker. Foto: Unsplash

Anthropic crea una IA tan peligrosa que no se atreve a lanzarla

La tecnológica liderada por Dario Amodei acaba de anunciar Claude Mythos Preview, su modelo más avanzado hasta la fecha.

Para ello, despliega el Project Glasswing, una iniciativa de ciberseguridad de emergencia para usar esa misma IA antes de que caiga en manos equivocadas.

En apenas unas semanas, Mythos Preview ha identificado miles de vulnerabilidades zero-day en todos los principales sistemas operativos y navegadores web.

Algunas de esas vulnerabilidades llevaban décadas sin ser detectadas, entre ellas un bug de 27 años en OpenBSD, un sistema conocido precisamente por su robustez en materia de seguridad.

Anthropic no ha entrenado este modelo para tareas de ciberseguridad. Sus capacidades son el resultado colateral de sus habilidades de razonamiento y programación. Eso es lo que lo hace distinto, y lo que lo hace preocupante.

Qué es el Project Glasswing de Anthropic para Claude Mythos

Anthropic crea el Project Glasswing para que más de 40 multinacionales usen con seguridad Claude Mythos. El proyecto reúne a doce grandes empresas tecnológicas y financieras como Amazon, Apple, Broadcom, Cisco, CrowdStrike, Google, JPMorganChase, Microsoft o Nvidia.

Anthropic ha comprometido hasta 100 millones de dólares en créditos de uso del modelo y 4 millones en donaciones directas a organizaciones de seguridad de código abierto.

El nombre hace referencia a una mariposa de alas transparentes: una metáfora de las vulnerabilidades de software, que son «relativamente invisibles» hasta que alguien sabe dónde mirar.

Sólo el 1% de los bugs potenciales lograron solucionarse

Menos del 1% de los bugs potenciales descubiertos han sido completamente parcheados hasta ahora. Anthropic ha abierto una caja que no puede cerrarse.

El plan de la empresa de Dario Amodei es lanzar antes un nuevo modelo Claude Opus para desarrollar y refinar salvaguardas con un modelo que no plantee el mismo nivel de riesgo.

Si esas salvaguardas funcionan, Mythos llegará después. Si no funcionan, el problema ya estará en la calle de todas formas, porque otras compañías desarrollarán capacidades equivalentes sin los mismos escrúpulos.

Claude Mythos podría ser la herramienta definitiva para los hackers

Los analistas dicen que Mythos tiene el potencial de convertirse en la herramienta de hacking definitiva, capaz de elevar a cualquier hacker ordinario al nivel de un adversario de estado.

Project Glasswing no es una iniciativa de relaciones públicas. Es la admisión de que la IA ha cruzado un umbral del que no hay vuelta atrás, el de ser competitiva con los mejores hackers humanos del mundo.

Claude Mythos detecta vulnerabilidades en Linux, OpenBSD, o FFmpeg

El comunicado oficial de Anthropic incluye tres casos concretos que ilustran de qué estamos hablando. En los tres, el modelo actuó de forma completamente autónoma, sin ninguna intervención humana.

El primero es un fallo de 27 años en OpenBSD, uno de los sistemas operativos más blindados del mundo, usado en cortafuegos e infraestructura crítica. La vulnerabilidad permitía a un atacante bloquear remotamente cualquier máquina con ese sistema simplemente conectándose a ella.

El segundo es un fallo de 16 años en FFmpeg, la librería que usan innumerables programas para codificar y decodificar vídeo, en una línea de código que las herramientas de pruebas automatizadas habían ejecutado cinco millones de veces sin detectar nunca el problema.

El tercero es el más inquietante. Mythos encontró y encadenó varias vulnerabilidades en el kernel de Linux, el software que ejecuta la mayoría de los servidores del mundo, para permitir a un atacante escalar desde acceso de usuario ordinario hasta el control total de la máquina.

En el benchmark CyberGym, Mythos Preview alcanza un 83,1% frente al 66,6% de Claude Opus 4.6, el modelo más avanzado disponible hasta ahora al público. No es una mejora incremental. Es otro nivel.


Síguenos en Google como fuente preferente
Suscríbete a nuestro canal de WhatsApp
Hazte Premium y apoya este proyecto periodístico
Únete a mi canal de YouTube

Anuncios

Más Noticias Relacionadas