Claude Mythos, la IA más peligrosa de Anthropic, está a punto de llegar a Claude Code
El modelo que encuentra vulnerabilidades críticas más rápido de lo que los desarrolladores pueden parchearlas ha aparecido en la herramienta de programación de Anthropic.
En resumen
- Usuarios detectan el identificador de Claude Mythos en Claude Code. El modelo ha encontrado más de 10.000 vulnerabilidades críticas en su primer mes con Project Glasswing.
- Mythos no solo caza bugs. En un banco asociado, el modelo ayudó a detectar y bloquear una transferencia fraudulenta de más de 1,5 millones de dólares.
- El modelo que encuentra vulnerabilidades críticas más rápido de lo que los desarrolladores pueden parchearlas ha aparecido en la herramienta de programación de Anthropic.
Varios usuarios han detectado el identificador "claude-mythos-1-preview" dentro de Claude Code y Claude Security. La aparición fue temporal, pero el mensaje es difícil de malinterpretar: Anthropic está ultimando los detalles para meter su modelo más avanzado —y más peligroso— en su herramienta para programadores. Si la empresa mantiene su ritmo habitual, la integración podría llegar en semanas.
Claude Mythos no es un modelo más. Anthropic lo presentó como una "IA de nueva frontera" con capacidades de seguridad que dejan muy atrás a Opus 4.7. Pero el dato que pone los pelos de punta es otro: Mythos puede desarrollar ciberataques funcionales de forma autónoma. La propia Anthropic reconoció que su despliegue supone un riesgo para la infraestructura digital global. Por eso frenó el lanzamiento mientras desarrolla medidas de seguridad adicionales.
El caso es que Mythos ya está en funcionamiento. A través de Project Glasswing, Anthropic colabora con unas 50 empresas para encontrar vulnerabilidades en software crítico antes de que actores maliciosos lleguen primero. Los números del primer mes son contundentes: más de 10.000 vulnerabilidades de severidad alta o crítica.
Los datos por empresa dan una idea del alcance. Cloudflare encontró 2.000 bugs en sus sistemas de ruta crítica, 400 de ellos de severidad alta o crítica, y con una tasa de falsos positivos mejor que la de testers humanos. Mozilla identificó y corrigió 271 vulnerabilidades en Firefox 150, más de diez veces lo que Claude Opus 4.6 había detectado en Firefox 148. Palo Alto Networks lanzó cinco veces más parches de lo habitual en su última actualización. Microsoft admitió que el volumen de parches "seguirá siendo más alto durante bastante tiempo". Oracle dice que está encontrando y corrigiendo fallos varias veces más rápido que antes.
Mythos no solo caza bugs. En un banco asociado, el modelo ayudó a detectar y bloquear una transferencia fraudulenta de más de 1,5 millones de dólares.
Además del trabajo con partners, Anthropic escaneó más de 1.000 proyectos de código abierto. El modelo estima que encontró 6.202 vulnerabilidades de severidad alta o crítica, de un total de 23.019 hallazgos. De las 1.752 revisadas hasta ahora por firmas independientes, el 90,6% eran verdaderos positivos. Pocas herramientas humanas se acercan a esa precisión.
El Instituto de Seguridad de IA del Reino Unido (UK AISI) ya había recortado sus estimaciones sobre el ritmo al que se duplican las capacidades cibernéticas de la IA: primero de ocho meses a 4,7. Mythos y GPT-5.5 han pulverizado incluso ese calendario acelerado. Mythos fue el primer modelo en resolver los dos campos de prácticas de ciberataque del instituto. La plataforma XBOW habló de "un gran paso adelante" y "precisión sin precedentes".
Logan Graham, jefe de red teaming de Anthropic, soltó una frase que cuesta sacarse de la cabeza: "Dentro de un año, Mythos probablemente parecerá bastante tonto". No es falsa modestia. Es una forma de decir que lo que hoy nos deja boquiabiertos será el suelo dentro de doce meses.
La cuestión ya no es si Claude Mythos va a cambiar la ciberseguridad. Ya lo está haciendo. La cuestión es qué pasa cuando estas capacidades estén a un clic de distancia para cualquiera que use Claude Code. Anthropic insiste en que desarrolla salvaguardas. Pero también ha admitido que ninguna empresa —incluida ella misma— ha construido defensas lo bastante sólidas para prevenir el uso indebido de estos modelos. No es una admisión cualquiera viniendo de quien viene.
Mythos ha encontrado más bugs en un mes de los que equipos enteros de seguridad encuentran en años. Ha pillado fraudes millonarios, ha superado simulaciones de ciberataque que ningún otro modelo había completado, y ha escaneado más de mil proyectos open source con una tasa de acierto del 90%. Que todo esto esté a punto de meterse dentro de Claude Code, la herramienta que usan miles de desarrolladores cada día, es una de esas noticias que merece la pena seguir de cerca.
Fuentes consultadas
- Hipertextual — Claude Mythos podría llegar a Claude Code
- The Decoder — Anthropic warns Claude Mythos Preview finds bugs faster than developers can patch them
- The Decoder — Mythos first AI model to clear all UK AISI cyberattack simulations
- The Decoder — Mythos resuelve el problema Erdős de OpenAI
- Anthropic — Project Glasswing
- Dot CSV Lab — CLAUDE MYTHOS, el modelo MÁS POTENTE y PELIGROSO jamás creado
- The Decoder — Anthropic briefs global financial regulators on Mythos findings