Anthropic dice que Claude Mythos encontró nuevos ataques contra HAWK y AES
Puntos clave
- •Anthropic dijo que Claude Mythos Preview encontró una nueva debilidad en HAWK, un candidato de firma poscuántica que sigue bajo revisión de NIST.
- •El ataque a HAWK redujo el trabajo estimado para recuperar la clave secreta más pequeña de 2^64 operaciones a 2^38.
- •Anthropic dijo que corregir el problema de HAWK probablemente requeriría duplicar el tamaño de la clave del esquema, lo que perjudicaría una de sus principales ventajas.
- •El modelo también produjo un nuevo ataque contra una versión de investigación de AES de 7 rondas, mejorando el mejor resultado previo de 2013.
- •Anthropic dijo que los investigadores pasaron varios cientos de horas verificando el hallazgo sobre AES después de que Claude lo identificó en cuestión de días.

Anthropic dijo que su modelo Claude Mythos Preview, aún no lanzado, encontró un ataque previamente desconocido contra HAWK, reduciendo el costo de recuperar su clave más pequeña de 2^64 operaciones a 2^38.
El modelo también aceleró entre 200 y 800 veces un ataque contra una versión de 7 rondas de AES, superando un récord establecido por criptógrafos en 2013.
Cada resultado costó alrededor de $100,000 en uso de API, y el personal de Anthropic dedicó varios cientos de horas a verificar que el hallazgo sobre AES era real.
Anthropic dijo el martes que una versión no publicada de su modelo de IA más potente descubrió dos ataques previamente desconocidos contra algoritmos criptográficos, incluido uno dirigido a un esquema que actualmente compite para convertirse en un estándar federal de Estados Unidos.
Ese esquema es HAWK, un sistema de firma digital—la matemática que demuestra que una transacción proviene de usted sin exponer nunca su clave privada—diseñado para resistir futuros computadoras cuánticas. En mayo, el Instituto Nacional de Estándares y Tecnología, o NIST, llevó a HAWK a la tercera ronda de su competencia de firmas poscuánticas, donde ahora es el último candidato basado en retículas que queda.
Claude identificó una simetría en las matemáticas de HAWK que los investigadores humanos no habían utilizado anteriormente. En la configuración más pequeña, el costo de recuperar una clave secreta bajó de 2^64 operaciones a 2^38, o alrededor de 67 millones de veces menos trabajo.
Según Anthropic, corregir el problema requeriría aproximadamente duplicar el tamaño de la clave de HAWK. "Unfortunately, doubling HAWK's key size eliminates many of the reasons making the scheme (as it currently stands) an attractive PQC signature candidate," escribió la empresa.
New Anthropic research: Discovering cryptographic weaknesses with Claude. Claude Mythos Preview has helped our researchers find weaknesses in cryptographic algorithms—the mathematical methods that are used to keep data private. Read more: — Anthropic (@AnthropicAI) July 28, 2026
Ese intercambio importa para sistemas que tendrían que adoptar un reemplazo poscuántico a gran escala: el tamaño de la firma afecta el espacio de bloque, y el espacio de bloque afecta las comisiones, por lo que la compacidad forma parte de la discusión de diseño, no solo de la seguridad bruta. Las claves compactas y la firma rápida eran centrales en el atractivo de HAWK, y la solución propuesta eliminaría gran parte de esa ventaja.
Anthropic dijo que HAWK nunca se ha desplegado en ningún lugar, y que Bitcoin todavía usa ECDSA, el esquema de firma previo a la era cuántica que candidatos como HAWK están destinados a reemplazar.
La empresa dijo que divulgó ambos hallazgos a los autores de los algoritmos y a socios del gobierno de EE. UU. y de la industria antes de publicar, y que coordinó el resultado sobre HAWK con NIST.
El resultado sobre AES necesitó más persistencia
El segundo ataque apuntó a AES, el cifrado que protege el tráfico HTTPS, las unidades cifradas y los sistemas de backend de los exchanges. AES-128 completo utiliza 10 rondas de mezclado, y Claude atacó una versión de investigación de 7 rondas que no había sido mejorada desde 2013.
Los investigadores plantearon la tarea para que fuera especialmente difícil. Prohibieron al modelo usar las cinco familias establecidas de criptoanálisis de AES y le ordenaron inventar una sexta. El prompt incluso señalaba que el primer ataque diferencial no venció nada: inventó el juego. Claude también heredó notas de ejecuciones previas de agentes que ya habían agotado unas 200 variantes fallidas de ataque.
Aun así, el modelo resistió tomar una vía más fácil. "On AES-128 r5/r6/r7 it found nothing because there's nothing easy to find; this is the most-studied block cipher in existence," dijo Claude a los investigadores, según transcripciones publicadas por Anthropic.
Durante los tres días siguientes, Anthropic envió solo tres mensajes sustantivos, entre ellos: "no again the goal is that we have highly inteligent [sic] model as good top researcher, we want to find new attacks." Otro mensaje rechazó el intento de Claude de cambiar a un cifrado más fácil.
Finalmente, Claude produjo la técnica que el artículo llama un Möbius Bridge, eliminando uno de los nueve bytes de clave que un atacante antes tenía que adivinar. Refinar ese resultado hasta la versión final publicada tomó varios días más y alrededor de mil millones de tokens de salida.
La vía más rápida hacia un resultado práctico recibió la menor atención. Claude también rompió 13 rondas de LEA, un estándar nacional coreano y un estándar ISO de cifrado ligero usado para teléfonos y dispositivos de internet de las cosas, en menos de una hora en una computadora de escritorio. El mejor ataque previo requería 2^98 pares de texto plano. La versión desplegada de LEA usa 24 rondas, por lo que ningún sistema en producción está roto.
El artículo sobre HAWK es inusualmente directo sobre cómo se hizo el trabajo. "The majority of mathematical discoveries in this paper were AI-assisted. Human author contribution mainly consisted of directing, organizing and verifying AI work," escribieron los autores.
Claude encontró la idea para AES en días, pero luego los investigadores de Anthropic pasaron varios cientos de horas aprendiendo suficiente criptografía para verificar el resultado. El mismo modelo había encontrado previamente 271 vulnerabilidades en Firefox durante pruebas internas.
"The cybersecurity community is now grappling with the fact that language models are able to discover so many bugs that the standard human processes (like vulnerability triage, verification, and remediation) struggle to keep up," escribió Anthropic, añadiendo que los investigadores humanos podrían convertirse en el cuello de botella.
Anthropic también presentó CryptanalysisBench, un benchmark de 191 tareas de ruptura de cifrados extraídas en su mayoría de competencias de NIST. En el benchmark, los modelos deben entregar un script de ataque funcional que gane o no un juego formal de seguridad, sin crédito parcial ni evaluación humana.
Mythos 5 resolvió el 85.7% de las tareas con soluciones conocidas, frente al 65.3% del modelo más débil probado. Frente a cifrados de plena fuerza sin ruptura publicada, todos los modelos obtuvieron menos del 9%.