En resumen
- Anthropic dijo que su modelo no publicado Claude Mythos Preview encontró un ataque previamente desconocido contra HAWK, reduciendo el costo de robar su clave más pequeña de 2^64 operaciones a 2^38.
- El modelo también aceleró un ataque contra una versión de 7 rondas de AES entre 200 y 800 veces, superando un récord que los criptógrafos establecieron en 2013.
- Cada resultado costó aproximadamente $100,000 en uso de API, y el personal de Anthropic dedicó varios cientos de horas para verificar que el trabajo sobre AES fuera real.
Anthropic dijo hoy que una versión no publicada de su modelo de IA más potente encontró dos ataques previamente desconocidos contra algoritmos criptográficos, uno de ellos contra un esquema que actualmente compite para convertirse en un estándar federal de EE. UU.
Ese esquema es HAWK, un sistema de firma digital—las matemáticas que demuestran que una transacción proviene de ti sin exponer jamás tu clave privada—diseñado para sobrevivir a futuras computadoras cuánticas. La agencia federal no reguladora y laboratorio NIST lo movió a la tercera ronda de su competencia de firmas post-cuánticas en mayo, donde es el último candidato basado en retículas en pie.
Claude encontró una simetría oculta en las matemáticas de HAWK que ningún humano había pensado en usar. Para la configuración más pequeña, el costo de recuperar una clave secreta cayó de 2^64 operaciones a 2^38, aproximadamente 67 millones de veces menos trabajo.
Arreglarlo significa aproximadamente duplicar las claves de HAWK. "Desafortunadamente, duplicar el tamaño de la clave de HAWK elimina muchas de las razones que hacen que el esquema (tal como está actualmente) sea un candidato atractivo de firma PQC", escribió Anthropic.
Nueva investigación de Anthropic: Descubriendo debilidades criptográficas con Claude.
Claude Mythos Preview ha ayudado a nuestros investigadores a encontrar debilidades en algoritmos criptográficos—los métodos matemáticos que se utilizan para mantener los datos privados.
Leer más: https://t.co/TYKLjb3Q7V
— Anthropic (@AnthropicAI) 28 de julio de 2026
Ese intercambio importa más a las blockchains de lo que parece. El tamaño de la firma es espacio de bloque, y el espacio de bloque son comisiones, por lo que cualquier cadena que busque un reemplazo resistente a la computación cuántica está eligiendo en parte según los bytes por firma. Las claves compactas y la firma rápida eran todo el argumento de HAWK, y el arreglo le cuesta gran parte de esa ventaja.
No se preocupen, hodlers: Sus monedas están bien (por ahora). HAWK nunca se ha desplegado en ningún lugar, y Bitcoin todavía funciona con ECDSA, el esquema de firma pre-cuántico que candidatos como HAWK eventualmente pretenden reemplazar.
Anthropic divulgó ambos resultados a los autores de los algoritmos y a socios gubernamentales e industriales de EE. UU. antes de publicarlos, y coordinó el hallazgo de HAWK con el NIST.
El resultado de AES necesitó una charla motivacional
El segundo ataque se dirige a AES, el cifrado que codifica tu tráfico HTTPS, tu disco cifrado y el backend de tu exchange. El AES-128 completo empuja los datos a través de 10 rondas de codificación, y Claude atacó una versión de investigación de 7 rondas que nadie ha mejorado desde 2013.
La configuración fue deliberadamente dura. Los investigadores prohibieron al modelo las cinco familias establecidas de criptoanálisis de AES y le dijeron que inventara una sexta, cerrando el informe con una línea sobre cómo el primer ataque diferencial no superó nada: inventó el juego. Claude también heredó notas de trabajo de ejecuciones de agentes anteriores que ya habían agotado aproximadamente 200 variantes de ataque fallidas.
Se negó de todos modos. "En AES-128 r5/r6/r7 no encontró nada porque no hay nada fácil de encontrar; este es el cifrado de bloque más estudiado que existe", dijo el modelo a los investigadores, según las transcripciones que publicó Anthropic.
Anthropic envió solo tres mensajes sustanciales durante los siguientes tres días, entre ellos: "no, de nuevo, el objetivo es que tengamos un modelo altamente inteligente [sic] tan bueno como un investigador de primer nivel, queremos encontrar nuevos ataques". Otro se negó a permitir que Claude cambiara AES por un cifrado más fácil.
Entonces produjo el truco que el artículo llama un Puente de Möbius, eliminando uno de los nueve bytes de clave que un atacante anteriormente tenía que adivinar. Refinar eso hasta la versión publicada tomó unos días más y mil millones de tokens de salida.
El hallazgo con el camino más corto hacia algo real recibió la menor atención. Claude también rompió 13 rondas de LEA, un estándar nacional coreano y estándar ISO de cifrado ligero diseñado para teléfonos y dispositivos de Internet de las cosas, en menos de una hora en un escritorio contra un mejor anterior que necesitaba 2^98 pares de texto plano. El LEA implementado ejecuta 24 rondas, por lo que nada en el campo está roto.
La verificación tomó más tiempo que el descubrimiento
El artículo de HAWK es inusualmente directo sobre la división del trabajo. "La mayoría de los descubrimientos matemáticos en este artículo fueron asistidos por IA. La contribución principal de los autores humanos consistió en dirigir, organizar y verificar el trabajo de la IA", escribieron sus autores.
Claude encontró la idea de AES en días. Los investigadores de Anthropic luego pasaron varios cientos de horas aprendiendo suficiente criptografía para confirmar que funcionaba: el mismo modelo que encontró 271 vulnerabilidades en Firefox durante las pruebas internas.
"La comunidad de ciberseguridad ahora está lidiando con el hecho de que los modelos de lenguaje son capaces de descubrir tantos errores que los procesos humanos estándar (como la clasificación de vulnerabilidades, la verificación y la remediación) luchan por mantenerse al día", escribió Anthropic, advirtiendo que los investigadores humanos pueden convertirse en el cuello de botella.
Anthropic también construyó CryptanalysisBench—191 tareas de descifrado de códigos extraídas en su mayoría de las competiciones de NIST. Los modelos envían un script de ataque funcional que o gana un juego de seguridad formal o no, sin crédito parcial y sin calificación humana.
Mythos 5 rompió el 85.7% de las tareas con soluciones conocidas, frente al 65.3% del modelo más débil probado. Contra cifrados de fuerza completa sin ruptura publicada, todos los modelos obtuvieron menos del 9%.






