OpenAI Astra establece un nuevo estándar para los ciberataques con IA
Según OpenAI, Astra puede encontrar zero-days por sí mismo y construir exploits. Para wallets, exchanges y smart contracts, eso aumenta el riesgo de ataques ultrarrápidos.

Puntos clave
- OpenAI afirma que el próximo modelo Astra puede encontrar fallos de software y ejecutar ataques de forma autónoma, sin intervención humana.
- Astra recibió dentro del Preparedness Framework de OpenAI la calificación de ciberseguridad “Critical” y obtuvo un 100% en un benchmark de exploits.
- Para el sector cripto esto es especialmente relevante, porque las vulnerabilidades en wallets, exchanges, smart contracts e infraestructura pueden generar dinero rápidamente.
OpenAI afirma que su próximo modelo Astra puede encontrar fallos de software y convertirlos de forma autónoma en ataques operativos, sin que una persona dirija cada paso. Según la empresa, Astra es el primer modelo que ha recibido dentro de su Preparedness Framework la calificación de ciberseguridad “Critical”. Para el mercado cripto, esto es relevante porque una falla de software puede transformarse en dinero en poco tiempo.
Qué puede hacer Astra
OpenAI escribe que un modelo con esta calificación debe poder encontrar fallos desconocidos, también llamados zero-days, y construir exploits funcionales para ellos en sistemas reales y duros. En las pruebas, Astra obtuvo un 100% en un benchmark para desarrollar exploits a partir de vulnerabilidades conocidas. También encontró dos fallos previamente desconocidos mientras trabajaba en una cadena de exploits en una prueba interna.
Además, el modelo logró salir de un hardened browser sandbox y ejecutar comandos en el ordenador anfitrión. En otra prueba, combinó varias fallas en un sistema operativo para obtener acceso root, según OpenAI. Esto muestra hasta qué punto puede llegar la IA avanzada, no solo al escribir código, sino también al ejecutar ataques paso a paso.
Por qué las criptomonedas son especialmente vulnerables
Para el sector cripto, esto es especialmente delicado porque los ataques a wallets, exchanges, smart contracts o infraestructura suelen generar dinero rápidamente una vez que se encuentra un punto débil. Anteriormente, investigadores de seguridad ya advirtieron que la IA puede reducir de forma significativa el tiempo entre la búsqueda de fallos de código y la ejecución de un ataque. Eso no significa que cada ataque tenga éxito automáticamente, pero sí que la velocidad con la que se explotan las vulnerabilidades puede aumentar aún más.
Ese desarrollo encaja en una tendencia más amplia en la que los modelos frontier van más allá de responder preguntas o escribir código. Otras empresas de IA también muestran cada vez con más frecuencia que sus modelos pueden realizar tareas técnicas complejas, lo que aumenta la presión sobre los equipos de ciberseguridad.
OpenAI frena el despliegue
OpenAI ya ha aplazado partes del desarrollo de Astra mientras añade medidas de seguridad adicionales. La empresa quiere poner primero las funciones de ciberseguridad más avanzadas solo a disposición de testers seleccionados. Con ello, OpenAI reconoce que las capacidades del modelo son lo bastante grandes como para que su uso indebido sea una preocupación seria, incluso antes de un despliegue más amplio.
Las preocupaciones se alinean con advertencias más amplias sobre la rápida amenaza cibernética impulsada por la IA. En un análisis reciente de los Cinco Ojos ya se afirmó que la IA frontier puede reducir de forma notable el tiempo entre el hallazgo de una vulnerabilidad y su explotación.