El próximo modelo de IA de OpenAI, Astra, puede detectar por sí solo vulnerabilidades desconocidas en software. El modelo es capaz de encontrar los llamados zero-days, fallos que ni siquiera el desarrollador conoce todavía. Después, Astra también puede averiguar cómo explotar esa vulnerabilidad sin que una persona tenga que guiarlo paso a paso.
Se trata de un avance notable. Astra no solo analiza problemas de seguridad ya conocidos, sino que busca de forma autónoma nuevas debilidades en el software. Por eso, OpenAI califica sus capacidades cibernéticas como “críticas” dentro de su propio Preparedness Framework.
Astra detecta por sí solo zero-days desconocidos
Los zero-days figuran entre las vulnerabilidades de software más peligrosas. El desarrollador aún no sabe que el problema existe y, por lo general, no tiene preparada una actualización de seguridad.
Si un atacante encuentra antes ese fallo, puede intentar explotarlo antes de que sea corregido.
En pruebas internas, Astra demostró que realmente puede descubrir este tipo de vulnerabilidades. Según OpenAI, el modelo encontró dos fallos de software hasta entonces desconocidos mientras intentaba combinar varias debilidades.
En otra prueba, Astra logró una puntuación del 100% al desarrollar métodos para explotar vulnerabilidades conocidas.
Precisamente esa combinación hace que el modelo sea potente. Astra no solo puede encontrar un fallo, sino también investigar si varios errores, combinados, permiten acceder a un sistema. Un trabajo que normalmente requiere investigadores de seguridad experimentados puede automatizarse cada vez más.
Astra escapa de un entorno protegido
Otra prueba muestra hasta dónde llegan esas capacidades. OpenAI colocó a Astra en una sandbox de navegador protegida, un entorno aislado diseñado precisamente para impedir que el software acceda al resto del ordenador.
Según OpenAI, Astra logró salir de ese entorno y ejecutar después órdenes en el sistema subyacente.
El modelo también encontró varias vulnerabilidades en un sistema operativo y las combinó hasta obtener acceso root. Se trata del nivel de acceso más alto en muchos sistemas informáticos y otorga un control prácticamente total.
Los resultados llevaron a OpenAI a extremar la cautela. La empresa ha retrasado partes del desarrollo y ha adoptado medidas de seguridad adicionales. Por ahora, las capacidades cibernéticas más avanzadas solo estarán disponibles para un grupo reducido de evaluadores.
La empresa neerlandesa de IA Euclyd capta 200 millones para competir con Nvidia
La empresa neerlandesa de inteligencia artificial Euclyd ha captado 200 millones de euros de inversores como Samsung y quiere plantar cara directamente a Nvidia con sus propios chips.
EE UU tiene armas en el espacio: lo que pueden hacer sigue siendo secreto
Estados Unidos confirma por primera vez que tiene armas en el espacio, mientras China advierte de una nueva carrera armamentística.
El rey Carlos reúne en palacio a Nvidia, OpenAI y Anthropic para una cumbre sobre IA
El rey Carlos convoca a altos ejecutivos de la IA para abordar la seguridad ante la creciente preocupación por modelos cada vez más potentes.
Más leídos
La probabilidad de aprobar la CLARITY Act cae al 18% antes de una votación clave
La probabilidad de aprobación de la CLARITY Act cae al 18%, mientras destacados demócratas se posicionan en contra de la propuesta.
Grok, de Elon Musk, anticipa el precio de XRP para finales de septiembre
Grok prevé que el precio de XRP se sitúe a finales de septiembre en torno a 1,45-1,60 dólares, aunque también ve margen para una subida mayor.
La gran ley cripto de EE. UU. se acerca al desenlace: todo o nada
La ley cripto CLARITY Act afronta el martes una votación decisiva en el Senado. Sin el apoyo de 7 demócratas, todo podría aplazarse hasta 2030.