Investigadores de seguridad lograron acceder a sistemas internos de OpenAI. Para ello utilizaron Claude, el modelo de IA de su competidor Anthropic. Los investigadores actuaron dentro de un programa de recompensas por vulnerabilidades y comunicaron de inmediato los fallos detectados a OpenAI, según The Wall Street Journal.

En este tipo de programas, los investigadores de seguridad pueden buscar vulnerabilidades bajo determinadas condiciones. Si los fallos son válidos, pueden recibir una recompensa.

La investigación empezó en el foro de OpenAI

Los investigadores trabajan para la empresa de ciberseguridad Hacktron AI y comenzaron su investigación el 23 de julio. Detectaron una vulnerabilidad en Discourse, el software que sostiene el foro comunitario de OpenAI.

Los investigadores utilizaron una versión especial de Claude para expertos en seguridad con el fin de explotar el fallo. Al principio no lo consiguieron. Tras la llegada de Claude Opus 5, el modelo de IA logró, según los investigadores, escribir código funcional.

Con ello obtuvieron acceso a un servidor de Discourse de OpenAI. En ese servidor había tokens de autenticación que permitían a los usuarios mantener iniciada la sesión en servicios en línea.

Después, los investigadores descubrieron que algunos tokens también funcionaban en ChatGPT. Además, parte de ellos pertenecía a empleados de OpenAI.

Acceso a código interno

A través de los tokens, los investigadores también pudieron llegar a sistemas en GitHub. Allí accedieron a un repositorio de código de software llamado Monorepo.

Según fuentes conocedoras de la infraestructura de OpenAI, este repositorio contiene software interno relevante que permite hacer que los modelos de IA de la compañía sean más rápidos y eficientes.

Los investigadores afirman que se detuvieron en cuanto quedó claro que podían consultar información sensible. Aun así, presentaron una solicitud de modificación de un documento para demostrar que realmente habían obtenido acceso.

OpenAI asegura que su investigación concluyó que hubo una «visualización limitada» de metadatos y cambios de código en repositorios internos. Las vulnerabilidades ya han sido corregidas.

OpenAI refuerza su seguridad

OpenAI pagó a Hacktron AI una recompensa de 6.500 dólares por informar de los problemas. Discourse afirma que corrigió su propia vulnerabilidad el 25 de julio, el mismo día en que fue notificada.

Según investigadores de seguridad, el hallazgo demuestra que la IA facilita cada vez más encontrar y explotar fallos de software. Mohan Pedhapati, director tecnológico de Hacktron AI, advierte de que actores mucho más potentes pueden disponer de la misma tecnología.

«No creo que seamos tan buenos como los hackers chinos», dice Pedhapati. «Solo somos tres tipos con suscripciones a Claude y Codex».

Tras varios incidentes de seguridad, OpenAI llevó a cabo una revisión exhaustiva de sus sistemas. Según el cofundador Greg Brockman, durante un tiempo se destinó el 25% de los desarrolladores de software a tareas de seguridad. En ese proceso, afirma, se encontraron y resolvieron varios problemas graves.

hacker

Hackers roban 4.000 bitcoins con cupones: «deja al descubierto una vulnerabilidad crítica»

hacker
Claude, Anthropic
Ciberataque de un hacker
Más Hack news

Más leídos

Capitolio de EE. UU.
Elon Musk XAI, Grok
Miembros del Senado de Estados Unidos escuchan en una sala de reuniones clásica