OpenAI pagó 6.500 dólares a la empresa de ciberseguridad Hacktron AI después de que tres investigadores utilizaran Claude, el modelo de Anthropic, para detectar y explotar una vulnerabilidad en sistemas internos de la compañía. El acceso permitió consultar de forma limitada metadatos y cambios de código en repositorios internos, según la investigación de OpenAI citada por The Wall Street Journal.
El hallazgo se produjo dentro del programa de recompensas por vulnerabilidades de OpenAI. Estos programas permiten a investigadores externos buscar fallos bajo determinadas condiciones y recibir una compensación cuando comunican problemas válidos a la compañía. En este caso, los investigadores informaron de inmediato a OpenAI y aseguran que dejaron de avanzar cuando comprobaron que podían acceder a información sensible.
El fallo estaba en el software del foro de OpenAI
La investigación comenzó el 23 de julio en el foro comunitario de OpenAI, construido sobre Discourse. Los miembros de Hacktron AI identificaron una vulnerabilidad en este software e intentaron explotarla con una versión de Claude orientada a expertos en seguridad.
Los primeros intentos no tuvieron éxito. Sin embargo, según los investigadores, la llegada de Claude Opus 5 permitió al modelo escribir código funcional para aprovechar el fallo. Con ese código consiguieron entrar en un servidor de Discourse utilizado por OpenAI.
En el servidor encontraron tokens de autenticación. Estas credenciales permiten a los usuarios mantener abiertas sus sesiones en distintos servicios en línea. Los investigadores comprobaron después que algunos de esos tokens también funcionaban en ChatGPT y que una parte pertenecía a empleados de OpenAI.
El acceso no se quedó en la infraestructura del foro. Los tokens permitieron llegar a sistemas de GitHub y consultar un repositorio interno de código conocido como Monorepo. De acuerdo con fuentes familiarizadas con la infraestructura de OpenAI, ese repositorio contiene software relevante para mejorar la velocidad y la eficiencia de los modelos de inteligencia artificial de la compañía.
Acceso limitado y vulnerabilidades corregidas
Hacktron AI sostiene que se detuvo al quedar claro que podía consultar información sensible. Para demostrar ante OpenAI que el acceso se había producido, los investigadores presentaron una solicitud de modificación de un documento. La compañía afirmó posteriormente que su revisión solo detectó una «visualización limitada» de metadatos y cambios de código en repositorios internos.
Discourse corrigió la vulnerabilidad el 25 de julio, el mismo día en que recibió la notificación. OpenAI también señaló que los problemas relacionados con el acceso ya habían sido solucionados.
El caso ilustra, según los investigadores, cómo los modelos de IA pueden ayudar a localizar y explotar fallos de software. Mohan Pedhapati, director tecnológico de Hacktron AI, advirtió de que grupos con más recursos pueden tener acceso a herramientas similares. «No creo que seamos tan buenos como los hackers chinos», afirmó. «Solo somos tres tipos con suscripciones a Claude y Codex».
La revisión interna de OpenAI
El incidente se produce después de varios problemas de seguridad que llevaron a OpenAI a revisar de forma amplia sus sistemas. Greg Brockman, cofundador de la compañía, explicó que durante un periodo se destinó el 25% de los desarrolladores de software a tareas de seguridad. Según su versión, ese proceso permitió encontrar y resolver varios problemas graves.
La recompensa de 6.500 dólares se suma así a las medidas adoptadas por OpenAI para reforzar sus sistemas, mientras el uso de modelos de IA en investigaciones de seguridad abre una nueva dimensión en los programas de detección de vulnerabilidades.











