
Durante la revisión de seguridad de OpenAI, los investigadores de Hacktron AI, con la ayuda del modelo Claude, pudieron acceder a parte de la infraestructura interna de la empresa. El incidente ocurrió el 23 de julio de 2026 en el marco de un programa de búsqueda de vulnerabilidades, tras lo cual el equipo informó del problema encontrado a OpenAI y recibió $6500. El punto de partida fue un servicio externo, Discourse, utilizado para el foro de la comunidad de OpenAI. Los investigadores descubrieron un error al procesar ciertos archivos de imagen y solicitaron una versión especial de Claude Opus 4.8 para preparar el código para su explotación. El primer intento fue fallido, sin embargo, después del lanzamiento de Claude Opus 5, el modelo ya al día siguiente propuso una forma efectiva de utilizar la vulnerabilidad.
El código obtenido permitió a los investigadores infiltrarse en el servidor Discourse, donde se encontraban los tokens de autenticación de los usuarios. Entre ellos se encontraban credenciales activas de empleados de OpenAI, que también abrían acceso al GitHub corporativo. Como resultado, el equipo pudo leer datos en el repositorio interno Monorepo. Según fuentes familiarizadas con la arquitectura de OpenAI, allí se almacena parte del código de programación y soluciones algorítmicas utilizadas para mejorar la eficiencia de los modelos. Sin embargo, los pesos de los modelos de IA, que representan enormes conjuntos de parámetros numéricos, no se encontraban en Monorepo. Tras descubrir información sensible, los investigadores detuvieron sus acciones. Antes de eso, lograron crear un pull request con la propuesta de cambiar la documentación y agregar una nota sobre la investigación realizada, sin embargo, los cambios no se incorporaron al repositorio. OpenAI informó que detectó una lectura limitada de metadatos de repositorios privados y cambios en el código. La vulnerabilidad en Discourse fue corregida el 25 de julio.
El caso se convirtió en un ejemplo de cómo la IA puede ser utilizada no solo para proteger sistemas, sino también para encontrar formas de explotar sus puntos débiles. El director técnico de Abundant Security, Joshua Sachs, señaló que la automatización de tales tareas puede expandir significativamente el círculo de personas capaces de realizar un análisis complejo de vulnerabilidades. El CTO de Hacktron AI, Mohan Pedhapati, también destacó que un pequeño equipo con acceso a servicios comerciales de IA ahora puede investigar grandes sistemas corporativos. Tras el incidente, OpenAI realizó una auditoría de seguridad adicional y redistribuyó temporalmente alrededor de una cuarta parte de los ingenieros de producción a tareas de protección de infraestructura. La empresa también continúa desarrollando mecanismos de monitoreo y detención automática de sistemas de IA en caso de comportamiento peligroso, y durante las pruebas limita su acceso a recursos externos.





