Usaron la IA de Anthropic para hackear OpenAI y acceder a su código interno

Un grupo de investigadores de ciberseguridad utilizó modelos avanzados de Claude para explotar dos vulnerabilidades y acceder a sistemas internos de OpenAI. La compañía corrigió los fallos y recompensó a los investigadores con US$6.500.
https://www.itsitio.com/dispositivos/airpods-con-ios-27-todas-las-nuevas-funciones-que-llegan-a-los-auriculares-de-apple/
https://www.itsitio.com/dispositivos/airpods-con-ios-27-todas-las-nuevas-funciones-que-llegan-a-los-auriculares-de-apple/
Compartir nota:

Un grupo de investigadores independientes de Hacktron AI consiguió acceder a sistemas internos de OpenAI utilizando modelos de inteligencia artificial de Claude, de Anthropic, durante una investigación realizada dentro del programa de búsqueda de vulnerabilidades de la compañía.

Los investigadores descubrieron dos vulnerabilidades que, combinadas, les permitieron avanzar desde un servicio externo utilizado por OpenAI hasta una cuenta de un empleado y, posteriormente, acceder al monorepo interno de código de OpenAI, donde se almacenan proyectos, servicios y desarrollos de la compañía.

El primer fallo correspondía a un problema de ejecución remota de código (RCE) en Discourse, la plataforma de terceros utilizada para alojar los foros de discusión de OpenAI. El segundo estaba relacionado con una configuración incorrecta del sistema de autenticación SSO utilizado en la infraestructura de identidad de la compañía.

Claude ayudó a explotar la vulnerabilidad

La investigación comenzó el 23 de julio, cuando Hacktron AI detectó un problema durante la carga de determinados formatos de imágenes en Discourse. Para analizarlo utilizaron modelos avanzados de Claude y descubrieron que algunas correcciones de seguridad no habían sido incorporadas correctamente, provocando un desbordamiento del heap buffer.

Inicialmente, los investigadores pidieron a Claude que generara un código capaz de explotar el fallo, pero el intento no tuvo éxito. Posteriormente, utilizando una versión más avanzada del modelo, consiguieron desarrollar una forma de aprovechar la vulnerabilidad.

Hacktron AI utilizó entonces ese código para acceder a un servidor de Discourse de OpenAI y obtener tokens de autenticación. Esos tokens permitieron a los investigadores hacerse con el control de una cuenta perteneciente a un empleado de OpenAI.

Del acceso a una cuenta al código privado de OpenAI

La cuenta comprometida tenía Codex conectado a la organización de OpenAI en GitHub. Los investigadores aprovecharon esta situación para enviar una solicitud a Codex con el objetivo de que generara un pull request dentro del monorepo interno de OpenAI.

De esta manera, consiguieron demostrar que podían acceder al código privado de la compañía y leer archivos internos a través de ChatGPT. Según Hacktron AI, detuvieron las pruebas antes de acceder a información sensible.

Como prueba del acceso obtenido, el pull request incluyó el texto “Hacktron AI Team PoC” dentro del repositorio y enlaces a las cuentas de algunos de los investigadores.

Un problema que podría afectar a otros servicios

Hacktron AI señaló que el problema no estaría limitado específicamente a Discourse. Según los investigadores, el riesgo estaba relacionado con el uso de OpenAI SSO, por lo que un compromiso similar podría producirse en otros servicios que utilicen este mecanismo de autenticación.

OpenAI confirmó que recibió los reportes y que los fallos fueron solucionados. La compañía también indicó que restringió los permisos de los tokens de inicio de sesión de Community y revocó los tokens y sesiones afectados.

Por su parte, Discourse también corrigió la vulnerabilidad poco después de recibir el informe de Hacktron AI. Como parte de su programa de recompensas por vulnerabilidades, OpenAI otorgó a los investigadores US$6.500 por los hallazgos.

El caso también pone de relieve el creciente papel de la IA en la investigación de vulnerabilidades. Hacktron AI sostuvo que el trabajo requirió apenas unos días de actividad de un agente de IA y unas horas de intervención humana, planteando nuevos desafíos para los sistemas de seguridad a medida que los modelos adquieren mayores capacidades para analizar código y desarrollar métodos de explotación.

Leer más

Anthropic revela que Claude ya realiza el 26% de la investigación para crear nuevos modelos de IA

Samsung inicia el lanzamiento oficial de One UI 9, llevando las últimas experiencias Galaxy a más dispositivos

AirPods con iOS 27: todas las nuevas funciones que llegan a los auriculares de Apple

Compartir nota:

Publicaciones Relacionadas

Scroll to Top