Una investigación de seguridad identificó vulnerabilidades en servicios de OpenAI que permitieron acceder a cuentas de empleados y demostrar conexión con un repositorio interno de código.
México
Investigadores utilizan Claude para encontrar vulnerabilidades
Un equipo de tres investigadores de Hacktron AI identificó vulnerabilidades en la infraestructura de OpenAI mediante el uso de herramientas de inteligencia artificial de Anthropic, entre ellas Claude Opus 4.8 y Claude Opus 5.
La investigación comenzó el 23 de julio de 2026 como parte de un programa de recompensas por errores (bug bounty) y permitió demostrar una cadena de vulnerabilidades que llevó desde el foro comunitario de OpenAI hasta cuentas de empleados y servicios internos.
Detectan vulnerabilidad en el procesamiento de imágenes
El primer punto identificado por los investigadores se encontraba en el foro comunitario de OpenAI, alojado mediante Discourse.
La falla estaba relacionada con el procesamiento de imágenes en formato HEIF/HEIC y con la biblioteca libheif. De acuerdo con la investigación, esta vulnerabilidad podía permitir la ejecución de código en el servidor encargado de procesar las imágenes.
Posteriormente, los investigadores encontraron un problema relacionado con el sistema de inicio de sesión único, conocido como SSO, de OpenAI.
Acceden a cuentas de empleados
La combinación de ambas vulnerabilidades permitió obtener tokens de autenticación que podían utilizarse para acceder a cuentas de ChatGPT y Codex pertenecientes a empleados de OpenAI.
Una de esas cuentas tenía conexión con el GitHub interno de la empresa, lo que permitió a los investigadores demostrar que podían alcanzar un repositorio interno de código.
Los investigadores señalaron que detuvieron las pruebas después de comprobar el alcance del acceso y utilizaron una cuenta de Codex comprometida para crear una pull request de prueba en un repositorio interno.
Claude ayudó a desarrollar el exploit
Uno de los aspectos destacados de la investigación fue el papel de Claude en el desarrollo de la explotación.
Los investigadores utilizaron inicialmente Claude Opus 4.8, aunque encontraron dificultades para conseguir que el exploit funcionara de manera estable. Posteriormente emplearon Claude Opus 5 y señalaron que el modelo consiguió generar un exploit funcional en aproximadamente tres horas.
El caso muestra cómo los modelos de inteligencia artificial pueden utilizarse durante investigaciones de seguridad para analizar vulnerabilidades y desarrollar herramientas de explotación.
OpenAI corrigió las vulnerabilidades
Tras recibir el reporte, OpenAI corrigió la vulnerabilidad relacionada con su infraestructura aproximadamente 14 horas después, de acuerdo con la información de la investigación.
La compañía pagó a Hacktron AI una recompensa de 6 mil 500 dólares por el hallazgo. Por su parte, Discourse también corrigió la vulnerabilidad relacionada con el procesamiento de imágenes y añadió medidas de aislamiento para ImageMagick.
La investigación no documentó una intrusión masiva contra las cuentas de usuarios comunes de ChatGPT. El acceso demostrado correspondió a cuentas de empleados de OpenAI durante una investigación de seguridad autorizada.
Datos
¿Hackearon las cuentas de ChatGPT?
Los investigadores accedieron a cuentas de empleados de OpenAI durante una investigación de seguridad, pero no se documentó una intrusión masiva contra cuentas de usuarios comunes.
¿Qué inteligencia artificial utilizaron los investigadores?
Utilizaron modelos Claude de Anthropic, incluidos Claude Opus 4.8 y Claude Opus 5, para ayudar en el desarrollo de la explotación.
¿OpenAI corrigió las vulnerabilidades?
Sí. OpenAI corrigió la vulnerabilidad reportada y otorgó a los investigadores una recompensa de 6 mil 500 dólares.
CEO de Anthropic admite que la industria ocultó durante años los riesgos de la IA
inteligencia_artificial chatgpt anthropic ciberseguridad OpenAI