Hackean sistemas de OpenAI con IA de Anthropic; investigadores detectan vulnerabilidades en ChatGPT
DigitalMex - Periodismo Confiable

Hackean sistemas de OpenAI con IA de Anthropic; investigadores detectan vulnerabilidades en ChatGPT

Viernes, 18 Septiembre 2026 14:04 Escrito por 
Investigadores utilizaron la inteligencia artificial Claude para detectar vulnerabilidades en sistemas de OpenAI. Investigadores utilizaron la inteligencia artificial Claude para detectar vulnerabilidades en sistemas de OpenAI. Foto: Especial

México

Investigadores utilizan Claude para encontrar vulnerabilidades

Un equipo de tres investigadores de Hacktron AI identificó vulnerabilidades en la infraestructura de OpenAI mediante el uso de herramientas de inteligencia artificial de Anthropic, entre ellas Claude Opus 4.8 y Claude Opus 5.

La investigación comenzó el 23 de julio de 2026 como parte de un programa de recompensas por errores (bug bounty) y permitió demostrar una cadena de vulnerabilidades que llevó desde el foro comunitario de OpenAI hasta cuentas de empleados y servicios internos.

Detectan vulnerabilidad en el procesamiento de imágenes

El primer punto identificado por los investigadores se encontraba en el foro comunitario de OpenAI, alojado mediante Discourse.

La falla estaba relacionada con el procesamiento de imágenes en formato HEIF/HEIC y con la biblioteca libheif. De acuerdo con la investigación, esta vulnerabilidad podía permitir la ejecución de código en el servidor encargado de procesar las imágenes.

Posteriormente, los investigadores encontraron un problema relacionado con el sistema de inicio de sesión único, conocido como SSO, de OpenAI.

Acceden a cuentas de empleados

La combinación de ambas vulnerabilidades permitió obtener tokens de autenticación que podían utilizarse para acceder a cuentas de ChatGPT y Codex pertenecientes a empleados de OpenAI.

Una de esas cuentas tenía conexión con el GitHub interno de la empresa, lo que permitió a los investigadores demostrar que podían alcanzar un repositorio interno de código.

Los investigadores señalaron que detuvieron las pruebas después de comprobar el alcance del acceso y utilizaron una cuenta de Codex comprometida para crear una pull request de prueba en un repositorio interno.

Claude ayudó a desarrollar el exploit

Uno de los aspectos destacados de la investigación fue el papel de Claude en el desarrollo de la explotación.

Los investigadores utilizaron inicialmente Claude Opus 4.8, aunque encontraron dificultades para conseguir que el exploit funcionara de manera estable. Posteriormente emplearon Claude Opus 5 y señalaron que el modelo consiguió generar un exploit funcional en aproximadamente tres horas.

El caso muestra cómo los modelos de inteligencia artificial pueden utilizarse durante investigaciones de seguridad para analizar vulnerabilidades y desarrollar herramientas de explotación.

OpenAI corrigió las vulnerabilidades

Tras recibir el reporte, OpenAI corrigió la vulnerabilidad relacionada con su infraestructura aproximadamente 14 horas después, de acuerdo con la información de la investigación.

La compañía pagó a Hacktron AI una recompensa de 6 mil 500 dólares por el hallazgo. Por su parte, Discourse también corrigió la vulnerabilidad relacionada con el procesamiento de imágenes y añadió medidas de aislamiento para ImageMagick.

La investigación no documentó una intrusión masiva contra las cuentas de usuarios comunes de ChatGPT. El acceso demostrado correspondió a cuentas de empleados de OpenAI durante una investigación de seguridad autorizada.

Datos

¿Hackearon las cuentas de ChatGPT?

Los investigadores accedieron a cuentas de empleados de OpenAI durante una investigación de seguridad, pero no se documentó una intrusión masiva contra cuentas de usuarios comunes.

¿Qué inteligencia artificial utilizaron los investigadores?

Utilizaron modelos Claude de Anthropic, incluidos Claude Opus 4.8 y Claude Opus 5, para ayudar en el desarrollo de la explotación.

¿OpenAI corrigió las vulnerabilidades?

Sí. OpenAI corrigió la vulnerabilidad reportada y otorgó a los investigadores una recompensa de 6 mil 500 dólares.

CEO de Anthropic admite que la industria ocultó durante años los riesgos de la IA

Visto 798 veces
Valora este artículo
(0 votos)
Redacción

icon 722xDIGITALMEX PERIODISMO CONFIABLE

Redacción

Sitio Web: www.digitalmex.mx