Investigadores de ciberseguridad usan IA de Anthropic para hallar falla y acceder a cuentas de OpenAI

Expertos de Hacktron AI identificaron una vulnerabilidad en el foro público de ayuda de la compañía creadora de ChatGPT mediante el modelo Claude Opus. La falla fue corregida en 14 horas y recompensada por el programa de ciberdefensa.

Un grupo de investigadores de ciberseguridad pertenecientes a la start-up Hacktron AI logró acceder a cuentas de ChatGPT de empleados de OpenAI utilizando un modelo de inteligencia artificial desarrollado por Anthropic, en el marco de un programa coordinado de búsqueda de vulnerabilidades (bug bounty).

La intrusión, confirmada por OpenAI, se originó tras detectar una falla en su foro público de ayuda, gestionado sobre la plataforma Discourse. De acuerdo con el reporte publicado por Hacktron, los especialistas utilizaron inicialmente el modelo Claude Opus 4.8 para identificar el fallo, pero fue con la versión Claude Opus 5 con la que lograron desarrollar un ataque funcional en un lapso de solo tres horas.

Resolución rápida y recompensa por hallazgo

Tras corroborar la brecha de seguridad, los investigadores reportaron de inmediato el problema a las áreas técnicas de OpenAI y Discourse para coordinar el parche de actualización. Desde OpenAI confirmaron que la vulnerabilidad quedó completamente resuelta en un plazo de 14 horas tras la notificación, otorgando a los especialistas una recompensa de 6.500 dólares.

“Agradecemos a los investigadores por contactarnos y compartir sus hallazgos”, señaló Drew Pusateri, portavoz de OpenAI. El incidente reflota la alerta en la industria respecto a cómo los nuevos modelos de lenguaje están reduciendo los tiempos y costos para ejecutar ciberataques sofisticados que antes requerían meses de trabajo especializado.

Contenido relacionado

Envíanos tu denuncia o información AVISOS ECONÓMICOS