Una imagen subida a un foro de soporte fue suficiente para que tres especialistas de Hacktron AI desmontaran la seguridad de OpenAI. El hackeo no solo comprometió cuentas de empleados, sino que permitió demostrar acceso directo al código interno de la compañía más valorada en IA.
Índice
¿Qué pasó exactamente?
Los investigadores aprovecharon una falla en los sistemas de OpenAI que comenzó de forma aparentemente banal: una imagen cargada en el foro de ayuda de la compañía. A partir de ahí, combinaron dos vulnerabilidades distintas para escalar privilegios y acceder a información sensible. El ataque fue lo suficientemente efectivo como para que pudieran comprometer tanto las credenciales de ChatGPT como las de Codex, las dos herramientas más críticas de OpenAI.
Lo que hace este hackeo particularmente relevante es que no se trató de un ataque teórico o de laboratorio. Los especialistas lograron demostrar acceso real al código fuente interno de la compañía, algo que las grandes empresas de IA mantienen bajo máxima protección. Para una organización que construye su reputación sobre la seguridad y confiabilidad de sus modelos, esto es más que un incidente técnico.
El rol inesperado de Claude
Lo irónico del caso es que para hackear OpenAI usaron herramientas de Anthropic. Los investigadores de Hacktron AI aprovecharon modelos Claude en parte del proceso del ataque, lo que subraya un punto que la industria lleva meses discutiendo: los modelos de lenguaje pueden ser instrumentos tanto defensivos como ofensivos, dependiendo de quién los use.
Este detalle también plantea preguntas incómodas sobre cómo las grandes empresas de IA están monitoreando el uso de sus propias herramientas. Si alguien puede usar Claude para ayudar en un ataque dirigido a un competidor, ¿qué tan visibles son estos patrones para Anthropic?
Cómo combinaron las vulnerabilidades
Según explicaron los especialistas de Hacktron AI, el ataque no dependió de una única falla catastrófica, sino de la combinación inteligente de dos problemas de seguridad separados. Primero, la imagen en el foro permitió pasar cierta barrera de entrada. Después, supieron encadenar eso con una segunda vulnerabilidad para elevar permisos y acceder a zonas restringidas.
Este enfoque de “escalada de privilegios” es común en ciberataques sofisticados, pero lo notable aquí es que no fue necesario un gusano, malware sofisticado o ingeniería social elaborada. Dos problemas moderados, mal configurados o descuidados, fueron suficientes cuando se combinaron estratégicamente.
¿Por qué importa esto?
OpenAI no es una startup pequeña. Es la compañía que define el estado del arte en IA generativa, con miles de millones en valuación y confianza de gobiernos y empresas del mundo entero. Si su seguridad puede ser penetrada por tres investigadores usando técnicas combinadas, esto abre preguntas más amplias sobre el nivel real de protección en las infraestructuras de IA a nivel global.
También hay implicaciones para la industria completa. Los equipos de seguridad de otras compañías probablemente ya están revisando si tienen vulnerabilidades similares. OpenAI probablemente ya está parcheando, pero el daño reputacional es difícil de cuantificar.
Qué sigue
Aún no hay confirmación oficial sobre el alcance completo del compromiso ni cuánto tiempo estuvo expuesto el código. Tampoco está claro si hubo exfiltración de datos más allá de lo que los investigadores demostraron. OpenAI habrá iniciado una auditoría de seguridad exhaustiva, aunque no siempre estas compañías revelan los detalles públicamente.
Lo que sí está claro es que los días donde una empresa de IA podía asumir que su código era prácticamente inaccesible quedaron atrás. A medida que estos sistemas se vuelven más críticos para la infraestructura digital, la seguridad deja de ser un diferenciador de lujo para convertirse en una exigencia fundamental.
Con información de Enter.co.