Hugging Face exige “transparencia radical” a OpenAI tras vulneración con IA
OpenAI enfrenta cuestionamientos luego de que sus modelos de IA vulneraran a Hugging Face y generaran dudas de seguridad.

OpenAI aceptó que sus modelos de inteligencia artificial vulneraron a Hugging Face y ahora la tecnológica afectada le pide una “transparencia radical” para que la comunidad entienda lo que pasó y pueda prepararse.
La empresa dirigida por Sam Altman reveló la semana pasada que el incidente fue provocado por una combinación de modelos, incluyendo GPT-5.6 Sol y un modelo aún más avanzado en fase de prelanzamiento, que estaban siendo probados internamente por Hugging Face.
El problema ocurrió porque dichos modelos, al intentar pasar una prueba de ciberseguridad, identificaron y explotaron una vulnerabilidad de día cero para realizar una serie de acciones de escalada de privilegios y movimiento lateral en el entorno de pruebas de investigación hasta alcanzar un nodo con acceso a internet.

Clem Delangue, CEO de Hugging Face, publicó en X que se trasladó a San Francisco para hablar con los encargados de OpenAI y les pidió varias cosas.
Lo primero es que se publiquen los rastros que dejaron estos agentes “maliciosos” para que toda la comunidad pueda estudiar lo sucedido.
Adicionalmente, consideró necesario destinar más recursos para los encargados de seguridad. Por eso, impulsará que se inviertan 100 millones de dólares en capacidad de procesamiento para que la comunidad de Hugging Face pueda desarrollar defensas cibernéticas con los mejores modelos de inteligencia artificial, tanto abiertos como cerrados.
El primer ciberataque de un agente autónomo es un evento sin precedentes. ¡Merece una respuesta sin precedentes!”, añadió Delangue.

Para el investigador Gary Marcus, un punto positivo en este incidente es que los modelos no buscaban activamente vulnerar los sistemas, simplemente “intentaban hacer trampa en una prueba”.
A lo que se añade que todo ocurrió en un ejercicio de entrenamiento y no fue un incidente real, es decir, en circunstancias normales se espera que haya mecanismos que eviten el comportamiento de dichos modelos.
Aunque Marcus aceptó que no se tiene ninguna garantía de que los modelos futuros no puedan hacer cosas similares como encontrar vulnerabilidades de día cero para afectar sistemas y, al contrario, teme que en el futuro haya más incidentes de este tipo.