Caso OpenAI-Hugging Face: ¿la IA ya es demasiado poderosa para ser controlada?

Dos agentes de IA de OpenAI realizaron un ciberataque autónomo durante una prueba y reavivaron el debate sobre su control.

Caso OpenAI-Hugging Face: ¿la IA ya es demasiado poderosa para ser controlada?
Caso OpenAI-Hugging Face: ¿la IA ya es demasiado poderosa para ser controlada?Reuters

Dos agentes de inteligencia artificial desarrollados por OpenAI realizaron de forma autónoma un ciberataque contra la plataforma Hugging Face durante una prueba interna. El incidente ha generado dudas sobre la capacidad para controlar los modelos de IA más avanzados.

La evaluación, realizada en un entorno controlado, tenía como objetivo medir las capacidades de GPT-5.6 Sol, considerado por la empresa como su modelo más avanzado, así como de un sucesor que todavía no ha sido lanzado al mercado.

De acuerdo con especialistas que analizaron el caso, ambos agentes lograron conectarse a internet sin autorización y atacaron Hugging Face, uno de los principales repositorios de modelos de inteligencia artificial utilizados por desarrolladores y empresas en todo el mundo.

Jeffrey Ladish, director de la firma independiente Palisade Research, señaló que los modelos entendían que OpenAI les había indicado no salir del entorno de pruebas ni interactuar con sistemas externos. Sin embargo, decidieron hacerlo por cuenta propia.

OpenAI reconoce que su IA se descontroló y lanzó un ciberataque ‘sin precedentes’.
Reuters

Casi parecía que lo hicieron antes incluso de tener un plan de qué hacer con el acceso a internet", señaló el especialista, quien advirtió que este tipo de comportamientos evidencia un nuevo desafío para la industria.

Según Ladish, los modelos de IA buscan cada vez mayor autonomía para cumplir sus objetivos, lo que incrementa la dificultad para mantenerlos bajo control.

El incidente se suma a otros casos recientes

El episodio no es un hecho aislado. En marzo, desarrolladores vinculados con Alibaba detectaron que uno de sus modelos intentó crear una criptomoneda por iniciativa propia después de conectarse sin autorización a un servidor externo.

Un mes después, Sam Bowman, responsable de seguridad de Anthropic, informó que un modelo experimental de la compañía logró navegar por internet pese a que inicialmente se encontraba aislado durante las pruebas.

Estos casos han intensificado las preocupaciones entre investigadores y autoridades sobre la capacidad de los sistemas de inteligencia artificial para actuar de forma independiente cuando reciben un mayor grado de autonomía.

OpenAI reconoce que su IA se descontroló y lanzó un ciberataque ‘sin precedentes’.
Reuters

Tras el incidente, OpenAI informó que reforzó las medidas de seguridad utilizadas durante las evaluaciones de sus modelos, aunque la empresa no explicó públicamente por qué no detectó el comportamiento antes de que ocurriera ni si alertó de inmediato a Hugging Face.

Especialistas consideran que una forma de evitar este tipo de situaciones es mantener los modelos completamente desconectados de internet durante las pruebas. Sin embargo, advierten que esta estrategia se vuelve más compleja conforme aumenta la capacidad de los sistemas para resolver tareas avanzadas.

Gang Wang, profesor de Ciencias de la Computación de la Universidad de Illinois, afirmó que aún es posible impedir físicamente el acceso a internet, pero advirtió que muchas personas siguen subestimando las capacidades de la inteligencia artificial.

Por su parte, Andrew Lohn, investigador del Centro de Seguridad y Tecnologías Emergentes de la Universidad de Georgetown, comparó estos entornos con los laboratorios donde se manipulan virus o bacterias, al señalar que requieren protocolos de seguridad mucho más estrictos.

Dan Lahav, director ejecutivo de la empresa de ciberseguridad Irregular, añadió que construir entornos completamente aislados para evaluar modelos avanzados representa un desafío técnico importante.

OpenAI reconoce que su IA se descontroló y lanzó un ciberataque ‘sin precedentes’.
Reuters

Explicó que, conforme los desarrolladores otorgan mayor autonomía a los sistemas para realizar tareas complejas, también aumenta la dificultad para supervisar su comportamiento y evitar acciones no previstas.

EU analiza nuevas reglas para la IA

El incidente ocurre mientras el gobierno de Estados Unidos mantiene el debate sobre cómo regular los modelos de inteligencia artificial más avanzados antes de su lanzamiento comercial.

La administración del presidente Donald Trump ha exigido que empresas como OpenAI y Anthropic sometan sus desarrollos más sofisticados a evaluaciones de seguridad antes de ponerlos a disposición del público.

Además, legisladores estadounidenses presentaron esta semana una iniciativa que obligaría a las compañías de inteligencia artificial a incorporar un "interruptor de apagado" o kill switch, capaz de desactivar un sistema si representa un riesgo grave para la seguridad.

El caso de OpenAI podría reforzar las presiones para endurecer las pruebas de seguridad y establecer nuevas reglas sobre el desarrollo de modelos con mayor autonomía, en un momento en que la industria acelera la carrera por construir sistemas de IA cada vez más potentes.

Con información de AFP.

mgid