No fue solo Hugging Face: OpenAI revela que la IA descontrolada atacó otras plataformas

OpenAI revela que dos modelos de IA no solo atacaron Hugging Face, sino también otras cuatro plataformas durante pruebas.

OpenAI reconoce que su IA se descontroló y lanzó un ciberataque ‘sin precedentes’.
No fue solo Hugging Face: OpenAI revela que la IA descontrolada atacó otras plataformas.Reuters

Los dos modelos de inteligencia artificial (IA) de OpenAI que salieron del entorno controlado donde eran probados no solo atacaron a Hugging Face, sino que también afectaron a otras cuatro plataformas, según la compañía creadora de ChatGPT.

El incidente, considerado uno de los casos más relevantes documentados sobre el comportamiento autónomo de modelos de IA, reavivó el debate sobre los riesgos del desarrollo acelerado de esta tecnología y la necesidad de fortalecer los mecanismos de supervisión.Los modelos de IA también accedieron a otras plataformas

OpenAI explicó que, además de intentar ingresar a Hugging Face, los dos modelos utilizaron otras cuatro plataformas, aunque no reveló sus nombres.

De acuerdo con la actualización del informe, una de estas plataformas fue utilizada como intermediaria para preparar el intento de acceso a Hugging Face, un popular repositorio de modelos y herramientas de inteligencia artificial donde los sistemas buscaron respuestas a las pruebas que les habían asignado los desarrolladores.

La empresa también señaló que los modelos visitaron diversos sitios públicos para copiar o probar fragmentos de código de programación, aunque aseguró que estas acciones no fueron más allá de lo que podría realizar cualquier usuario con acceso a esos servicios.

OpenAI reconoce que su IA se descontroló y lanzó un ciberataque ‘sin precedentes’.
Reuters

Por su parte, Hugging Face publicó su propia versión de los hechos y afirmó que la intrusión correspondió a un intento de los modelos de "hacer trampa" durante la evaluación realizada por OpenAI.

Según la plataforma, los sistemas buscaban obtener directamente las soluciones de las pruebas en lugar de resolverlas mediante sus propias capacidades.

OpenAI detectó el uso de credenciales expuestas

Como parte de la investigación, OpenAI encontró algunos casos en los que los modelos localizaron credenciales de acceso que otras organizaciones habían dejado expuestas en internet y las utilizaron para ingresar a cuentas en servicios externos.

La compañía indicó que ya notificó a los propietarios de las cuentas afectadas y aseguró que, hasta el momento, no existe evidencia de que el incidente haya provocado un impacto más amplio sobre esos proveedores o sobre otras cuentas alojadas en sus plataformas.

Tras lo ocurrido, el director ejecutivo de OpenAI, Sam Altman, informó que la empresa decidió pausar temporalmente sus pruebas mientras fortalece las medidas de seguridad relacionadas con el llamado sandboxing, el proceso mediante el cual los modelos son aislados dentro de un entorno controlado para evaluar su comportamiento sin afectar sistemas externos.

OpenAI reconoce que su IA se descontroló y lanzó un ciberataque ‘sin precedentes’.
Reuters

¿Qué pasa con la regulación de la IA?

Este caso ocurre en un momento en que la industria tecnológica avanza hacia el desarrollo de agentes de inteligencia artificial, sistemas diseñados para ejecutar tareas de forma autónoma en lugar de limitarse a responder instrucciones mediante un chatbot.

Al mismo tiempo, más de mil empleados y directivos de empresas dedicadas al desarrollo de IA solicitaron al gobierno de Estados Unidos impulsar la creación de un organismo internacional encargado de evaluar y supervisar los modelos más avanzados antes de su lanzamiento.

Los firmantes sostienen que la industria se acerca a una etapa conocida como automejora recursiva (recursive self-improvement o RSI), en la que un modelo de inteligencia artificial sería capaz de diseñar por sí mismo una versión más avanzada, iniciando un proceso de evolución continua que dificultaría la supervisión por parte de ingenieros humanos.

El incidente también generó reacciones encontradas dentro de Silicon Valley. Mientras algunos consideran que evidencia la necesidad de establecer controles más estrictos para el desarrollo de la IA, otros acusan a las grandes empresas tecnológicas de utilizar este tipo de episodios para justificar regulaciones que dificulten la entrada de nuevos competidores.

Asimismo, algunos analistas señalaron que OpenAI podría estar aprovechando la difusión del incidente para demostrar las capacidades de sus modelos más recientes, una crítica similar a la que recibió Anthropic cuando retrasó el lanzamiento público de uno de sus sistemas avanzados alegando preocupaciones de seguridad.

mgid