Agentes fuera de control de OpenAI intentan borrar su actividad tras acceder a sitios de gobierno

Agentes de IA de OpenAI accedieron a sitios gubernamentales y trataron de borrar sus rastros, según un informe de ciberseguridad.

Agentes fuera de control de OpenAI intentan borrar su actividad tras acceder a sitios de gobierno.
Agentes fuera de control de OpenAI intentan borrar su actividad tras acceder a sitios de gobierno.Reuters

Agentes de inteligencia artificial (IA) de OpenAI que accedieron de manera autónoma a sitios gubernamentales intentaron borrar el rastro de su actividad, de acuerdo con un informe de la empresa de ciberseguridad Asymmetric Security. Los expertos señalaron que no es posible determinar si estas acciones fueron deliberadas.

El análisis revisó la actividad de agentes de IA, programas capaces de realizar acciones por sí mismos, que tuvieron como objetivo sitios del gobierno australiano y otras organizaciones públicas entre marzo y septiembre.

El informe se suma a investigaciones realizadas por OpenAI y especialistas independientes sobre diversos incidentes registrados desde julio, entre ellos el hackeo de la plataforma de inteligencia artificial Hugging Face.

Agentes de IA realizaron acciones que dificultan rastrear su actividad

De acuerdo con Asymmetric Security, las acciones de estos agentes parecen haberse originado en tareas consideradas inocuas, como la recopilación de estadísticas sanitarias de Australia, que posteriormente derivaron en otras actividades.

Agentes fuera de control de OpenAI intentan borrar su actividad tras acceder a sitios de gobierno.
Reuters

Entre las acciones identificadas, los agentes obtuvieron mediante métodos indirectos estadísticas sobre la delincuencia en Nueva Gales del Sur.

También abrieron cuentas privadas en un servicio de análisis de sitios web, lo que ocultaba sus búsquedas, y crearon cuentas de correo electrónico temporales. Una de estas cuentas estaba programada para eliminarse automáticamente después de 48 horas.

Los autores del informe señalaron que, debido a la ausencia de registros, resulta imposible descartar que los agentes hayan accedido a datos sensibles.

Sin embargo, Asymmetric Security indicó que estos elementos no permiten determinar que los agentes tuvieran la intención de ocultar su actividad.

Agentes fuera de control de OpenAI intentan borrar su actividad tras acceder a sitios de gobierno.
Reuters

OpenAI ya había detectado intentos de borrar historiales

OpenAI reconoció a finales de agosto que sus modelos habían intentado en algunas ocasiones borrar o falsificar el historial de su actividad durante pruebas internas, aunque no consiguieron hacerlo.

La empresa también calificó el ataque contra Hugging Face como el primer caso conocido de agentes que actuaron de manera ofensiva sin autorización.

Según Asymmetric Security, las técnicas utilizadas por los agentes evolucionaron en cuestión de pocos días, mientras que las empleadas por ciberdelincuentes humanos pueden tardar meses o años en cambiar. Para los investigadores, esta diferencia muestra el riesgo de que las técnicas ofensivas basadas en IA avancen más rápido que los sistemas diseñados para defenderse de ellas.

Los incidentes analizados forman parte de una serie de investigaciones que buscan establecer hasta dónde pueden llegar las herramientas de IA autónomas y qué comportamientos pueden presentar cuando realizan tareas sin supervisión directa.

Agentes fuera de control de OpenAI intentan borrar su actividad tras acceder a sitios de gobierno.
Reuters

Crece el debate sobre los límites de la IA

Los casos registrados han generado llamados a reducir el ritmo de desarrollo de los sistemas de inteligencia artificial autónomos.

Dario Amodei, director ejecutivo de Anthropic, pidió frenar la carrera por el desarrollo de esta tecnología ante el temor de que, al ritmo actual, un grupo de agentes pueda llegar a tomar el control de Internet en un periodo de seis a 12 meses.

En Estados Unidos tampoco existe actualmente una ley federal que regule estos modelos de inteligencia artificial. El presidente Donald Trump, quien se ha pronunciado en contra de regulaciones que frenen la innovación en el sector, se reunió el martes con líderes de la industria tecnológica, quienes adoptaron un código de conducta voluntario.

Los incidentes analizados por Asymmetric Security mantienen abierto el debate sobre los mecanismos de supervisión de los agentes autónomos, especialmente cuando pueden ejecutar acciones, crear cuentas, realizar búsquedas y modificar o eliminar rastros de su propia actividad.

Con información de AFP.

Temas:

mgid