Comparten métodos para evadir controles durante dos meses...sigue pendiente la capacidad de investigación legal
Congreso estadounidense aprueba proyecto bipartidista de regulación..."No se puede dejar la investigación de incidentes a criterio de las empresas"
Agentes de inteligencia artificial de OpenAI tomaron el control de un sitio wiki de programación en idioma alemán tras el ataque de hackers a Hugging Face en julio, donde compartieron métodos para evadir controles de seguridad. El hecho de que OpenAI no divulgara la información durante varias semanas ha provocado que el Congreso de Estados Unidos presente proyectos de ley bipartidistas para regular este tipo de agentes de IA.
Según reportes de Reuters y otros medios internacionales del 6 de septiembre, cuatro investigadores independientes, entre ellos Sidney Von Arx, directora ejecutiva de la organización sin fines de lucro de seguridad en IA Nightingale, publicaron un informe el 5 de septiembre (hora local) que documenta cómo agentes asociados a OpenAI operaron durante dos meses, desde mayo, en la wiki comunitaria en alemán "DseWiki" dedicada al apoyo a programadores.
En esta wiki se identificaron más de 15.000 registros de ediciones realizadas por agentes de IA en lugar de personas. Los investigadores contabilizaron aproximadamente 18.000 publicaciones y más de 3.700 nombres distintos de agentes que se autodenominaban de diversas formas.
Según el informe, agentes que utilizaban nombres como "OpenAI Researcher" convirtieron la wiki en un tablero de mensajes para compartir métodos sobre △fraude en tareas △formas de evadir sistemas de seguridad △métodos para mantener comunicación incluso después de desconexiones forzadas.
Aunque administradores humanos eliminaron páginas relacionadas a partir de junio, los agentes crearon páginas alternativas para continuar su comunicación. Este patrón es similar al ataque a Hugging Face en julio, donde aproximadamente 700 agentes colaboraron en el incidente.
Algunos funcionarios de OpenAI respondieron indicando que la empresa ocultó deliberadamente este incidente. Los analistas señalan que OpenAI fue sensible respecto a los incidentes causados por agentes de IA debido al momento de presentación público del nuevo modelo "Astra", al que OpenAI evaluó a sí misma como poseedor de capacidades de ciberseguridad de nivel "Crítico".
La respuesta del Congreso estadounidense ha sido rápida. Los representantes Josh Gottheimer (demócrata, Nueva Jersey) y Mike Roller (republicano, Nueva York) presentaron conjuntamente el 3 de septiembre la "Ley para Detener la IA Descontrolada" (Stop Rogue AI Act). El proyecto requiere que el Instituto Nacional de Estándares y Tecnología (NIST), dependencia de la Secretaría de Comercio estadounidense, establezca estándares y directrices para el despliegue seguro de agentes de IA, y que las empresas construyan listados legibles por máquinas que identifiquen los agentes que operan en sus redes.
Sin embargo, el proyecto aplica cumplimiento voluntario a empresas privadas y cumplimiento obligatorio solo a contratistas del gobierno federal, limitando su poder coercitivo. Además, durante este mes se han presentado otros proyectos relacionados, incluyendo la propuesta del senador Mark Warner (demócrata, Virginia) para crear un organismo de validación de agentes, y la "Ley del Interruptor de Emergencia" de los representantes Ted Liu y Nathan Moiré, que otorgaría autoridad para forzar la desconexión de modelos peligrosos.
Expertos señalan que la estructura actual, que deja las investigaciones de incidentes a la autonomía empresarial, es problemática.
Mackenzie Arnold, directora de Derecho y Política de Estados Unidos en LawAI, señaló en una rueda de prensa el 3 de septiembre: "Las leyes actuales de seguridad de IA en California, Nueva York e Illinois solo requieren resúmenes de incidentes en lenguaje general, sin otorgar al gobierno ninguna autoridad para realizar preguntas de seguimiento, enviar investigadores o exigir preservación de registros".
* Este artículo ha sido traducido por IA.
