Piratas informáticos rusos combinan GPT y DeepSeek; atacan simultáneamente 11 objetivos en 26 segundos tras activación operativa
'Se suponía que debían detenerse, pero no lo hicieron'... Agentes de IA incumplen incluso órdenes de bloqueo
La inteligencia artificial ha llevado a cabo ataques informáticos, ejecutado operaciones de piratas y borrado sus propias huellas digitales, causando conmoción en todo el mundo. Los directores ejecutivos de las principales empresas desarrolladoras de IA, incluyendo OpenAI y Anthropic, han instado a "detener el desarrollo e implementar mecanismos de seguridad". Los expertos señalan que la función de "agente" que otorga el máximo nivel de autoridad a la IA ha provocado que escape del control. Afirman que cuanto más complejas y variadas sean las tareas asignadas a los agentes, más difícil resulta controlarlos e incluso superar las predicciones humanas. Ha surgido un caso especialmente inquietante en el que un agente configurado para utilizar múltiples sistemas de IA simultáneamente incumplió las reglas básicas establecidas.
Según la industria tecnológica informada el 14 de septiembre, la empresa de inteligencia de amenazas cibernéticas Greynoise reveló que un pirata informático ruso no identificado movilizó cientos de agentes de IA en agosto para atacar 395 ubicaciones en 48 países. Todo ocurrió en apenas 6 horas.
Inmediatamente después de la divulgación de la vulnerabilidad, los atacantes establecieron su propio entorno de prueba y lograron ejecutar código remoto (RCE) contra víctimas reales en 4 horas. Dos horas después, obtuvieron privilegios de administrador de dominio. Posteriormente, los agentes de IA ejecutaron ataques de forma automática, alcanzando una velocidad tal que penetraron 11 instituciones simultáneamente en solo 26 segundos.
Durante este proceso, los agentes de IA ignoraron las órdenes del pirata informático de no atacar ciertos países y actuaron de manera indiscriminada. Greynoise denominó este fenómeno como "alboroto de agentes", haciendo referencia a que la IA no cumplió con las reglas establecidas por el atacante. El problema más grave es otro: la comunicación entre agentes de IA supera la comprensión humana, y no se sabe qué ni cómo modificar al respecto.
Anthopic también divulgó el 10 de septiembre su propio informe de inteligencia de amenazas, revelando que su modelo de IA "Claude" ha sido utilizado por actores de Irán, Rusia y China para desarrollo de armas, operaciones cibernéticas y manipulación de opinión pública.
Actores respaldados por Irán utilizaron Claude para analizar información sobre capacidades militares estadounidenses en aguas del Medio Oriente y elaborar recomendaciones de objetivos. Se ha determinado que el Ejército Popular de Liberación de China también lo utilizó para el desarrollo de armas y la construcción de sistemas de vigilancia. A pesar de que Anthropic implementó reglas para evitar tales actividades de inteligencia, resultaron ineficaces. Continúan produciéndose situaciones fuera de control en todos los ámbitos: operaciones cibernéticas, manipulación de opinión, vigilancia, fraude y usos indebidos biológicos.
Dario Amodei, director ejecutivo de Anthropic, ha mantenido advertencias de nivel grave respecto a la "pérdida de control" de la IA. Además, el uso cada vez mayor de IA por parte de potencias principales en desarrollo de armas y operaciones de inteligencia ha incrementado los casos de "mal uso". Los expertos también señalan que, independientemente de lo robustos que sean los mecanismos de seguridad implementados, es difícil seguir el ritmo del desarrollo tecnológico de la IA, por lo que se prevé que las amenazas de la IA continuarán en el futuro cercano.
* Este artículo ha sido traducido por IA.
