Corea del Sur lucha por evaluar modelos de IA frontera con insuficientes recursos: solo 16 GPU H200

  • Cada evaluación toma 7-10 días con costos de token de 50-60 millones de won

  • Los 16 GPU H200 son limitados: se necesitan más GPU, marco de trabajo y recursos para evaluar adecuadamente

Dario Amodei, CEO de Anthropic [Foto: Agencias Unidas, AFP, Getty Images Bank]
Dario Amodei, CEO de Anthropic [Foto: Agencias Unidas, AFP, Getty Images Bank]

Los principales directores ejecutivos de grandes tecnológicas estadounidenses advierten constantemente sobre los riesgos de la inteligencia artificial, lo que aumenta las demandas de pruebas de validación de seguridad para modelos frontera. En Corea del Sur, el Instituto de Seguridad de IA es responsable de estas evaluaciones, pero carece de infraestructura suficiente para mantenerse al ritmo del desarrollo de modelos.

Según el Instituto de Seguridad de IA informó el 16 de septiembre, la institución utiliza 16 unidades de procesamiento gráfico Nvidia H200 para evaluar la seguridad de los modelos de IA introducidos en el país.

Los modelos de IA más recientes se someten a aproximadamente 900 a 1.500 tareas complejas y luego se verifica su seguridad analizando los resultados procesados. Con los 16 GPU H200 disponibles, la institución requiere entre 7 y 10 días para evaluar un único modelo. El costo de tokens por ejecución de un punto de referencia alcanza entre 50 y 60 millones de won.

El Instituto de Seguridad de IA evaluó 6 modelos en marzo pasado, incluido Claude, pero esta cifra aumentó a 11 en agosto. Sin embargo, se lanzan más de 10 modelos frontera nuevos cada mes, una velocidad que la institución no puede seguir.

Kim Myung-ju, director del Instituto de Seguridad de IA y profesor en el Departamento de Seguridad de la Información de la Universidad de Seúl para Mujeres, explicó: "La demanda de evaluaciones se ha concentrado. Cuando surge escasez, arrendamos sesiones de nube comercial para adquirir recursos computacionales adicionales".

Debido a la insuficiencia de infraestructura, la institución prioriza la evaluación de modelos sensibles en términos de seguridad y protección. Como resultado, aumentan los casos en que modelos de IA que no han completado la validación de seguridad se utilizan en el mercado local.

El modelo prioritario actual es GLM 5.3, un modelo frontera desarrollado por la empresa china Zhipu AI. Recientemente, versiones modificadas de GLM 5.3 con salvaguardias desactivadas han circulado en internet, por lo que la institución determinó que es necesario verificar primero las posibilidades reales de mal uso.

Los modelos con salvaguardias desactivadas pueden generar vulnerabilidades de software o código de ataque que una IA normal debería rechazar. Estos modelos podrían proporcionar no solo ataques cibernéticos, sino también información peligrosa en campos químicos y biológicos, por lo que el instituto está evaluando hasta qué punto responden a solicitudes peligrosas.

El Instituto de Seguridad de IA también ha comenzado la evaluación de Astra, un modelo frontera recientemente publicado por OpenAI. El director Kim señaló: "Las evaluaciones de varios modelos se están realizando simultáneamente, por lo que se espera que transcurra tiempo antes de que se obtengan resultados".

Los expertos señalan que solo con 16 unidades H200 existe un límite para evaluar de manera integral la seguridad de modelos frontera del nivel de Astra. Argumentan que para realizar pruebas de ataque en rojo y monitoreo en tiempo real más allá de simples evaluaciones de preguntas y respuestas, se requiere un modelo de nivel similar al objetivo evaluado y recursos computacionales comparables.

Choi Byong-ho, profesor investigador del Instituto de Investigación de IA de la Universidad de Corea, afirmó: "La investigación de seguridad requiere tantos recursos como la investigación para mejorar el desempeño del modelo. Se deben contar no solo con GPU, sino también con energía para operarlas, espacio físico y un marco de evaluación integral". Añadió: "Dado que es difícil evaluar con un único modelo, también es necesaria una evaluación multimodelo que utilice recursos disponibles como API y modelos de código abierto".

Mientras tanto, el debate global sobre la velocidad de desarrollo de IA y la seguridad continúa en la industria de IA internacional. Según reportes externos, altos funcionarios de la administración Trump se reunieron el 15 de septiembre con ejecutivos de alto nivel de Anthropic para discutir cuestiones de seguridad de IA.

Dario Amodei, CEO de Anthropic, argumentó que la velocidad de desarrollo de IA debe reducirse para tener tiempo de reforzar las salvaguardias, mientras que el presidente Donald Trump se opone a la moderación de la velocidad, argumentando la competencia en IA con China.



* Este artículo ha sido traducido por IA.