Gobierno coreano destinará 256 unidades de GPU para IA gratuita nacional, considerado insuficiente para servicio universal

  • Proyectos de IA y ciberseguridad recibirán 256 GPU B200 por equipo, una cuarta parte del apoyo a modelos anteriores

  • Análisis de rendimiento indica capacidad máxima de 14.000 consultas simultáneas, insuficiente para servicio nacional gratuito

  • India y Arabia Saudita invierten decenas de miles a cientos de miles de GPU, evidenciando brecha de recursos

El viceprimer ministro y ministro de Ciencia, Tecnología e Información y Comunicaciones, Bae Kyung-hoon, interviene durante una conferencia de prensa del Ministerio de Ciencia, Tecnología e Información y Comunicaciones. [Foto: Ministerio de Ciencia, Tecnología e Información y Comunicaciones]
El viceprimer ministro y ministro de Ciencia, Tecnología e Información y Comunicaciones, Bae Kyung-hoon, interviene durante una conferencia de prensa del Ministerio de Ciencia, Tecnología e Información y Comunicaciones. [Foto: Ministerio de Ciencia, Tecnología e Información y Comunicaciones]


El Gobierno ha decidido destinar alrededor de 256 unidades de procesadores gráficos (GPU) para los proyectos de "Modelo de Fundación de IA especializado en ciberseguridad" y "IA para todos". Comparado con el proyecto anterior de Modelo de Fundación de IA independiente, donde se proporcionaron un mínimo de 1.000 unidades por equipo seleccionado, esta cifra representa una cuarta parte, lo que ha generado críticas sobre las limitaciones para construir un chatbot de IA gratuito dirigido a toda la población nacional.
 
Según informó la industria tecnológica el 6 de agosto, el Ministerio de Ciencia, Tecnología e Información y Comunicaciones y el Instituto de Promoción de la Industria de las Tecnologías de la Información y Comunicaciones (NIPA) publicaron el 29 de julio las "Notificaciones revisadas del proyecto de apoyo al uso universal del servicio de IA nacional para todos" y la "Notificación revisada del proyecto de desarrollo del Modelo de Fundación de IA especializado en ciberseguridad".
 
El proyecto "IA para todos" tiene como objetivo proporcionar un chatbot de IA ilimitado y gratuito a toda la población nacional, utilizando 512 unidades B200 en poder del Gobierno. Si se seleccionan dos empresas, se distribuirán 256 unidades a cada una; si se seleccionan tres, se asignarán 256 unidades a la empresa clasificada en primer lugar y 128 unidades a las empresas clasificadas en segundo y tercer lugar.
 
Convertida a base del precio de alquiler comercial de B200 (aproximadamente 6,6 millones de wones mensuales), el valor anual de 256 unidades es de aproximadamente 20.200 millones de wones, lo que significa que el proyecto "IA para todos" en su totalidad implica la inversión de aproximadamente 40.500 millones de wones en infraestructura gubernamental anual.
 
El proyecto de desarrollo del Modelo de Fundación de IA especializado en ciberseguridad proporcionará a un equipo seleccionado 256 GPU NVIDIA B200 (32 nodos) durante 10 meses, con un presupuesto total de hasta 30.000 millones de wones, que incluye costos de adquisición de GPU, salarios, construcción de datos y gastos de demostración de servicio.
 
Cuando se utilizan 256 GPU B200 (basado en 32B) durante 10 meses, la escala teórica de tokens procesables se estima en aproximadamente 62 billones. Según funcionarios gubernamentales, el proyecto de desarrollo del modelo especializado en ciberseguridad se interpreta como un nivel que permite no solo el aprendizaje inicial teórico sino también la demostración de servicio.
 
El problema radica en el proyecto "IA para todos". Según la hoja de especificaciones de B200, el rendimiento computacional teórico de 256 GPU es aproximadamente 1.152 petaflops (PFLOPS) con base FP8, lo que corresponde a aproximadamente 2,3 veces el de 256 GPU H100.

Según análisis del sector, al convertir el benchmark de uso real H100 de la empresa emergente de IA nacional Allganize a la escala de 256 GPU B200, el límite máximo de procesamiento simultáneo en uso real es de solo 14.000 solicitudes. Aunque el límite máximo de procesamiento simultáneo puede incrementarse según el nivel de optimización del motor, la evaluación indica que resulta prácticamente difícil proporcionar un chatbot de IA gratuito dirigido a toda la población nacional.
 
En particular, si ocurren casos donde un usuario específico utiliza excesivamente el chatbot de IA gratuito del Gobierno, será difícil evitar cuellos de botella.
 
El profesor Cho Sung-bae del Departamento de Ciencias de la Computación de la Universidad de Yonsei señaló: "Es posible hacer que muchos usuarios utilicen IA para todos mediante métodos como hacer el modelo más ligero, pero existe un límite realista. Ciertamente, no se encuentra a un nivel que pueda utilizarse para desarrollo e investigación". No obstante, agregó: "A pesar de los recursos limitados, la realización de este tipo de intentos tiene significado".
 
También surgen críticas sobre la inversión insuficiente de recursos de IA a nivel nacional en comparación con ejemplos internacionales. El Gobierno de India ha invertido aproximadamente 1,7 billones de wones en la Misión de India IA, asegurando más de 38.000 GPU, operándolo mediante arrendamiento a precios inferiores al valor de mercado a empresas emergentes e instituciones de investigación.

HumanE, empresa estatal de IA bajo el Fondo de Inversión Pública (PIF) de Arabia Saudita, ha presentado el objetivo de desplegar 600.000 GPU en los próximos años. Estos proyectos van más allá del nivel de chatbot gratuito para toda la población nacional, apuntando hacia el alquiler de computación para empresas emergentes e instituciones de investigación, así como la exportación de centros de datos.
 
El Gobierno está invirtiendo una porción significativa del presupuesto nacional de IA de 9,9 billones de wones de este año en la expansión de centros de datos y la adquisición de GPU; sin embargo, a medida que aumentan los nuevos proyectos, la escala de GPU asignada a cada proyecto individual se reduce proporcionalmente. El proyecto "IA para todos" tiene como objetivo seleccionar operadores este mes, lanzar un servicio beta a finales de septiembre y lograr la puesta en servicio oficial dentro del año.
 



* Este artículo ha sido traducido por IA.