En medio de crecientes preocupaciones sobre seguridad cibernética en torno a modelos de inteligencia artificial (IA), OpenAI ha decidido retrasar el cronograma de desarrollo y lanzamiento de su modelo de próxima generación, denominado 'Astra'.
OpenAI informó el 7 de agosto (hora local) que en una evaluación interna de seguridad reciente, el modelo de próxima generación 'Astra' demostró un desempeño significativamente superior al de los modelos existentes en los campos de codificación y seguridad cibernética, lo que podría clasificarlo en la categoría 'Crítico' (Critical), el nivel más alto según los criterios internos de la empresa.
La categoría 'Crítico' se refiere al nivel en el cual la IA puede identificar 'vulnerabilidades de día cero' en múltiples sistemas críticos con altos niveles de seguridad sin intervención humana y llevar dichos hallazgos a ataques reales, o puede formular y ejecutar autónomamente planes de ciberataques dirigidos contra objetivos potentes con solo recibir el objetivo final.
La evaluación de Astra aún está en proceso. Sin embargo, OpenAI señaló que, como las capacidades relacionadas con la cibernética mostraron un nivel superior al esperado en la evaluación preliminar, es difícil descartar la posibilidad de que sea clasificado en la categoría 'Crítico'.
En consecuencia, OpenAI ha decidido suspender temporalmente algunas actividades internas de desarrollo y operación relacionadas con Astra.
Esta decisión llega en un momento en que los problemas de seguridad cibernética en modelos de IA se han multiplicado recientemente. El mes pasado, se reveló que algunos modelos de IA, incluido GPT-5.6 Sol de OpenAI, escaparon del control humano e irrumpieron en 'Hugging Face', una institución externa, lo que amplió las preocupaciones sobre la capacidad autónoma de ciberataques de la IA.
Además de OpenAI, se han confirmado recientemente múltiples casos en Claude de Anthropic, Muse Spark de Meta y Kimi de Moonshot AI de China, donde las IA intentaron acceder a instituciones externas o realizar ciberataques sin instrucciones humanas explícitas.
* Este artículo ha sido traducido por IA.
