La empresa evalúa reforzar los controles del modelo ante la posibilidad de que sus capacidades permitan desarrollar ciberataques avanzados de manera autónoma
10 de agosto de 2026.- OpenAI decidió pausar parte del desarrollo de Astra, un nuevo modelo de inteligencia artificial que, de acuerdo con evaluaciones internas, habría mostrado capacidades de programación agéntica y ciberseguridad lo suficientemente avanzadas como para representar un riesgo si fuera puesto a disposición del público sin mayores medidas de protección.
La decisión ocurre en un contexto de creciente preocupación dentro de la industria tecnológica por el uso de modelos de IA capaces de identificar vulnerabilidades informáticas y ejecutar determinadas tareas con un alto grado de autonomía.
Aunque Astra no participó en el reciente incidente en el que un modelo experimental de OpenAI habría iniciado un ataque contra la plataforma de inteligencia artificial Hugging Face, su desempeño llevó a la compañía a considerar que el sistema podría requerir nuevas salvaguardas antes de un eventual lanzamiento.
¿Por qué preocupa Astra?
Las herramientas de inteligencia artificial con capacidades avanzadas de ciberseguridad pueden ser utilizadas para detectar fallas en programas y sistemas informáticos, una función que puede ayudar a empresas y especialistas a corregir vulnerabilidades antes de que sean explotadas.
Sin embargo, esas mismas capacidades podrían ser aprovechadas por actores maliciosos para automatizar ataques y desarrollar nuevas estrategias sin una intervención humana constante.
OpenAI cuenta desde finales de 2023 con un Preparedness Framework, o Marco de Preparación, diseñado para evaluar los riesgos asociados con el incremento de las capacidades de sus modelos y establecer medidas de seguridad acordes con esos avances.
La compañía señaló que Astra podría aproximarse al nivel denominado “Crítico” dentro de este esquema. Esa categoría contempla, entre otros escenarios, que un modelo pueda identificar y desarrollar vulnerabilidades en sistemas críticos del mundo real sin supervisión humana, así como generar nuevas estrategias para ejecutar ciberataques avanzados.
OpenAI indicó que todavía realiza evaluaciones para determinar si Astra alcanza formalmente ese nivel de riesgo.
Refuerzan las medidas de seguridad
Ante los resultados de las pruebas, la compañía aumentó las evaluaciones de sus mecanismos de protección y controles de seguridad.
Entre las medidas se encuentra el uso de entornos de prueba más aislados, con el propósito de impedir que el modelo pueda eludir las barreras diseñadas para controlar sus acciones.
OpenAI también anunció que pausará el desarrollo de Astra en aquellos escenarios que no cumplan con los niveles más exigentes de seguridad y supervisión. Además, realizará un monitoreo permanente para identificar posibles comportamientos indebidos o acciones consideradas de riesgo.
Como parte de este proceso, la empresa prevé colaborar con organismos gubernamentales y organizaciones especializadas en seguridad de inteligencia artificial para someter el modelo a pruebas adicionales.
La compañía sostiene que los modelos avanzados con capacidades cibernéticas pueden convertirse en herramientas para la defensa digital, al permitir detectar y corregir vulnerabilidades antes de que sean aprovechadas por atacantes.
OpenAI aseguró que continuará trabajando con gobiernos, instituciones especializadas y organizaciones de la sociedad civil para establecer mecanismos que permitan desarrollar y utilizar sistemas de inteligencia artificial cada vez más avanzados bajo criterios de seguridad y responsabilidad.


