NoticiasMacroOpenAI pausó ciertas actividades de Astra por hallazgos de ciberseguridad «críticos»; el entrenamiento continuó, según Altman

OpenAI pausó ciertas actividades de Astra por hallazgos de ciberseguridad «críticos»; el entrenamiento continuó, según Altman

Autor: CryptoBriefing·

Puntos clave

  • OpenAI afirmó que las capacidades de ciberseguridad de Astra alcanzaron o se acercaron al nivel «crítico» de su Marco de Preparación.
  • El modelo mostró habilidades avanzadas de codificación agéntica y el potencial de encontrar o explotar vulnerabilidades de día cero.
  • OpenAI pausó las actividades internas afectadas durante un poco más de dos semanas mientras implementaba nuevas medidas de seguridad.
  • Sam Altman afirmó que el entrenamiento central de Astra no se detuvo y que aún se espera que los nuevos modelos se lancen pronto.
OpenAI pausó ciertas actividades de Astra por hallazgos de ciberseguridad «críticos»; el entrenamiento continuó, según Altman

OpenAI detuvo ciertas actividades internas vinculadas a su modelo Astra el 7 de agosto de 2026, después de que hallazgos preliminares indicaran que la IA había alcanzado lo que la empresa clasifica como capacidades de ciberseguridad «críticas». No obstante, el director ejecutivo Sam Altman subrayó que el entrenamiento central de Astra nunca se detuvo y que los nuevos modelos siguen en camino de lanzarse pronto.

Qué provocó la pausa

La preocupación se centra en las capacidades de ciberseguridad de Astra, que supuestamente alcanzaron o se acercaron al nivel «crítico» del Marco de Preparación (Preparedness Framework) de OpenAI, la clasificación más alta que la empresa utiliza para evaluar los riesgos de sus modelos.

En términos prácticos, el modelo demostró sofisticadas habilidades de codificación agéntica y el potencial de identificar o explotar vulnerabilidades de día cero (zero-day). Las vulnerabilidades de día cero son fallas de seguridad que los proveedores de software aún no conocen, lo que las hace extraordinariamente valiosas tanto para los defensores como para los atacantes. El descubrimiento de vulnerabilidades impulsado por IA ya es un campo de trabajo activo: el AI Cyber Challenge de DARPA, cuya final se celebró en la conferencia de hackers DEF CON en 2025, encargó a sistemas de IA encontrar y corregir fallas en software de código abierto de uso generalizado, lo que subraya tanto la promesa defensiva como el riesgo de doble uso de la capacidad en cuestión.

La pausa duró un poco más de dos semanas mientras OpenAI implementaba nuevas medidas de seguridad en torno a esas capacidades específicas. Durante ese período, la empresa evaluó los riesgos y estableció salvaguardas antes de reanudar las actividades afectadas.

Las capacidades más amplias de Astra

La dimensión de ciberseguridad es solo una faceta de lo que parece ser un modelo excepcionalmente poderoso. Según los informes, una versión anterior de Astra resolvió 10 grandes problemas abiertos en matemáticas y ciencias de la computación teórica, un logro que, de verificarse de forma independiente, representaría un hito en la investigación de la IA.

Altman ha dicho que Astra está destinado a estar «disponible de forma general», lo que significa que no quedará encerrado indefinidamente tras un acceso restringido de investigación. No obstante, reconoció que hace falta más tiempo para garantizar que el modelo se desarrolle de manera segura, con un enfoque particular en abordar sus capacidades cibernéticas antes de un despliegue más amplio.

El equilibrio entre seguridad y velocidad

El Marco de Preparación de OpenAI fue diseñado precisamente para este tipo de situaciones. Introducido en octubre de 2023, el marco establece niveles de riesgo, desde «bajo» hasta «crítico», en categorías que incluyen ciberseguridad, persuasión, autonomía y amenazas biológicas. Cuando un modelo alcanza el nivel crítico en cualquier categoría, se activan pasos adicionales de revisión y mitigación antes de que el despliegue pueda proseguir.

En la actualidad existen esquemas comparables en el panorama de los laboratorios de frontera: tanto la Política de Escalamiento Responsable (Responsible Scaling Policy) de Anthropic como el Marco de Seguridad de Frontera (Frontier Safety Framework) de Google DeepMind definen umbrales de capacidad que activan salvaguardas más estrictas, lo que convierte la evaluación de riesgos por niveles en una norma emergente de la industria. El hallazgo de nivel crítico atribuido a Astra figura entre los ejemplos públicos más claros hasta la fecha de la activación de un umbral de este tipo en un laboratorio importante.

La relevancia del marco también llega tras un período movido para la gobernanza de seguridad de OpenAI. En 2024, la empresa disolvió su equipo de Súper Alineación (Superalignment) de largo plazo tras las salidas de sus colíderes Ilya Sutskever y Jan Leike, integrando su trabajo en esfuerzos de seguridad más amplios, una secuencia que mantuvo en el ojo público las preguntas sobre el equilibrio entre velocidad y precaución de la empresa.

Qué observar de aquí en adelante

La pregunta a corto plazo es cuándo Astra, o los modelos derivados de él, llegarán realmente a los usuarios. La declaración de Altman de que se esperan nuevos modelos pronto sugiere que el cronograma no cambió drásticamente pese a la pausa.

También vale la pena seguir de cerca si OpenAI publica hallazgos detallados de su evaluación de seguridad. Un modelo que alcanza el nivel crítico de riesgo en ciberseguridad parecería ameritar un informe público exhaustivo sobre lo que se encontró y qué mitigaciones se implementaron y, con Anthropic y Google DeepMind operando marcos similares basados en umbrales, si los laboratorios pares comienzan a divulgar evaluaciones comparables de sus propios modelos.