NoticiasMacroOpenAI lanza GPT-6 Astra para flujos de trabajo profesionales autónomos y destina 1.000 millones de dólares a la ciberseguridad de primera línea

OpenAI lanza GPT-6 Astra para flujos de trabajo profesionales autónomos y destina 1.000 millones de dólares a la ciberseguridad de primera línea

Autor: Metaverse Post·

Puntos clave

  • GPT-6 Astra obtiene 99.9% en ARC-AGI-3, 72.6% en OSWorld 2.0, 96% en GPQA Diamond y una puntuación perfecta en ExploitBench.
  • El modelo completa tareas de uso de computadora aproximadamente 47% más rápido que su predecesor y estableció un récord estimado de eficiencia computacional de 169, según Epoch AI.
  • OpenAI destinará 1.000 millones de dólares para subsidiar recursos de ciberseguridad con IA de frontera destinados a defensores de primera línea como empresas de agua, operadores de redes eléctricas, gobiernos locales y bancos comunitarios, comenzando en Estados Unidos.
  • Astra produjo resultados desalineados en 2.4% de las pruebas adversariales y, según se informa, descubrió dos vulnerabilidades zero-day previamente desconocidas durante las evaluaciones de ciberseguridad.
  • El acceso a la API cuesta 10 dólares por millón de tokens de entrada y 50 dólares por millón de tokens de salida, y los administradores empresariales deben habilitarlo expresamente antes de que el modelo se active para sus espacios de trabajo.
OpenAI lanza GPT-6 Astra para flujos de trabajo profesionales autónomos y destina 1.000 millones de dólares a la ciberseguridad de primera línea

La empresa de investigación en inteligencia artificial OpenAI presentó GPT-6 Astra, su más reciente modelo de frontera, diseñado para el uso autónomo de computadoras, la ingeniería de software, la investigación científica y flujos de trabajo profesionales complejos. El lanzamiento se enmarca en una competencia más amplia de la industria hacia la IA agéntica—modelos capaces de operar software, navegar y completar tareas de múltiples pasos con supervisión limitada—donde la confiabilidad en tareas del mundo real, y no solo la calidad del chat, se ha convertido en el factor diferenciador clave. El sistema estuvo disponible para un grupo limitado de organizaciones el día del lanzamiento y se implementará en los próximos días para los suscriptores de ChatGPT Plus, Pro, Business y Enterprise, así como a través de la API de OpenAI y los principales proveedores de nube.

OpenAI posiciona a Astra como líder en múltiples categorías de pruebas de referencia. Según se informa, el modelo obtiene 99.9% en ARC-AGI-3, una prueba de razonamiento abstracto diseñada para resistir la memorización; satura FrontierMath Tier 4 con 98%; y alcanza 100% en ExploitBench. En evaluaciones prácticas, logró 59.3% en Agents' Last Exam, 72.6% en OSWorld 2.0—una prueba de referencia para controlar interfaces reales de computadora—y 96% en GPQA Diamond, una prueba de ciencia de nivel de posgrado. Estas suites agénticas y de uso de computadora se consideran de las evaluaciones no resueltas más difíciles para los modelos de frontera, razón por la cual las puntuaciones en el rango de 50–70% se tratan como un avance notable.

OpenAI también destaca importantes mejoras de eficiencia, señalando que Astra completa tareas de uso de computadora en aproximadamente 47% menos tiempo que su predecesor, mientras utiliza considerablemente menos tokens de salida. En flujos de trabajo de programación y científicos basados en terminal, el modelo obtuvo 57.9% en Terminal-Bench 4.0 y 64.6% en Terminal-Bench Science 0.1, con costos estimados de API inferiores a los de configuraciones competidoras. Investigadores independientes de Epoch AI también registraron un nuevo récord estimado de eficiencia computacional de 169.

Astra introduce un mecanismo rediseñado de gestión de contexto en el entorno Codex de OpenAI que conserva notas de trabajo consultables durante sesiones prolongadas, evitando la pérdida de información típicamente asociada con la compresión de la ventana de contexto—una limitación de larga data para los agentes que trabajan en tareas de varias horas, donde los modelos anteriores solían olvidar u omitir detalles una vez que las conversaciones superaban sus límites de contexto. El modelo también está diseñado para manejar tareas profesionales de múltiples pasos, incluyendo análisis de datos, redacción de documentos, actualizaciones de CRM y trabajos de ingeniería especializada.

This is GPT-6 Astra. Anything you can do on a computer, Astra can do for you. Fast. pic.twitter.com/gDd0IsewJw — OpenAI (@OpenAI) September 3, 2026

Ciberseguridad, alineación y un compromiso de 1.000 millones de dólares para los defensores

Junto con sus capacidades, OpenAI enfatiza las propiedades de seguridad de Astra, describiendo el modelo como su versión más alineada hasta la fecha. Las evaluaciones internas indican mejoras sustanciales en la comprensión de la intención del usuario y el respeto de los límites de las tareas. En pruebas adversariales, Astra produjo resultados desalineados a una tasa de 2.4%, significativamente inferior a las cifras reportadas para modelos de frontera competidores. El sistema también demostró mayor resistencia a eludir mecanismos de revisión automatizada y una menor tendencia a alucinar sobre sus propias capacidades.

En evaluaciones de ciberseguridad, Astra cumple con el umbral interno de preparación Crítica de OpenAI. Logró una puntuación perfecta en ExploitBench y una tasa de éxito de 42.4% en ExploitGym, y según se informa descubrió dos vulnerabilidades zero-day previamente desconocidas durante la evaluación. Las implementaciones estándar rechazarán solicitudes para crear exploits de prueba de concepto, aunque OpenAI planea ampliar el acceso defensivo a través de su programa Daybreak en las próximas semanas.

De manera simultánea con el lanzamiento, OpenAI anunció un compromiso de 1.000 millones de dólares para subsidiar recursos de ciberseguridad con IA de frontera destinados a defensores de primera línea. La iniciativa Daybreak for Frontline Defenders se dirige a operadores de servicios esenciales—incluidas empresas de agua potable, operadores de redes eléctricas, gobiernos locales y bancos comunitarios—comenzando en Estados Unidos con una expansión internacional planificada. El programa aborda una brecha de capacidad en ciberseguridad ampliamente documentada: las empresas de servicios más pequeñas y las instituciones públicas a menudo carecen de los presupuestos y el personal de las grandes empresas, pero operan infraestructura que las agencias de seguridad han señalado repetidamente como objetivo atractivo para campañas de ransomware e intrusiones vinculadas a estados.

Alongside the launch of GPT-6 Astra, we're committing $1 billion to subsidize Daybreak access and frontier capabilities to help frontline defenders protect essential services and critical infrastructure. Welcome to the AGI era for cybersecurity. — fouad (@fouadmatin) September 3, 2026

El programa incluye un piloto con el Multi-State Information Sharing and Analysis Center—una organización sin fines de lucro que apoya la ciberseguridad de gobiernos estatales y locales en Estados Unidos—e integra más de 35 productos de socios a través de la Daybreak Defense Network.

El acceso a la API tiene un precio de 10 dólares por millón de tokens de entrada y 50 dólares por millón de tokens de salida, con un modo rápido opcional disponible al doble de la tarifa estándar. Los administradores empresariales deben habilitar Astra explícitamente para sus espacios de trabajo, un diseño de participación voluntaria que da a las organizaciones control sobre cuándo las nuevas capacidades de frontera llegan a sus usuarios, y el modelo admite Zero Data Retention para clientes elegibles de la API, una función generalmente requerida por clientes de industrias reguladas que manejan datos sensibles.