NoticiasMacroOpenAI lanza GPT-6 Astra y lo presenta como su modelo más seguro, aunque aún peligroso

OpenAI lanza GPT-6 Astra y lo presenta como su modelo más seguro, aunque aún peligroso

Autor: AI Business·

Puntos clave

  • OpenAI lanzó GPT-6 Astra el jueves, presentándolo como su modelo más alineado hasta la fecha, con capacidades de uso de computadoras y ciberseguridad.
  • El lanzamiento sigue a una pausa temporal en el despliegue después de que un agente de OpenAI vulneró Hugging Face y otras plataformas, lo que llevó a un nuevo proceso de evaluación y protecciones más estrictas.
  • Astra puede manejar trabajo digital rutinario, incluido llenar formularios en línea, actualizar registros en un CRM, organizar calendarios, realizar investigaciones y redactar resúmenes de correos.
  • OpenAI reconoció que Astra sigue siendo peligroso, ya que puede encontrar fallas de seguridad desconocidas y desarrollar nuevas formas de explotarlas.
  • Los analistas cuestionaron las afirmaciones de que Astra representa la AGI, y lo describieron en cambio como un modelo de razonamiento de primer nivel que avanza la capacidad de los agentes para usar computadoras.
OpenAI lanza GPT-6 Astra y lo presenta como su modelo más seguro, aunque aún peligroso

OpenAI ha lanzado su tan esperado modelo GPT-6 Astra, una versión centrada en el uso de computadoras y la ciberseguridad con funciones de seguridad integradas. Presentado el jueves, Astra refleja una tendencia más amplia de modelos de IA que se convierten en "motores de razonamiento" capaces de identificar vulnerabilidades de seguridad, aunque aún conllevan riesgos. El lanzamiento llega mientras las empresas trasladan a los agentes de IA de proyectos piloto experimental a flujos de trabajo de producción, lo que eleva la exigencia sobre cómo los proveedores gestionan la autonomía, los controles de acceso y el uso indebido.

El modelo más alineado de OpenAI

OpenAI describió a Astra como su modelo más alineado hasta la fecha, ya que comprende mejor la intención del usuario y el comportamiento del modelo que sus predecesores. Los usuarios pueden delegar tareas confiando en el criterio del modelo. Según OpenAI, Astra puede llenar formularios en línea, actualizar registros de clientes en un CRM, organizar calendarios, realizar investigaciones en línea y redactar resúmenes de correos electrónicos: el tipo de trabajo digital rutinario que históricamente requería operadores humanos o scripts de automatización frágiles. La compañía indicó que las capacidades de uso de computadoras del modelo aplican en ámbitos como el desarrollo de videojuegos, la ingeniería eléctrica y el trabajo del conocimiento.

El lanzamiento sigue a la desaceleración temporal del despliegue del modelo por parte de OpenAI, después de que un agente de la empresa vulneró Hugging Face y otras plataformas. En respuesta, el laboratorio de IA afirmó que construyó un nuevo proceso de evaluación basado en el incidente de Hugging Face y fortaleció las protecciones contra acciones cibernéticas dañinas por parte del modelo. La solidez de ese nuevo proceso de evaluación será un caso de prueba clave para la industria, ya que los competidores enfrentan preguntas similares sobre cómo otorgar de forma segura a los agentes acceso a sistemas reales.

A pesar de las mejoras de seguridad, OpenAI reconoció que, con las herramientas y el acceso adecuados, Astra puede ser peligroso porque puede encontrar fallas de seguridad desconocidas y desarrollar nuevas formas de explotarlas.

"Según las noticias recientes, [la seguridad] ha sido uno de sus mayores problemas de imagen", afirmó Lian Jye Su, analista de Omdia, una división de Informa TechTarget. "Contar con eso es bastante significativo".

¿Es AGI?

Se ha informado que el presidente y cofundador de OpenAI, Greg Brockman, llamó a Astra el inicio de la inteligencia artificial general (AGI, por sus siglas en inglés), el punto en el que la IA puede realizar cualquier tarea intelectual tan bien como un ser humano, pero Su no estuvo de acuerdo.

"Llamarlo AGI es un poco exagerado en este punto", señaló Su. "Ahora es muy justo llamarlo el mejor modelo de razonamiento, o bien está acercándose mucho al razonamiento de nivel humano".

Su sostuvo que los modelos de mundo que impulsan dispositivos físicos están más cerca de la AGI que Astra. Lo que hace Astra, según él, es avanzar la capacidad de los agentes para usar computadoras.

La IA agéntica está madurando rápidamente, evolucionando de agentes que apenas identifican instrucciones mediante texto a agentes que interpretan el entorno local e interactúan con la infraestructura local de TI y software, como lo harían los humanos. El proveedor de búsqueda con IA Perplexity ya lo ha hecho con el uso de computadoras, y Anthropic también ha incorporado capacidades de uso de computadoras en sus modelos. OpenAI parece llevar esta tendencia más lejos con Astra, afirmando que el modelo maneja tareas complejas con velocidad, precisión y criterio.

"Ahora los agentes sí tienen su propio mecanismo de descubrimiento", comentó Su. "Entiende de manera independiente lo que está sucediendo y podrá formar su propio razonamiento y juicio".

Enfoque en uso de computadoras y ciberseguridad

El enfoque de OpenAI en el uso de computadoras, y la capacidad del modelo para ejecutar y delegar tareas en múltiples ámbitos mientras anticipa riesgos cibernéticos, también señala un cambio en la IA, afirmó Sid Nag, fundador y director de investigación de Tekonyx.

"La infraestructura de IA está pasando de hacer solo inferencia a la ejecución autónoma", declaró Nag.

Añadió que el énfasis de OpenAI en capacidades cibernéticas con Astra es significativo. El proveedor afirmó que el modelo puede identificar exploits de día cero para que los defensores cibernéticos encuentren y corrijan debilidades, lo que a la vez genera la necesidad de salvaguardas más estrictas. Esa naturaleza de doble uso —ayudar a los defensores a encontrar fallas mientras potencialmente ayuda a los atacantes a explotarlas— es central en el debate sobre cuánta capacidad cibernética debe liberarse en modelos de propósito general.

"La ciberseguridad en sí misma podría convertirse en la primera carga de trabajo donde la IA no solo crea el mecanismo de defensa..., sino también la infraestructura de ataque", señaló Nag.

Tradicionalmente, observó, los proveedores creaban modelos que destacaban en el razonamiento pero dejaban el componente de seguridad en manos de expertos tradicionales en ciberseguridad. Ahora, los proveedores de IA están poniendo mayor énfasis en incorporar la seguridad en la lógica del modelo.

Este cambio es evidente no solo en Astra sino también en Fable 5.1 de Anthropic, al que se le permite realizar descubrimiento de vulnerabilidades en código fuente durante el uso general, pero está restringido para tareas como la generación de exploits, el proceso de crear software que aprovecha una debilidad en una aplicación.

Los principales competidores en la carrera de la IA se están moviendo todos para incluir este componente cibernético, una convergencia que vale la pena observar mientras los reguladores y los equipos de seguridad empresarial evalúan cómo se gobiernan estas capacidades.

Fuente: AI Business