Laboratorios de EE. UU. lideran el ranking de IA, con Anthropic, OpenAI y Google en la cima
Puntos clave
- •Claude Fable 5.1 (Max), Claude Opus 5.5 y Claude Sonnet 5.5, de Anthropic, ocupan las primeras posiciones del ranking de Agent Arena.
- •GPT-6 Astra y GPT-6.1 Sol, de OpenAI, siguen a los modelos de Anthropic, y GPT-6.1 Sol ingresó al ranking con una impresionante puntuación de mejora neta.
- •Gemini 4 Argon, de Google, completa los diez primeros, consolidando la presencia líder de los laboratorios estadounidenses en la clasificación.
- •El ranking abarca las categorías de código, chat y trabajo, por lo que las posiciones líderes reflejan amplitud entre distintos tipos de tareas y no solo fortaleza en una única métrica de referencia.
- •Se prevé que próximos lanzamientos de Anthropic, OpenAI y Google, junto con posibles movimientos de Meta y Alibaba, puedan modificar la clasificación hacia finales de octubre y noviembre de 2026.

El más reciente ranking de Agent Arena ha colocado a los laboratorios de Estados Unidos a la vanguardia de la resolución de problemas con agentes, el campo de la IA centrado en modelos capaces de planificar y ejecutar tareas de varios pasos de forma autónoma, con Anthropic, OpenAI y Google en las posiciones líderes de las categorías de código, chat y trabajo.
Los modelos de Anthropic —Claude Fable 5.1 (Max), Claude Opus 5.5 y Claude Sonnet 5.5— encabezan la tabla, seguidos por GPT-6 Astra y GPT6.1 Sol, de OpenAI. Gemini 4 Argon, de Google, completa los diez primeros. La clasificación apunta a un entorno altamente competitivo en el que los laboratorios estadounidenses dominan actualmente el desarrollo de modelos avanzados de IA. Anthropic, OpenAI y Google se encuentran entre los desarrolladores de IA con sede en Estados Unidos más destacados y están detrás de las familias de modelos Claude, GPT y Gemini, respectivamente. Debido a que la tabla abarca tareas de programación, conversación y trabajo, ocupar posiciones líderes en las tres categorías indica amplitud entre distintos tipos de tareas, en lugar de fortaleza en una sola métrica de referencia.
La tabla es dinámica y refleja avances recientes, incluida la entrada de GPT-6.1 Sol, de OpenAI, que se incorporó al ranking con una impresionante puntuación de mejora neta, una muestra de la rapidez con la que puede cambiar la clasificación cuando ingresan nuevos modelos.
El ranking refuerza el liderazgo de EE. UU.
La clasificación actual parece fortalecer la posición de los laboratorios estadounidenses —en particular Anthropic, OpenAI y Google— en el sector de los modelos de IA. La presencia continua de Anthropic en la cima de la tabla es consistente con un sólido desempeño en la resolución de problemas con agentes en múltiples categorías.
Para los desarrolladores y las empresas que siguen la evolución de los modelos, este tipo de tablas funciona como un punto de referencia compartido y actualizado periódicamente para comparar sistemas de frontera en tareas con agentes.
Los precios sugieren que existe potencial para un cambio en el ranking, ya que la competencia entre los principales modelos de IA sigue siendo intensa.
Qué observar
Se espera que la atención se concentre en los próximos lanzamientos y actualizaciones de líderes de IA como Anthropic, OpenAI y Google. La naturaleza dinámica del ranking indica que avances significativos o nuevos lanzamientos de modelos podrían alterar la clasificación actual.
Los observadores también siguen posibles movimientos de otros competidores, incluidos Meta y Alibaba —las empresas detrás de las familias de modelos Llama y Qwen, respectivamente—, que podrían afectar el panorama general e influir en el ranking hacia finales de octubre y noviembre de 2026.