Alibaba lanza Qwen3.8-Max como pesos abiertos y desafía a Claude y ChatGPT en costo y distribución
Puntos clave
- •Alibaba ha publicado Qwen3.8-Max como pesos abiertos, lo que lo convierte en el primer modelo Qwen de clase Max disponible para descarga gratuita y autoalojamiento.
- •El modelo de 2,4 billones de parámetros emplea un diseño Mixture-of-Experts que activa solo 95.000 millones de parámetros por cómputo para reducir los costos de inferencia manteniendo la capacidad general.
- •Qwen3.8-Max lidera la mayoría de las categorías de benchmarks en tareas multimodales que involucran documentos, video y razonamiento espacial, pero ganó solo siete de treinta y una pruebas de texto y una de doce evaluaciones específicas de programación.
- •Alibaba afirma que Qwen3.8-Max funciona a aproximadamente el 30% del costo de Claude Fable 5 de Anthropic, lo que lo convierte en una alternativa significativamente más económica incluso cuando se necesitan pasos de razonamiento adicionales.
- •El lanzamiento en pesos abiertos marca una reversión estratégica respecto a abril, cuando Alibaba eliminó el nivel gratuito de Qwen Code en medio de un movimiento más amplio hacia modelos cerrados y de pago.

Alibaba ha publicado Qwen3.8-Max, el modelo de inteligencia artificial más potente que ha construido jamás, lo que marca la primera vez que la empresa pone a disposición un modelo Qwen de clase Max como pesos abiertos.
Los pesos del modelo se publicarán en Hugging Face y ModelScope la semana siguiente al lanzamiento del lunes. Con un total de 2,4 billones de parámetros, de los cuales 95.000 millones se activan en cualquier momento dado, el modelo utiliza una arquitectura Mixture-of-Experts que dirige cada cómputo a través de un subconjunto de subredes especializadas en lugar de involucrar al modelo completo de una sola vez. Este diseño preserva la capacidad general mientras reduce los costos de inferencia, y está pensado para que las empresas más pequeñas y los laboratorios de investigación con hardware suficiente puedan ejecutar un sistema de última generación sin incurrir en los costos por token asociados con el uso de una API de un gran centro de datos.
Resultados de rendimiento centrados en la resistencia
En lugar de liderar con comparaciones convencionales de benchmarks, Alibaba enfatizó las capacidades autónomas sostenidas del modelo. Según la empresa, Qwen3.8-Max pasó 16 días construyendo de forma independiente una herramienta de programación, produciendo 265 commits, 127 pull requests y 151 issues sin intervención humana. También reprodujo supuestamente un artículo de investigación para el cual no tenía código fuente durante cinco días, y luego superó los resultados originales del artículo en 2,7 puntos. En una competencia de aprendizaje automático de 24 horas, el modelo superó a 458 de los 526 equipos humanos participantes.
Compatibilidad con herramientas de programación rivales
Qwen3.8-Max se distribuye con instrucciones de configuración para Claude Code de Anthropic y Codex de OpenAI, ambas plataformas competidoras. La API de Alibaba es compatible con los protocolos de ambas empresas, y la mayoría de los benchmarks de programación del modelo se realizaron dentro de Claude Code.
Los resultados de los benchmarks, sin embargo, son mixtos. En las 31 pruebas de texto de la tabla de evaluación propia de Alibaba, Fable 5 de Anthropic obtuvo el primer lugar en 15 categorías, GPT-5.6 Sol de OpenAI obtuvo nueve, y Qwen3.8-Max ganó siete. En 12 pruebas específicas de programación, Qwen ganó exactamente una.
Donde el modelo destaca es en la eficiencia de costos. Alibaba afirma que Qwen3.8-Max opera a aproximadamente el 30% de lo que Anthropic cobra por Claude Fable 5, lo que significa que incluso cuando se requieren iteraciones o pasos de razonamiento adicionales, el costo total de completar una tarea sigue siendo significativamente menor.
Las clasificaciones cambian sustancialmente en tareas multimodales que involucran documentos, video y razonamiento espacial, donde Qwen3.8-Max lidera la mayoría de las categorías de benchmarks.
Reversión estratégica sobre el acceso abierto
El lanzamiento representa un cambio de dirección notable. En abril, Alibaba eliminó el nivel gratuito de Qwen Code, y el equipo se movió hacia modelos cerrados y de pago tras la salida de líderes. Una reseña de Decrypt sobre Qwen 3.7 Max había señalado anteriormente que, mientras que la versión Plus sería abierta, se esperaba que la variante Max permaneciera accesible solo a través de la API.
El momento del lanzamiento en pesos abiertos coincide con cambios más amplios en el panorama de la inteligencia artificial. Los modelos chinos de pesos abiertos pasaron de menos del 2% de los tokens procesados en OpenRouter a finales de 2024 a aproximadamente el 61% hacia mediados de 2026. Qwen ha superado a Llama de Meta como el modelo más autoalojado del mundo.
La disponibilidad en formato de pesos abiertos significa que las organizaciones pueden descargar, auditar y ejecutar el modelo en su propia infraestructura, una propuesta atractiva para empresas con requisitos de soberanía de datos o que buscan evitar la dependencia de un único proveedor, particularmente a medida que las tensiones geopolíticas complican las dependencias de API transfronterizas.
Mientras tanto, Washington restringió Fable 5 y Mythos 5 bajo controles de exportación en junio, y Beijing estaría considerando sus propias limitaciones sobre los modelos chinos que se implementan en el extranjero.
Aunque Qwen3.8-Max queda por detrás de sus competidores en varias tablas de clasificación de benchmarks, Alibaba parece estar priorizando la distribución y la accesibilidad, posicionando el modelo como una alternativa gratuita y descargable que se acerca al rendimiento de los sistemas propietarios líderes a una fracción del costo.