Alibaba desafía a OpenAI y Anthropic con Qwen3.8-Max, su modelo de IA más grande hasta la fecha
Puntos clave
- •Qwen3.8-Max de Alibaba cuenta con 2,4 billones de parámetros y supuestamente iguala o supera a Fable 5 de Anthropic en múltiples benchmarks, al tiempo que supera a Kimi K3 de Moonshot.
- •La empresa planea publicar los pesos del modelo la próxima semana, lo que permitirá a los desarrolladores descargar y personalizar el sistema, marcando un regreso a las prácticas de código abierto tras un período propietario.
- •En arenas de evaluación por votación de usuarios, Qwen3.8-Max ocupó el quinto lugar en tareas de texto y el segundo en tareas de visión, solo por detrás de modelos premium selectos de Claude.
- •Anthropic ha acusado a operadores vinculados a Alibaba de utilizar miles de cuentas falsas para realizar casi 29 millones de intercambios con Claude, describiéndolo como la mayor campaña de destilación que ha enfrentado.
- •Las acciones de Alibaba subieron hasta un 7,3% tras el anuncio del debut, marcando el mejor desempeño de la acción en casi un mes.

Alibaba Group Holding Ltd. ha presentado Qwen3.8-Max, su modelo de inteligencia artificial más avanzado hasta la fecha, en vísperas de un lanzamiento planificado de pesos abiertos al público para la próxima semana.
El modelo cuenta con 2,4 billones de parámetros y supera al recién lanzado Kimi K3 de Moonshot en múltiples benchmarks. El lanzamiento también marca el regreso de Alibaba a sus orígenes de código abierto, tras un período en el que varios de sus modelos de IA de primer nivel fueron publicados como ofertas propietarias a principios de este año.
Qwen3.8-Max está disponible actualmente a través de las APIs de Model Studio de Alibaba Cloud y vía QwenWork, la plataforma asistente de IA de la empresa para clientes corporativos. El lanzamiento de pesos abiertos previsto para la próxima semana permitirá a los usuarios descargar los pesos del modelo y ajustar el sistema por sí mismos. Este movimiento sitúa a Alibaba en competencia directa con los rivales estadounidenses OpenAI y Anthropic.
A diferencia de los sistemas de IA propietarios que ofrecen acceso exclusivamente mediante API, un lanzamiento de pesos abiertos permite a desarrolladores y empresas descargar los pesos del modelo, personalizarlos para sus propios sistemas de IA propietarios y construir aplicaciones sobre ellos. Este enfoque otorga a las empresas un mayor control sobre el despliegue, la privacidad y la optimización del rendimiento, al tiempo que permite a los investigadores replicar y ampliar el trabajo de Alibaba sin partir de cero. La estrategia se alinea con el objetivo más amplio de Alibaba de acelerar la adopción empresarial en todo su ecosistema de IA. Los lanzamientos de pesos abiertos se han convertido en un elemento competitivo clave en la industria de la IA: la serie Llama de Meta demostró que los pesos de modelo disponibles gratuitamente pueden atraer grandes comunidades de desarrolladores e impulsar la adopción de las plataformas de nube y herramientas de la empresa que los publica.
Rendimiento en Benchmarks y Capacidades Autónomas
Según Alibaba, Qwen3.8-Max ha logrado resultados comparables a —o en algunos casos superiores a— los de Fable 5 de Anthropic en varios benchmarks. El modelo puede transformar fuentes de datos complejas, incluidas transmisiones de video y extensos manuales técnicos, en archivos navegables.
Entre las capacidades adicionales se incluyen la recreación de aplicaciones a partir de capturas de pantalla, el diseño de juegos interactivos y contenido educativo, y la conversión de planos planos en visualizaciones 3D inmersivas. Alibaba afirmó que el modelo destaca en codificación autónoma, investigación compleja y otras tareas que requieren un procesamiento sostenido durante períodos prolongados. Para demostrar su autonomía, el modelo gestionó de forma independiente un proyecto de software interno durante 16 días consecutivos. El sistema también mejora la eficiencia mediante la activación selectiva únicamente de los componentes necesarios: un diseño de Mezcla de Expertos que permite al modelo escalar a billones de parámetros manteniendo los costos de inferencia y la latencia en niveles manejables, un enfoque que también se utiliza en modelos de vanguardia de otros laboratorios líderes.
En arenas de evaluación por votación de usuarios, el modelo de Alibaba ha asegurado posiciones destacadas, solo por detrás de un grupo selecto de modelos premium de Claude. Obtuvo el quinto lugar en tareas de texto y el segundo en tareas de visión. El modelo se lanzó inicialmente el 19 de julio a través del plan de suscripción de Alibaba y su ecosistema Qoder, con la empresa afirmando en ese momento que su rendimiento ocupaba el segundo lugar, solo por detrás de Fable 5.
Tras el anuncio del debut, las acciones de Alibaba subieron hasta un 7,3%, marcando su mejor desempeño en casi un mes. La reacción del mercado subraya la creciente percepción de los inversores de que la IA es un motor de crecimiento a largo plazo principal para la empresa. Alibaba ha destinado recursos sustanciales a la computación en la nube y la IA generativa, con la expectativa de que un mejor rendimiento del modelo atraiga a más clientes corporativos a su plataforma en la nube y ecosistema de desarrolladores.
Escalada de la Competencia en IA entre China y Estados Unidos
El lanzamiento refleja la creciente rivalidad entre los desarrolladores de IA chinos y estadounidenses, ambos compitiendo por publicar modelos fundamentales cada vez más capaces a un ritmo acelerado. Las empresas ahora se diferencian no solo por sus puntuaciones en benchmarks, sino también por su capacidad de codificación, funcionalidad multimodal, integración empresarial y la disponibilidad de modelos de código abierto que los desarrolladores pueden adaptar libremente.
El debut de Qwen3.8-Max añade un mayor impulso al rápido avance de China en el sector, arriving poco después de que el modelo Kimi de Moonshot atrajera una atención significativa en los centros tecnológicos occidentales. Los laboratorios chinos continúan trabajando para reducir la brecha con OpenAI y Anthropic mientras operan con comparativamente menos recursos computacionales, una limitación impulsada en parte por los controles de exportación de Estados Unidos sobre chips avanzados de IA que restringen el acceso a las últimas GPU de NVIDIA y otro silicio de alto rendimiento. En desarrollos recientes, DeepSeek amplió el acceso a su modelo V4 Flash, mientras que ByteDance y MiniMax lanzaron ambos nuevos modelos de generación de video el viernes.
Vey-Sern Ling, director general de Union Bancaire Privée, sostuvo que los modelos chinos se están acercando a la paridad con los sistemas líderes de Estados Unidos. Declaró: "Muchos inversores siguen subestimando los modelos de IA chinos debido a las restricciones de chips de EE. UU. o al escepticismo general. En realidad, la brecha probablemente es mucho menor y se está reduciendo rápidamente. El Qwen 3.8 de Alibaba es otra prueba de ello, tras Kimi K3."
La rivalidad tecnológica entre ambas naciones se ha intensificado en los últimos meses. El gobierno de Estados Unidos prohibió previamente el acceso extranjero a los modelos Fable 5 y Mythos 5 de Anthropic, restringiéndolos temporalmente como medida de precaución para prevenir una posible evasión de seguridad por parte de las autoridades chinas. Posteriormente, Anthropic restableció el acceso a su base de usuarios en el extranjero por orden de Washington, señalando que estaba implementando salvaguardas más estrictas y que había asumido compromisos con el gobierno en materia de protección tecnológica.
Más recientemente, Anthropic acusó a desarrolladores chinos de llevar a cabo ataques de destilación. En una carta dirigida a dos legisladores estadounidenses, la empresa con sede en San Francisco declaró que operadores vinculados a Alibaba habían utilizado miles de cuentas falsas para realizar casi 29 millones de intercambios con Claude, describiéndolo como la campaña de extracción más grande que ha encontrado. Los ataques de destilación consisten en consultar sistemáticamente a un modelo para extraer sus resultados y utilizarlos para entrenar un modelo competidor, replicando efectivamente las capacidades del sistema objetivo sin acceso autorizado. Anthropic instó a los legisladores a responsabilizar a las entidades detrás de estos ataques y a fortalecer las medidas que prevengan la apropiación no autorizada de tecnología estadounidense.
Según Anthropic, la operación fue altamente selectiva, centrándose específicamente en las capacidades de Claude para gestionar proyectos complejos y razonamiento de alto nivel. La empresa declaró: "Los ataques de destilación convierten cientos de miles de millones de dólares en inversión estadounidense y [investigación y desarrollo] en un subsidio masivo para nuestros competidores geopolíticos."