NoticiasMacroMistral AI lanza Mistral Large 4, el modelo de 1 billón de parámetros apodado 'Le Chonk'

Mistral AI lanza Mistral Large 4, el modelo de 1 billón de parámetros apodado 'Le Chonk'

Autor: Decrypt·

Puntos clave

  • •Mistral Large 4 es un modelo de mezcla de expertos de 1 billón de parámetros que dirige cada consulta a subredes especializadas, de modo que solo se activan 49.000 millones de parámetros por respuesta, y la empresa lo ha bautizado oficialmente como Le Chonk.
  • •Con $1.36 por millón de tokens de entrada y $4.18 por millón de tokens de salida, el modelo cuesta aproximadamente un tercio del precio de entrada de Claude Opus 5.5 y alrededor de un quinto de su precio de salida.
  • •Mistral dice que publicará los pesos de Large 4 a finales de octubre, permitiendo a los clientes ejecutar el modelo en su propia infraestructura como parte de su propuesta de IA soberana, que incluye un acuerdo por cientos de millones de euros con la saudita HUMAIN.
  • •En evaluaciones de terceros, Mistral Large 4 ocupó el segundo lugar en la evaluación a ciegas de programación de Surge AI con 3.74 sobre 5, por detrás de Claude Opus 5, y obtuvo 59.9 en AutomationBench, muy por debajo del 77.5 de Gemini 4 Argon.
  • •El lanzamiento es el primer hito de la hoja de ruta financiada por la Serie D de 3.000 millones de euros ($3.370 millones) de Mistral, levantada en septiembre con una valoración superior a 21.000 millones de euros en una ronda liderada por Samsung.
Mistral AI lanza Mistral Large 4, el modelo de 1 billón de parámetros apodado 'Le Chonk'

La parisina Mistral AI lanzó Mistral Large 4 el martes 6 de octubre, presentando un modelo de IA de 1 billón de parámetros al que la empresa ahora llama, "muy oficialmente", Le Chonk. El modelo tiene un precio de $1.36 por millón de tokens de entrada y $4.18 por millón de tokens de salida, y Mistral dice que publicará los pesos del modelo a finales de octubre.

Los parámetros son los números ajustables que un modelo afina durante el entrenamiento: más parámetros generalmente significa mayor capacidad de aprendizaje y mayores costos de operación. Los sistemas de esta escala son el tipo que está detrás de chatbots como ChatGPT y Claude.

Un diseño de mezcla de expertos

No todos esos parámetros funcionan a la vez. Large 4 utiliza un diseño de "mezcla de expertos", lo que significa que el modelo dirige cada pregunta a unas pocas subredes especializadas, de modo que solo se activan 49.000 millones de parámetros por respuesta. Mantener bajos los parámetros activos ayuda a contener esos costos operativos. El modelo insignia anterior de Mistral, Large 3, funcionaba de la misma manera, con 41.000 millones de parámetros activos de 675.000 millones en total.

"[Mistral Large 4] está en la frontera de los modelos abiertos, y por mucho es el modelo de pesos abiertos más fuerte de EE. UU. o Europa", escribió en X el director científico de Mistral AI, Guillaume Lample, en su cuenta de X.

En Finance Agent v2, el gráfico de lanzamiento muestra a Large 4 con 54.7, por delante de GPT-6 Astra con 53.5, pero por detrás de Claude Opus 5.5 con 58.6.

Precios que subcotan a los rivales

Mistral cobra por token, los fragmentos de texto —de aproximadamente tres cuartos de una palabra cada uno— por los que las empresas de IA facturan. Con $1.36 por millón de tokens y $4.18 por millón de tokens de salida, Large 4 se sitúa en alrededor de un tercio del precio de entrada de Claude Opus 5.5 y un quinto de su precio de salida. Opus 5.5 cobra $4 y $20, respectivamente, mientras que GPT-6 Astra cobra $10 y $50, lo que hace que Large 4 represente aproximadamente un séptimo y un doceavo de las tarifas de Astra. Como los cargos por token escalan con el uso, esas brechas se acumulan rápidamente para los desarrolladores con cargas de trabajo intensivas.

Cómo "Le Chonk" obtuvo su nombre

El apodo tiene una historia. En junio, después de que Mistral renombrara su asistente Le Chat como Vibe, fans en Reddit y X inventaron un modelo ficticio llamado Le Chaton Fat —algo así como "el gatito gordo"— con 30 billones de parámetros, 1.000 maullidos por segundo y benchmarks falsos que afirmaban que superaba a Claude Fable 5.

The French Goverment needs to STOP Le Chaton Fat before it's too late. This is the FAT takeoff we've been warned against for years! pic.twitter.com/VoaBPJmfBT

— GLIF (@heyglif) June 15, 2026

El CEO Arthur Mensch se sumó a la broma, respondiendo que el modelo en realidad se llamaba "le gros chaton", que en francés significa "el gatito grande". Mistral luego añadió un gato de caricatura a su sitio web de Vibe. Su verdadera publicación de lanzamiento ahora lista al modelo como, "muy oficialmente", Le Chonk.

IA soberana y nueva financiación

Mistral vende "IA soberana": modelos que un país o una empresa pueden poseer y ejecutar sin entregar sus datos a empresas externas. La saudita HUMAIN, respaldada por el Estado, firmó en agosto un acuerdo con Mistral por valor de cientos de millones de euros por exactamente esa razón. La publicación prevista de los pesos sirve para el mismo discurso: los pesos publicados permiten a los clientes ejecutar el modelo en infraestructura que ellos controlan.

En septiembre, Mistral levantó una Serie D de 3.000 millones de euros ($3.370 millones), una ronda de financiación en la que una empresa vende acciones a inversionistas, con una valoración superior a 21.000 millones de euros ($23.600 millones), en una ronda liderada por Samsung. La empresa dice que Large 4 es el primer hito de la hoja de ruta que financian esos fondos.

Lo que dicen los benchmarks

El anuncio de Mistral compara a Large 4 principalmente con modelos chinos de pesos abiertos: DeepSeek V4 Pro, Kimi K3, GLM-5.3 y Qwen3.8 Max. "Pesos abiertos" significa que cualquiera puede descargar y ejecutar el modelo. Los modelos Claude y GPT aparecen solo en un puñado de comparaciones, y el Claude más reciente, Opus 5.5, aparece únicamente en una afirmación sobre ciberseguridad. Los gráficos de las publicaciones de lanzamiento son compilados por el propio proveedor, razón por la cual los puntajes de terceros suelen atraer mayor atención.

En una evaluación humana a ciegas de calidad de programación realizada por Surge AI, Mistral Large 4 ocupó el segundo lugar entre cinco modelos con 3.74 sobre 5, por detrás del 4.22 de Claude Opus 5.

AutomationBench, operado por Artificial Analysis, asigna a una IA 657 tareas en software empresarial simulado —finanzas, RR. HH., ventas y soporte— y puntúa la proporción de los objetivos de cada tarea que completa, sin ningún crédito si incumple una regla. Large 4 obtuvo 59.9 puntos. En el mismo benchmark, Claude Sonnet 5.5 logró 71.8, Opus 5.5 alcanzó 69.5 y Gemini 4 Argon encabezó la tabla con77.5.

En DeepSWE 1.1, un benchmark que los desarrolladores consultan al evaluar qué tan bien programa un modelo, Large 4 obtuvo 62, por delante de GLM-5.3 con 61 y DeepSeek V4 Pro con 57, pero por detrás del 68 de Kimi K3. La tabla de Datacurve sitúa a GPT-6 Astra y Claude Opus 5 con 74.

Mistral dice que publicará los pesos de Large 4 —los números entrenados que hacen funcionar al modelo— a finales de octubre, lo que permitirá a desarrolladores externos descargar el modelo y comprobar por sí mismos esas afirmaciones.