NieuwsMacroMistral AI lanceert Mistral Large 4, het 1-biljoen-parametermodel met de bijnaam 'Le Chonk'

Mistral AI lanceert Mistral Large 4, het 1-biljoen-parametermodel met de bijnaam 'Le Chonk'

Auteur: Decrypt·

Belangrijkste punten

  • •Mistral Large 4 is een mixture-of-experts-model met 1 biljoen parameters dat elke query routeert naar specialistische subnetwerken, zodat per antwoord slechts 49 miljard parameters actief zijn; het bedrijf heeft het model officieel Le Chonk gedoopt.
  • •Met $1,36 per miljoen inputtokens en $4,18 per miljoen outputtokens kost het model ongeveer een derde van de inputprijs van Claude Opus 5.5 en ongeveer een vijfde van diens outputprijs.
  • •Mistral zegt eind oktober de gewichten van Large 4 te publiceren, zodat klanten het model op hun eigen infrastructuur kunnen draaien als onderdeel van zijn souvereine-AI-aanbod, waaronder een deal ter waarde van honderden miljoenen euro's met het Saoedische HUMAIN.
  • •In evaluaties door derden eindigde Mistral Large 4 als tweede in Surge AI's blinde codeertoets met 3,74 uit 5 achter Claude Opus 5, en scoorde het 59,9 op AutomationBench, ruim onder Gemini 4 Argon's 77,5.
  • •De lancering is de eerste mijlpaal op de routekaart die wordt gefinancierd door Mistral's Series D van €3 miljard ($3,37 miljard), opgehaald in september bij een waardering boven de €21 miljard in een ronde onder leiding van Samsung.
Mistral AI lanceert Mistral Large 4, het 1-biljoen-parametermodel met de bijnaam 'Le Chonk'

Het in Parijs gevestigde Mistral AI lanceerde dinsdag 6 oktober Mistral Large 4, een AI-model met 1 biljoen parameters dat het bedrijf nu "zeer officieel" Le Chonk noemt. Het model is geprijsd op $1,36 per miljoen inputtokens en $4,18 per miljoen outputtokens, en Mistral zegt eind oktober de modelgewichten vrij te geven.

Parameters zijn de aanpasbare getallen die een model tijdens training bijstelt — meer parameters betekent doorgaans meer leercapaciteit en hogere bedrijfskosten. Systemen van deze schaal zijn het type dat achter chatbots als ChatGPT en Claude zit.

Een mixture-of-experts-architectuur

Niet al die parameters werken tegelijk. Large 4 gebruikt een "mixture of experts"-ontwerp: het model routeert elke vraag naar een paar gespecialiseerde subnetwerken, waardoor per antwoord slechts 49 miljard parameters actief zijn. Het laag houden van het aantal actieve parameters helpt de bedrijfskosten beheersen. Mistral's vorige vlaggenschip, Large 3, werkte op dezelfde manier, met 41 miljard actieve parameters op een totaal van 675 miljard.

"[Mistral Large 4] behoort tot de voorhoede van open modellen en is verreweg het sterkste open-weight-model uit de VS of Europa," schreef Mistral AI's chief scientist Guillaume Lample op X.

Op Finance Agent v2 toont de lanceringsteller Large 4 op 54,7 — vóór GPT-6 Astra met 53,5, maar achter Claude Opus 5.5 met 58,6.

Prijsstelling onderbiedt concurrenten

Mistral factureert per token, de tekstbrokjes — elk goed voor ruwweg drie kwart woord — waarvoor AI-bedrijven rekenen. Met $1,36 per miljoen tokens en $4,18 per miljoen outputtokens ligt Large 4 op ongeveer een derde van de inputjs van Claude Opus 5.5 en een vijfde van diens outputprijs. Opus 5.5 rekent respectievelijk $4 en $20, terwijl GPT-6 Astra $10 en $50 vraagt — waarmee Large 4 ongeveer een zevende en een twaalfde van Astra's tarieven bedraagt. Omdat kosten per token meeschalen met gebruik, lopen die verschillen snel op voor ontwikkelaars met zware workloads.

Hoe "Le Chonk" aan zijn naam kwam

De bijnaam heeft een voorgeschiedenis. In juni, nadat Mistral zijn assistent Le Chat had omgedoopt tot Vibe, verzonnen fans op Reddit en X een fictief model genaamd Le Chaton Fat — zoiets als "het dikke katje" — met 30 biljoen parameters, 1.000 miauwen per seconde en vervalste benchmarks waarin het Claude Fable 5 versloeg.

The French Goverment needs to STOP Le Chaton Fat before it's too late. This is the FAT takeoff we've been warned against for years! pic.twitter.com/VoaBPJmfBT

— GLIF (@heyglif) June 15, 2026

CEO Arthur Mensch speelde het spel mee en antwoordde dat het model in werkelijkheid "le gros chaton" heette, Frans voor "het grote katje." Mistral voegde vervolgens een stripkatje toe aan zijn Vibe-website. In de echte lancering staat het model nu, "zeer officieel," als Le Chonk te boek.

Souvereine AI en nieuw kapitaal

Mistral verkoopt "souvereine AI" — modellen die een land of bedrijf kan bezitten en draaien zonder zijn data aan externe partijen te hoeven afstaan. Het door de staat gesteunde Saoedische HUMAIN tekende in augustus om die reden een deal met Mistral ter waarde van honderden miljoenen euro's. De geplande gewichtenvrijgave dient hetzelfde verhaal: gepubliceerde gewichten laten klanten het model draaien op infrastructuur die ze zelf beheren.

In september haalde Mistral een Series D op van €3 miljard ($3,37 miljard) — een financieringsronde waarin een bedrijf aandelen verkoopt aan investeerders — bij een waardering boven de €21 miljard ($23,6 miljard), in een ronde onder leiding van Samsung. Het bedrijf zegt dat Large 4 de eerste mijlpaal is op de routekaart die dat geld financiert.

Wat de benchmarks zeggen

In zijn aankondiging meet Mistral Large 4 vooral af tegen Chinese open-weight-modellen — DeepSeek V4 Pro, Kimi K3, GLM-5.3 en Qwen3.8 Max. "Open-weight" betekent dat iedereen het model kan downloaden en draaien. Claude- en GPT-modellen komen slechts in een handvol vergelijkingen voor, en de nieuwste Claude, Opus 5.5, verschijnt alleen in een claim over cybersecurity. Grafieken in lanceringsberichten zijn door de leverancier zelf samengesteld, juist daarom trekken scores van derden extra aandacht.

In een blinde menselijke evaluatie van codeerkiteit door Surge AI eindigde Mistral Large 4 als tweede van vijf modellen met 3,74 uit 5, achter Claude Opus 5 met 4,22.

AutomationBench, gerund door Artificial Analysis, geeft een AI 657 taken in gesimuleerde bedrijfsoftware — financiën, HR, sales en support — en beoordeelt welk deel van de doelen per taak wordt behaald, met nul punten bij het overtreden van een regel. Large 4 scoorde 59,9 punten. Op dezelfde benchmark haalde Claude Sonnet 5.5 71,8, Opus 5.5 69,5, en staat Gemini 4 Argon bovenaan met 77,5.

Op DeepSWE 1.1, een benchmark die ontwikkelaars raadplegen om te beoordelen hoe goed een model codeert, scoorde Large 4 een 62 — voor GLM-5.3 met 61 en DeepSeek V4 Pro met 57, maar achter Kimi K3 met 68. Datacurve's eigen ranglijst zet GPT-6 Astra en Claude Opus 5 op 74.

Mistral zegt eind oktober de gewichten van Large 4 vrij te geven — de getrainde getallen die het model laten werken — zodat externe ontwikkelaars het model kunnen downloaden en die claims zelf kunnen toetsen.