NieuwsAandelenxAI lanceert Grok 4.7 na herhaalde vertragingen, blijft op benchmarks achter bij frontier-rivalen

xAI lanceert Grok 4.7 na herhaalde vertragingen, blijft op benchmarks achter bij frontier-rivalen

Auteur: Decrypt·

Belangrijkste punten

  • Grok 4.7 gebruikt 2,1 biljoen parameters, een stijging van 40% ten opzichte van de 1,5 biljoen in Grok 4.6, en is geprijsd op $2 per miljoen inputtokens en $6 per miljoen outputtokens.
  • xAI vulde de training van het model aan met SpaceX-data, waaronder Starlink-satelliettelemetrie, productiegegevens en logboeken van technische storingen, met als doel het redeneren over hardware en fysische systemen te verbeteren.
  • Vroege benchmarkresultaten plaatsen Grok 4.7 op de tweede plek achter Claude Fable 5.1 op GDPval (1695 vs. 1735) en AA-Briefcase (1657 vs. 1678), en achter GPT-6 Astra op de EEBench-test voor elektrotechniek.
  • De lancering volgde op ten minste vijf herziene releaseplanningen sinds eind juli, en het model ging onmiddellijk live zonder wachtlijst in de Grok-app, Cursor, Grok Build en de xAI API.
  • Musk zei dat Grok 4.7 ongeveer gelijkwaardig zou moeten zijn aan Anthropic's Claude Opus 5.0, en schetste komende modellen—Grok 4.8, Grok 4.9 en een mogelijk frontier-leidende Grok 5—zonder releasedata toe te wijzen.
xAI lanceert Grok 4.7 na herhaalde vertragingen, blijft op benchmarks achter bij frontier-rivalen

Elon Musks xAI bracht maandagmiddag Grok 4.7 uit, het krachtigste model tot op heden, dat het bedrijf omschreef als "een opmerkelijke verbetering ten opzichte van Grok 4.6 tegen dezelfde prijs en snelheid."

Vroege benchmarkresultaten plaatsten het model op de tweede plek, achter Claude Fable 5.1 op GDPval en AA-Briefcase, en achter GPT-6 Astra op EEBench, een benchmark voor elektrotechniek.

De lancering volgde na een reeks verschoven deadlines. Musk heeft de planning sinds eind juli ten minste vijf keren bijgesteld: eerst "vier weken verwijderd", toen "een paar weken", toen "3 tot 4 weken", toen "10 dagen" op 1 september, en ten slotte "heeft nog een paar dagen meer nodig om te garen" op 11 september.

Deze keer is er geen wachtlijst. Grok 4.7 is onmiddellijk beschikbaar in de Grok-app, Cursor, Grok Build en de xAI API.

Musk volgde op op X en noemde Grok 4.7 "een sterke combinatie van intelligentie, snelheid & lage kosten."

Grok 4.7 is here. It's a notable improvement over Grok 4.6 at the same price and speed. pic.twitter.com/H3OTBbXyvO

SpaceXAI (@SpaceXAI) September 21, 2026

Volgens de officiële aankondiging van xAI besteedt het model meer tijd aan het doorwerken van moeilijke problemen en controleert het zijn eigen antwoorden vaker dan Grok 4.6 deed, naast wat het bedrijf zijn sterkste veiligheidsmaatregelen tot nu toe noemt.

##algrootte, prijzen en SpaceX-data

Grok 4.7 bevat 2,1 biljoen parameters, een stijging van 40% ten opzichte van de 1,5 biljoen in Grok 4.6, dat zelf een verfijning was van Grok 4.5. De kosten zijn vastgesteld op $2 per miljoen inputtokens en $6 per miljoen outputtokens. Parameters zijn de interne knoppen die een model tijdens training afstelt, en meer parameters betekent doorgaans meer capaciteit om patronen te leren, terwijl tokens de basiseenheden van informatie zijn die een AI-model kan registreren of genereren.

xAI voegde ook aanvullende trainingsdata toe afkomstig van SpaceX, Musks raketbedrijf: Starlink-satelliettelemetrie, productiegegevens en logboeken van technische storingen. De belofte is een model dat beter redeneert over hardware en fysische systemen dan alles wat puur op internett tekst is getraind.

Benchmarks vertellen een bekend verhaal

GDPval meet hoe een model presteert op echt, economisch waardevol kenniswerk—juridische notities, spreadsheets, presentaties—met behulp van taken die zijn beoordeeld door werkende professionals in elk vakgebied, en geeft hiervoor een Elo-rating, hetzelfde onderlinge rangschikkingssysteem dat de schaaksport gebruikt. Grok 4.7 scoorde 1695 op GDPval, terwijl Claude Fable 5.1 de lijst aanvoerde met 1735—aan een kloof van 40 punten op de Elo-schaal.

AA-Briefcase, gebouwd door Artificial Analysis, test kantoormerk van meerdere uren die onderzoek, analyse en documentproductie aan elkaar regelt in één lange taak, ook gescoord op de Elo-schaal. Grok 4.7 behaalde 1657 tegenover Fable 5.1's 1678—aan een smallere kloof van 21 punten, en hetzelfde resultaat op een andere test.

CursorBench 4.0, de benchmark van Cursor voor echte programmeertaken binnen zijn editor, zet nauwkeurigheid af tegen de kosten en het aantal tokens dat elke taak verbruikt. Grok 4.7 belandt in het midden: duurder per taak dan GPT-6 Astra, de opvolger van GPT-5.6 Sol, en Claude Sonnet 5, maar nog steeds onder Fable 5.1, dat op elke prijspunt op de grafiek wint.

Een terugkerend patroon voor xAI

Het bedrijf heeft herhaaldelijk vlaggenschipmodellen uitgebracht die bij onafhankelijke evaluaties achter rivalen aankwamen. Grok 4.5 debuteerde in juli met het grootste trainingscluster van de sector en derde-plaats scores achter Claude en OpenAI's modellen. Daarvoor ruilde Grok 4.20 betrouwbaarheid in voor snelheid en persoonlijkheid, en Grok 4.6 bleef achter het frontier-pakket op autonoom programmeren.\nNiets van dit alles maakt Grok 4.7 een slecht product voor de miljoenen mensen die er via X, de standalone app of het dashboard van hun Tesla mee praten. Het betekent wel dat het model dat het meest waarschijnlijk de vragen van gebruikers beantwoordt—of de stemassistent van hun auto aandrijft—draait op een systeem dat volgens de benchmarks van de maker zelf een tree onder de top van de ladder staat.

Die kloof is de reden waarom de prijs voor de meeste mensen zwaarder weegt dan de positie op de ranglijst. xAI heeft Anthropic en OpenAI consequent onderbied op kosten per token, zelfs als het achterblijft op rauwe capaciteit, in de gok dat "goed genoeg, goedkoop en overal" wint van "het beste, maar duurder" voor het gros van het dagelijkse gebruik.

Musks verwachtingen en de weg vooruit

Musk had de verwachtingen al dagen voor de lancering lager gelegd en schreef op X dat Grok 4.7 "ongeveer gelijkwaardig aan" Anthropic's Claude Opus 5.0 zou moeten zijn—niet de nieuwere Opus 5.1—waarbij multimodale prestaties nog verbetering behoeften.

In dezelfde post schetste hij de volgende drie modellen: Grok 4.8 als een betekenisvolle stap vooruit, Grok 4.9 in "Astra/Fable-klasse," en Grok 5 als een mogelijke frontier-leider. Die upgrades hebben nog geen releasedatum—een detail dat extra zwaar weegt nu de planning van Grok 4.7 zelf vóór de lancering ten minste vijf keer werd bijgesteld. "We shall see," schreef hij.