Stand van zaken 9 juli 2026:Grok 4.5 verscheen gisteren, 8 juli. Dit stuk zet de cijfers op een rij en plaatst de release in de bredere lijn vanSpaceX’ overname van Cursorende compute-deals waarmee SpaceX rekenkracht verhuurt aan concurrenten.
Wat SpaceXAI precies uitbracht
SpaceXAI — de AI-tak die ontstond toen SpaceX eerder dit jaar Elon Musks xAI opslokte — bracht op 8 juli Grok 4.5 uit, het eerste grote model sinds de beursgang van het bedrijf een paar weken eerder (Bron: TechCrunch). Het model richt zich op coderen, agentic taken en algemeen kenniswerk: codebases repareren, spreadsheets bouwen die zelf webonderzoek doen, een outline omzetten naar een presentatie.
Het meest opvallende detail zit niet in de benchmarks, maar in de trainingsgeschiedenis: SpaceXAI trainde Grok 4.5 samen met Cursor (Bron: MarkTechPost) — de codeertool die SpaceX drie weken eerder voor 60 miljard dollar overnam. Dat is geen toeval. Het is het eerste concrete resultaat van een samenwerking die we al zagen aankomen.
Beginner-tip:“agentic” betekent dat een AI niet alleen antwoordt, maar zelfstandig meerdere stappen achter elkaar uitvoert — een bug opzoeken, hem fixen, en dan uitleggen wat er mis was, zonder dat jij elke stap apart hoeft te vragen.
Musk noemt het “Opus-class” — maar welke Opus precies?
Elon Musk introduceerde het model zelf op X: “Based on strong positive feedback from customers in our beta test program, @SpaceXAI will make Grok 4.5 available to the public tomorrow. It is an Opus-class model, but faster, more token-efficient and lower cost” (Bron: TechCrunch). In een vervolgpost werd hij specifieker: “Our internal assessment is that Grok 4.5 is roughly comparable to Opus 4.7, but much faster.”
Hier zit een klein maar veelzeggend detail dat in de meeste berichtgeving onderbelicht bleef: Musk vergelijkt zijn model in zijn eigen quote met Opus 4.7, terwijl SpaceXAI’s eigen gepubliceerde benchmarktabel Grok 4.5 juist naast Opus 4.8 (max) — de nieuwere versie — legt. Dat is voor de vergelijking niet dramatisch, want Anthropic hield de prijs bij de upgrade van 4.7 naar 4.8 bewust gelijk, maar het is wel een aanwijzing dat de marketingtekst en de eigen technische data niet helemaal synchroon liepen bij de lancering.
De benchmarks: dichtbij, niet op kop
SpaceXAI publiceerde zelf vier coderingsbenchmarks, en het eigen plaatje is eerlijker dan de tekst eromheen doet vermoeden. Claude Fable 5 (max) — Anthropics topmodel — scoort op alle vier het hoogst. Grok 4.5 komt het dichtstbij op Terminal-Bench 2.1.
| Benchmark | Grok 4.5 | Hoogst genoteerd | Overige |
|---|---|---|---|
| DeepSWE 1.0 (pass@1) | 62,0% | Fable (max) 66,1% | GPT-5.5 (xhigh) 64,3%; Opus 4.8 (max) 55,8% |
| DeepSWE 1.1 (mini-swe-agent) | 53% | Fable (max) 70% | GPT-5.5 (xhigh) 67%; Opus 4.8 (max) 59%; GLM-5.2 44% |
| Terminal-Bench 2.1 | 83,3% | Fable (max) 84,3% | GPT-5.5 (xhigh) 83,4%; Opus 4.8 (max) 78,9% |
| SWE-Bench Pro (resolve rate) | 64,7% | Fable (max) 80,4% | Opus 4.8 (max) 69,2%; GLM-5.2 62,1%; GPT-5.5 (xhigh) 58,6% |
“Pass@1” telt alleen pogingen die in één keer slagen; “resolve rate” is het aandeel opgeloste taken. Cijfers: SpaceXAI’s eigen gepubliceerde chart, via MarkTechPost.
Waar Grok 4.5 wél uitspringt, is efficiëntie. Op SWE-Bench Pro loste het model taken op met gemiddeld 15.954 outputtokens, tegen 67.020 voor Opus 4.8 (max) — zo’n 4,2 keer minder. Fewer tokens betekent minder kosten én minder wachttijd per taak, geserveerd op 80 tokens per seconde. Het model won verder de eerste plek op Harvey’s Legal Agent Benchmark, een test voor juridisch AI-gebruik, en is inmiddels het standaardmodel in Grok Build.
Gevorderden:de training zelf leunde zwaar op reinforcement learning over honderden duizenden taken, vooral meerstaps-softwareontwikkeling, met een asynchrone trainingsstack die agent-rollouts urenlang kan laten doorlopen terwijl het leerproces gewoon doorgaat. SpaceXAI benadrukt daarnaast investering in datafiltering: deduplicatie en kwaliteitsscoring vóór de eigenlijke training, niet alleen ruwe tokenvolume.
Prijs: goedkoper dan Opus, vergelijkbaar met het goedkoopste GPT-5.6-model
Grok 4.5 kost $2 per miljoen inputtokens en $6 per miljoen outputtokens. Ter vergelijking, volgens dezelfde TechCrunch-berichtgeving: Opus 4.7 (en dus ook 4.8, gelijke prijs) kost $5/$25, en OpenAI’s net aangekondigde GPT-5.6 hanteert een gelaagd prijsmodel — het topmodel Sol kost $5 voor input en $30 voor output, het goedkopere Luna-model $1/$6 (Bron: TechCrunch).
Grok 4.5 zit daarmee ergens tussen de twee OpenAI-varianten in, maar de token-efficiëntie maakt het verschil in de praktijk groter dan de kale prijs suggereert: minder tokens nodig per taak betekent een lagere rekening, ook bij een vergelijkbare prijs per token. Precies dezelfde dynamiek die we eerder beschreven toen Anthropic bleek te betalen voor de rekenkracht achter zijn eigen modellen — de zichtbare prijs per token is nooit het hele verhaal.
Toevallig valt de release in dezelfde week als een grote GPT-release: OpenAI brengt donderdag GPT-5.6 breed uit, nadat een eerdere, beperktere release van de Amerikaanse overheid moest wachten vanwege veiligheidszorgen (Bron: TechCrunch). Twee grote modellen, dezelfde week — de concurrentie tussen de AI-labs verslapt niet.
Nog niet in Europa
Voor Nederlandse gebruikers is er één praktisch punt dat in de internationale berichtgeving amper aandacht kreeg: Grok 4.5 is bij lancering niet beschikbaar in de EU. SpaceXAI verwacht EU-toegang “medio juli”, zonder een harde datum te noemen (Bron: MarkTechPost). Wie in Nederland via Grok Build of de SpaceXAI-console aan de slag wil, kijkt voorlopig tegen die regionale grens aan — ook al draait het model elders al gewoon, inclusief een gratis periode in Grok Build en Cursor.
Wat dit betekent voor Cursor — en voor Musks AI-stapel
Deze release beantwoordt gedeeltelijk een vraag die we stelden bij de overname van Cursor: kiest Musk voor Grok als standaardmodel in Cursor, of blijft de tool model-agnostisch? Het antwoord, voor nu: geen van beide volledig. Cursor draait door op Claude, GPT en zijn eigen Composer-modellen, en Grok 4.5 komt erbij als extra optie — beschikbaar op alle Cursor-abonnementen. Dat het model specifiek mét Cursor is getraind, is wel het duidelijkste signaal tot dusver dat de twee bedrijven nauwer gaan samenwerken dan een gewone leverancier-klantrelatie.
Zet de stukken naast elkaar en het patroon wordt scherper. Musk heeft via SpaceX de Colossus-datacenters, waar niet alleen Anthropic 1,25 miljard dollar per maand aan rekenkracht huurt, maar sinds een aangekondigde deal begin juni ook Google — 920 miljoen dollar per maand vanaf oktober 2026 tot en met juni 2029. Twee directe concurrenten van Grok betalen dus om straks te draaien op de infrastructuur van de partij die tegelijk zijn eigen model uitbrengt. Rekenkracht, codeertool én model komen bij dezelfde speler samen, en Grok 4.5 is het eerste product dat laat zien wat die combinatie oplevert.
Wat dit voor jou betekent
Voor de meeste gebruikers verandert er vandaag weinig: als je Grok, Cursor of Grok Build al gebruikt, zie je een snellere, goedkopere optie verschijnen naast wat je al had. Een week na deze release kwam Grok Build zelf wel in het nieuws — niet om z’n snelheid, maar om z’n dataverkeer. Zie onze duiding van het incident waarbij Grok CLI hele codebases (en soms je hele home directory) naar xAI uploadde voor wat je zelf kunt controleren als je de tool hebt geïnstalleerd. Voor Nederlandse developers geldt vooralsnog de EU-beperking. En voor wie een model kiest op basis van pure capaciteit blijven Claude Fable 5 en Opus 4.8 volgens SpaceXAI’s eigen cijfers de sterkere keuze — Grok 4.5 wint niet op kwaliteit, het wint op snelheid en prijs per opgeloste taak. Welke van die twee zwaarder weegt, hangt af van wat je bouwt.
