Wie de eerste week van september volgde, zag vier nieuwe modellen langskomen in drie dagen: Anthropic op 1 september, Google en Meta op 2 september, OpenAI op 3 september. Dit is wat de grote namen vandaag kunnen en wat ze kosten. Begin met dat laatste, want daar zit het addertje: de prijs die vooraan op de pagina staat, is bij de meeste modellen niet de prijs die je betaalt.
Beginner-tipJe hoeft dit niet bij te houden om AI goed te gebruiken. Voor gewoon schrijf- en denkwerk zijn de verschillen tussen de topmodellen klein. Dit stuk is nuttig als je iets bouwt, een abonnement kiest, of wilt snappen waarom de ene tool duurder is dan de andere.
De week waarin ze allemaal tegelijk kwamen
Anthropic bracht op 1 september Claude Fable 5.1 en Mythos 5.1 uit. De basisprijs bleef staan; de opvallendste verandering zit in de cache, waar herhaald invoermateriaal 75 procent goedkoper werd. Fable en Mythos zijn hetzelfde onderliggende model met een andere afstelling: Fable heeft veiligheidsfilters voor cyber en biologie, Mythos heeft ruimere marges en is voorbehouden aan geverifieerde organisaties.
Google maakte op 2 september Gemini 3.8 Flash algemeen beschikbaar, tegen dezelfde prijs als zijn voorganger. Flash is de middenklasse, niet het vlaggenschip, en juist dat is het punt: Google zet zijn scherpste tarieven in de laag waar het meeste werk gebeurt.
Meta bracht diezelfde dag Muse Spark 1.3 uit, het model dat de Llama-lijn opvolgde als vlaggenschip. Closed-weight, alleen via de API, en met 48 punten op de Artificial Analysis Intelligence Index (mediaan: 24) bepaald geen bijrol. Voor een bedrijf dat jarenlang het gezicht van open modellen was, is dat een scherpe bocht.
OpenAI sloot op 3 september af met GPT-6 Astra: 1,05 miljoen tokens context, gericht op werk dat lang doorloopt, en het eerste model dat onder OpenAI’s eigen risicokader de hoogste klasse haalt voor cybercapaciteiten.
xAI deed eerder mee, op 12 augustus, met Grok 4.6: 500.000 tokens context en scherpe uitvoertarieven.
Wat ze kosten, en waar dat verandert
Prijzen per miljoen tokens, stand 9 september 2026:
| Model | Input | Output | Context | Waar het kantelt |
|---|---|---|---|---|
| GPT-6 Astra | $10 | $50 | 1,05M | boven 272K: $20 / $75 |
| Claude Fable 5.1 | $10 | $50 | 1M | vlak over het hele venster |
| GPT-5.6 Sol | $4 | $20 | ~1,05M | promo tot minstens 21 nov 2026 |
| Gemini 3.1 Pro | $2 | $12 | 1M | boven 200K: $4 / $18 |
| Grok 4.6 | $2 | $6 | 500K | vanaf 200K: $4 / $12 |
| Meta Muse Spark 1.3 | $1,25 | $4,25 | 1M | — |
| Gemini 3.8 Flash | $0,75 | $3,75 | 1M | promo tot 1 jan 2027, daarna dubbel |
| GPT-5.6 Luna | $0,20 | $1,20 | ~1,05M | — |
De laatste kolom is de belangrijkste. Bij vier van deze acht modellen kantelt de hele aanvraag naar een hoger tarief zodra je een drempel passeert — niet alleen het deel erboven. Eén token over de grens en ook alles eronder wordt herprijsd. Wie een miljoen-token-venster koopt en het ook gebruikt, betaalt bij Astra dus $20 en $75, niet $10 en $50.
Drie patronen die de tabel niet vanzelf laat zien
De stickerprijs is niet de prijs. Drie lagen bepalen wat je echt betaalt: de drempel hierboven, het promotarief (Sol tot minstens 21 november, Flash tot 1 januari) en de cache. Wie modellen vergelijkt op het getal dat vooraan staat, vergelijkt de verkeerde getallen. Claude Fable 5.1 is het enige topmodel dat één vlak tarief rekent over zijn volledige venster, en dat is bij lange-context-werk een groter voordeel dan welk benchmarkpunt ook.
Er wordt wél degelijk geconcurreerd op prijs. OpenAI verlaagde Sol op 21 augustus met 20 procent op invoer en een derde op uitvoer. Anthropic maakte cache-reads 75 procent goedkoper. En Meta zette een frontier-model neer op $1,25 en $4,25 — een achtste van het toptarief, met hetzelfde contextvenster. De concurrentie is niet verdwenen, ze is verschoven naar de assen die minder makkelijk te vergelijken zijn: cache, drempels en tijdelijke tarieven.
Open gewichten zijn niet meer waar het vlaggenschip zit. Meta was jarenlang de partij die zijn beste modellen vrijgaf. Dat is voorbij: het topmodel is closed-weight en API-only, en Llama 4 Behemoth is nooit verschenen. Wie open modellen wil draaien kijkt inmiddels naar andere namen; die zetten we op een rij in de staat van open-source AI.
GevorderdenDe cache-voorwaarden lopen tussen de twee duurste modellen precies tegengesteld. Anthropic bracht cache-reads bij Fable 5.1 van $1,00 naar $0,25; OpenAI rekent bij Astra $12,50 voor een cache-write, meer dan de $10 voor gewone invoer. Bij een systeem dat dezelfde lange system-prompt duizenden keren hergebruikt, kantelt dat detail de maandrekening harder dan het verschil in basistarief.
Wat je hiermee doet
De praktische vraag is niet welk model het beste is, maar welke laag bij je taak past. Drie vuistregels.
Voor schrijven, samenvatten en meedenken is elk topmodel goed genoeg en is de middenklasse dat meestal ook. Kies op gewenning en op integratie met wat je verder gebruikt, niet op benchmarks.
Voor werk op schaal — duizenden documenten classificeren, gegevens uitlezen, berichten routeren — is het lichtste model bijna altijd het juiste. Het verschil tussen $0,20 en $10 per miljoen tokens is een factor vijftig, en de taak is meestal simpel genoeg.
Voor agents en lange redeneerketens zijn de topmodellen hun geld waard, maar let op twee dingen: knip je invoer op zodat je onder de drempel blijft, en splits je werk. Laat een goedkoop model de tussenstappen doen en roep het vlaggenschip alleen aan voor de zware beslissing. In veel opzetten levert dat meer op dan overstappen naar een goedkopere aanbieder.
Stand van zaken — bijgewerkt 9 september 2026
- Vlaggenschepen: GPT-6 Astra (OpenAI, 3 sept), Claude Fable 5.1 (Anthropic, 1 sept), Gemini 3.1 Pro (Google), Grok 4.6 (xAI, 12 aug), Muse Spark 1.3 (Meta, 2 sept).
- Toptarief: $10 / $50 per miljoen tokens bij OpenAI en Anthropic — bij OpenAI alleen onder 272.000 tokens.
- Twee klokken die aflopen: het Sol-promotarief van $4/$20 geldt tot minstens 21 november 2026; Gemini 3.8 Flash staat op $0,75/$3,75 tot 1 januari 2027 en verdubbelt daarna.
- Gratis: voor GPT-6 Astra is geen gratis toegang aangekondigd.
Prijzen, versienummers en beschikbaarheid veranderen in deze markt per maand. Controleer voor een beslissing altijd de prijspagina van de aanbieder zelf; de tabel hierboven is een momentopname, geen belofte.
Een voorbeeld van hoe snel dat gaat: Gemini 3.8 Flash rekent tot 31 december 2026 een introprijs die daarna verdubbelt.
