Verdieping9 minGevorderd

Welk AI-model kan wat? De grote namen van 2026 op een rij

OpenAI, Anthropic, Google en Meta brachten in drie dagen nieuwe modellen uit. Wat ze kunnen, wat ze echt kosten en waarom de prijs op de pagina misleidt.

Miniatuur diorama-illustratie bij artikel 'Welk AI-model kan wat? De grote namen van 2026 op een rij'

Wie de eerste week van september volgde, zag vier nieuwe modellen langskomen in drie dagen: Anthropic op 1 september, Google en Meta op 2 september, OpenAI op 3 september. Dit is wat de grote namen vandaag kunnen en wat ze kosten. Begin met dat laatste, want daar zit het addertje: de prijs die vooraan op de pagina staat, is bij de meeste modellen niet de prijs die je betaalt.

Beginner-tipJe hoeft dit niet bij te houden om AI goed te gebruiken. Voor gewoon schrijf- en denkwerk zijn de verschillen tussen de topmodellen klein. Dit stuk is nuttig als je iets bouwt, een abonnement kiest, of wilt snappen waarom de ene tool duurder is dan de andere.

De week waarin ze allemaal tegelijk kwamen

Anthropic bracht op 1 september Claude Fable 5.1 en Mythos 5.1 uit. De basisprijs bleef staan; de opvallendste verandering zit in de cache, waar herhaald invoermateriaal 75 procent goedkoper werd. Fable en Mythos zijn hetzelfde onderliggende model met een andere afstelling: Fable heeft veiligheidsfilters voor cyber en biologie, Mythos heeft ruimere marges en is voorbehouden aan geverifieerde organisaties.

Google maakte op 2 september Gemini 3.8 Flash algemeen beschikbaar, tegen dezelfde prijs als zijn voorganger. Flash is de middenklasse, niet het vlaggenschip, en juist dat is het punt: Google zet zijn scherpste tarieven in de laag waar het meeste werk gebeurt.

Meta bracht diezelfde dag Muse Spark 1.3 uit, het model dat de Llama-lijn opvolgde als vlaggenschip. Closed-weight, alleen via de API, en met 48 punten op de Artificial Analysis Intelligence Index (mediaan: 24) bepaald geen bijrol. Voor een bedrijf dat jarenlang het gezicht van open modellen was, is dat een scherpe bocht.

OpenAI sloot op 3 september af met GPT-6 Astra: 1,05 miljoen tokens context, gericht op werk dat lang doorloopt, en het eerste model dat onder OpenAI’s eigen risicokader de hoogste klasse haalt voor cybercapaciteiten.

xAI deed eerder mee, op 12 augustus, met Grok 4.6: 500.000 tokens context en scherpe uitvoertarieven.

Wat ze kosten, en waar dat verandert

Prijzen per miljoen tokens, stand 9 september 2026:

ModelInputOutputContextWaar het kantelt
GPT-6 Astra$10$501,05Mboven 272K: $20 / $75
Claude Fable 5.1$10$501Mvlak over het hele venster
GPT-5.6 Sol$4$20~1,05Mpromo tot minstens 21 nov 2026
Gemini 3.1 Pro$2$121Mboven 200K: $4 / $18
Grok 4.6$2$6500Kvanaf 200K: $4 / $12
Meta Muse Spark 1.3$1,25$4,251M
Gemini 3.8 Flash$0,75$3,751Mpromo tot 1 jan 2027, daarna dubbel
GPT-5.6 Luna$0,20$1,20~1,05M

De laatste kolom is de belangrijkste. Bij vier van deze acht modellen kantelt de hele aanvraag naar een hoger tarief zodra je een drempel passeert — niet alleen het deel erboven. Eén token over de grens en ook alles eronder wordt herprijsd. Wie een miljoen-token-venster koopt en het ook gebruikt, betaalt bij Astra dus $20 en $75, niet $10 en $50.

Drie patronen die de tabel niet vanzelf laat zien

De stickerprijs is niet de prijs. Drie lagen bepalen wat je echt betaalt: de drempel hierboven, het promotarief (Sol tot minstens 21 november, Flash tot 1 januari) en de cache. Wie modellen vergelijkt op het getal dat vooraan staat, vergelijkt de verkeerde getallen. Claude Fable 5.1 is het enige topmodel dat één vlak tarief rekent over zijn volledige venster, en dat is bij lange-context-werk een groter voordeel dan welk benchmarkpunt ook.

Er wordt wél degelijk geconcurreerd op prijs. OpenAI verlaagde Sol op 21 augustus met 20 procent op invoer en een derde op uitvoer. Anthropic maakte cache-reads 75 procent goedkoper. En Meta zette een frontier-model neer op $1,25 en $4,25 — een achtste van het toptarief, met hetzelfde contextvenster. De concurrentie is niet verdwenen, ze is verschoven naar de assen die minder makkelijk te vergelijken zijn: cache, drempels en tijdelijke tarieven.

Open gewichten zijn niet meer waar het vlaggenschip zit. Meta was jarenlang de partij die zijn beste modellen vrijgaf. Dat is voorbij: het topmodel is closed-weight en API-only, en Llama 4 Behemoth is nooit verschenen. Wie open modellen wil draaien kijkt inmiddels naar andere namen; die zetten we op een rij in de staat van open-source AI.

GevorderdenDe cache-voorwaarden lopen tussen de twee duurste modellen precies tegengesteld. Anthropic bracht cache-reads bij Fable 5.1 van $1,00 naar $0,25; OpenAI rekent bij Astra $12,50 voor een cache-write, meer dan de $10 voor gewone invoer. Bij een systeem dat dezelfde lange system-prompt duizenden keren hergebruikt, kantelt dat detail de maandrekening harder dan het verschil in basistarief.

Wat je hiermee doet

De praktische vraag is niet welk model het beste is, maar welke laag bij je taak past. Drie vuistregels.

Voor schrijven, samenvatten en meedenken is elk topmodel goed genoeg en is de middenklasse dat meestal ook. Kies op gewenning en op integratie met wat je verder gebruikt, niet op benchmarks.

Voor werk op schaal — duizenden documenten classificeren, gegevens uitlezen, berichten routeren — is het lichtste model bijna altijd het juiste. Het verschil tussen $0,20 en $10 per miljoen tokens is een factor vijftig, en de taak is meestal simpel genoeg.

Voor agents en lange redeneerketens zijn de topmodellen hun geld waard, maar let op twee dingen: knip je invoer op zodat je onder de drempel blijft, en splits je werk. Laat een goedkoop model de tussenstappen doen en roep het vlaggenschip alleen aan voor de zware beslissing. In veel opzetten levert dat meer op dan overstappen naar een goedkopere aanbieder.

Stand van zaken — bijgewerkt 9 september 2026

  • Vlaggenschepen: GPT-6 Astra (OpenAI, 3 sept), Claude Fable 5.1 (Anthropic, 1 sept), Gemini 3.1 Pro (Google), Grok 4.6 (xAI, 12 aug), Muse Spark 1.3 (Meta, 2 sept).
  • Toptarief: $10 / $50 per miljoen tokens bij OpenAI en Anthropic — bij OpenAI alleen onder 272.000 tokens.
  • Twee klokken die aflopen: het Sol-promotarief van $4/$20 geldt tot minstens 21 november 2026; Gemini 3.8 Flash staat op $0,75/$3,75 tot 1 januari 2027 en verdubbelt daarna.
  • Gratis: voor GPT-6 Astra is geen gratis toegang aangekondigd.

Prijzen, versienummers en beschikbaarheid veranderen in deze markt per maand. Controleer voor een beslissing altijd de prijspagina van de aanbieder zelf; de tabel hierboven is een momentopname, geen belofte.

Een voorbeeld van hoe snel dat gaat: Gemini 3.8 Flash rekent tot 31 december 2026 een introprijs die daarna verdubbelt.

Veelgestelde vragen

Welk AI-model is het beste in 2026?

Er is geen model dat op alles wint, en de verschillen aan de top zijn kleiner dan de marketing suggereert. Voor zwaar redeneerwerk, lange codebases en agents die uren doorlopen staan GPT-6 Astra en Claude Fable 5.1 vooraan. Voor dagelijks tekstwerk zijn de topmodellen grofweg inwisselbaar en biedt een middenklasse-model als GPT-5.6 Sol, Gemini 3.1 Pro of Meta Muse Spark 1.3 een veel betere prijs-kwaliteitverhouding. Voor classificeren, samenvatten en data uitlezen op schaal is een licht model tientallen keren goedkoper en ruim voldoende.

Wat kosten de grote AI-modellen per miljoen tokens?

Stand 9 september 2026, invoer en uitvoer per miljoen tokens: GPT-6 Astra en Claude Fable 5.1 allebei $10 en $50. GPT-5.6 Sol $4 en $20, een promotarief dat tot minstens 21 november loopt. Gemini 3.1 Pro $2 en $12. Grok 4.6 $2 en $6. Meta Muse Spark 1.3 $1,25 en $4,25. Gemini 3.8 Flash $0,75 en $3,75, promotioneel tot 1 januari 2027. GPT-5.6 Luna $0,20 en $1,20. Let op de drempels: bij Astra, Sol, Gemini 3.1 Pro en Grok gaat de hele aanvraag naar een hoger tarief zodra je boven een bepaald aantal tokens komt.

Waarom klopt de prijs op de prijspagina vaak niet?

Om drie redenen. Ten eerste drempels: bij GPT-6 Astra kantelt de volledige aanvraag naar $20 en $75 boven 272.000 tokens, bij Gemini 3.1 Pro en Grok 4.6 gebeurt hetzelfde boven 200.000. Niet alleen het meerdere wordt duurder, alles. Ten tweede promotarieven: die van GPT-5.6 Sol loopt tot minstens 21 november 2026, die van Gemini 3.8 Flash tot 1 januari 2027, waarna hij verdubbelt. Ten derde de cache: herhaald invoermateriaal is fors goedkoper, maar het wegschrijven ernaartoe kan juist duurder zijn dan gewone invoer.

Is Meta gestopt met Llama?

Meta is gestopt met open-weight als koers voor zijn beste modellen. Sinds april 2026 brengt Meta Superintelligence Labs modellen uit onder de naam Muse Spark: closed-weight en alleen via de API, dus niet om zelf te downloaden en draaien. Muse Spark 1.3 verscheen op 2 september 2026 en scoort 48 op de Artificial Analysis Intelligence Index, ruim boven de mediaan van 24. Llama 4 Behemoth, het grote model dat in 2025 werd aangekondigd, is nooit uitgekomen en ook nooit formeel geschrapt. De bestaande Llama-modellen blijven beschikbaar.

Wat betekent een contextvenster van 1 miljoen tokens?

Het contextvenster is hoeveel tekst een model in één keer meeneemt: je vraag, de meegestuurde documenten en het antwoord samen. Een miljoen tokens is ruwweg 750.000 woorden, oftewel een flinke stapel boeken. GPT-6 Astra, Claude Fable 5.1, de Gemini-modellen en Muse Spark 1.3 zitten daar allemaal op; Grok 4.6 op 500.000. Twee kanttekeningen: een groot venster betekent niet dat het model alles even goed gebruikt (de kwaliteit zakt vaak in het midden van lange invoer), en bij de meeste aanbieders wordt het duur zodra je het echt volmaakt.

Bronnen

Waar deze informatie vandaan komt.