AI Nieuws5 minGevorderd

Gemini 3.8 Flash: wat het kost, en wie de cyberversie krijgt

Derde Flash-release in zes weken. 3.8 Flash zit nu in de Gemini-app; de cyberversie die softwarelekken opspoort gaat alleen naar overheden en partners.

Miniatuur diorama-illustratie bij artikel 'Gemini 3.8 Flash: wat het kost, en wie de cyberversie krijgt'

Google bracht op 2 september Gemini 3.8 Flash uit, drie weken na 3.7 Flash en zes weken na de Flash daarvóór (Bron: Google). Interessanter dan het tempo is wat er níet bij zat: er is een tweede versie, gebouwd om beveiligingslekken op te sporen, en die krijg jij niet.

Wat is er nieuw aan Gemini 3.8 Flash?

Het korte antwoord: hetzelfde prijskaartje, meer doorzettingsvermogen. Google houdt de introductieprijs van 3.7 Flash aan — 0,75 dollar per miljoen invoertokens, 3,75 per miljoen uitvoertokens — en belooft betere prestaties bij programmeren, bij taken waarin het model zelfstandig stappen achter elkaar zet, en bij redeneren dat meerdere tussenstappen vraagt.

Die winst komt ergens vandaan. Google beschrijft het zelf als een ontwerpkeuze: het model werkt harder. Op ingewikkelde taken zet het extra redeneerstappen en roept het vaker gereedschap aan. Dat kost tokens. Voor eenvoudige klussen op groot volume kan 3.8 dus duurder uitvallen dan 3.7, en Google raadt daar zelf aan om een lager effort-niveau te kiezen of bij de oude versie te blijven.

Op benchmarks scoort het model 54,9 procent op HLE-Verified, een toets die meerstapsredeneren over uiteenlopende vakgebieden meet. Bij vergelijkingen op financiële en juridische taken wint het volgens Google van 3.7 Flash en van grotere concurrenten. Dat zijn cijfers van de maker, met alles wat daarbij hoort.

Beginner-tipEentokenis ongeveer een woorddeel; ruwweg 750 woorden per 1.000 tokens. De prijzen hierboven gaan dus over miljoenen woorden, niet over losse vragen. Als je gewoon de Gemini-app gebruikt, betaal je niets per token — dat zit in je abonnement.

Let op de vervaldatum van de prijs

In een voetnoot onder de aankondiging staat het echte prijsverhaal. De genoemde tarieven zijn introductieprijzen en gelden tot en met 31 december 2026. Vanaf 1 januari 2027 gaat het naar 1,50 dollar per miljoen invoertokens en 7,50 per miljoen uitvoertokens (Bron: Google).

Een verdubbeling, met een datum erbij. Wie nu een begroting maakt voor iets dat volgend jaar nog draait, rekent beter meteen met het hogere bedrag. Het patroon is niet nieuw: prijsvergelijkingen tussen AI-modellen verouderen sneller dan de modellen zelf.

Waarom gaat de cyberversie alleen naar overheden?

Gemini 3.8 Flash Cyber is getraind om kwetsbaarheden in software te vinden en te repareren. Google claimt daar concrete resultaten mee: het Chrome-beveiligingsteam kreeg 2,6 keer zoveel correcte patches uit dit model als uit de beste commerciële modellen die veel groter zijn, en een intern onderzoeksteam vond een kritieke kwetsbaarheid binnen twee uur waar zulk speurwerk normaal maanden kost.

Toegang loopt via het Fairwind Program, en dat is expliciet begrensd: overheidsinstanties, beheerders van kritieke infrastructuur en onderhouders van software kunnen toegang aanvragen (Bron: Google DeepMind). Om welke overheden het gaat, zegt Google niet.

De reden die het bedrijf geeft, is eerlijk genoeg. Datzelfde denken zagen we eerder terug toen OpenAI zijn beveiliging aanscherpte na een inbraak in een testomgeving: hoe capabeler het model, hoe smaller de kring die erbij mag. Het gewone 3.8 Flash heeft veiligheidsremmen tegen misbruik op het gebied van chemische, biologische, radiologische en nucleaire kennis, en tegen aanvallend cybergebruik. De Cyber-variant heeft “een ruimere set mitigaties” — vriendelijk geformuleerd voor: minder rem. Een model dat lekken kan vinden om ze te dichten, kan ze net zo goed vinden om erdoorheen te kruipen.

GevorderdenOp CWE-Bench, een externe test voor patch-kwaliteit, haalt 3.8 Flash Cyber 47,2 procent pass@1 tegen 47,8 procent voor een toonaangevend groter model — vergelijkbaar dus, tegen fors lagere kosten. De interessantere claim is de interne benchmark over twintig programmeertalen, waar het model boven de 70 procent uitkomt. Die test is niet publiek, dus onafhankelijk verifiëren kan niet.

Wat betekent dat voor de rest van internet?

Hier zit de vraag die de aankondiging onbeantwoord laat. Als het beste gereedschap om lekken te vinden voorbehouden blijft aan overheden en geselecteerde partners, wie repareert dan de software die daar niet onder valt? De open source-bibliotheken waar je bank op draait, de webshop van de zaak om de hoek, het contentmanagementsysteem van je vereniging.

Google noemt onderhouders van software wel expliciet als doelgroep voor Fairwind, wat het gat kleiner maakt. Maar aanvragen is iets anders dan krijgen, en een klein project met twee vrijwilligers loopt zelden voorop in zo’n procedure.

Er is ook een spiegelbeeld: dezelfde beperking is precies wat voorkomt dat het model een cadeautje wordt voor wie kwaad wil. Er is geen versie van dit besluit waarin iedereen tevreden is. Dat AI-beveiligingsgereedschap ongelijk verdeeld raakt, is wel iets om in de gaten te houden, en het past in een breder patroon dat we eerder zagen bij de leiderschapswissel boven Gemini: Google zet zwaar in op AI-veiligheid als onderscheidend punt.

Wat merk jij ervan?

Heb je Google AI Pro of Ultra, dan gebruik je 3.8 Flash nu al — in de Gemini-app, in AI Mode binnen Search en in Gemini in Google Sheets. Je hoeft niets aan te zetten. Wat je waarschijnlijk merkt, is dat langere klussen vaker in één keer afgemaakt worden.

Zit je op het gratis plan, dan verandert er voorlopig niets. En wil je juist mínder AI in je dagelijkse software, dan is de gids om AI overal uit te zetten nuttiger dan welke modelrelease ook.

Voor ontwikkelaars: 3.7 Flash blijft ondersteund. Er is geen migratiedeadline aangekondigd. De enige datum die je in je agenda hoeft te zetten is 31 december 2026, wanneer die introductieprijs afloopt.

Veelgestelde vragen

Wat is Gemini 3.8 Flash?

Gemini 3.8 Flash is het nieuwste snelle model van Google DeepMind, uitgebracht op 2 september 2026. Het is de opvolger van 3.7 Flash, dat drie weken eerder verscheen. Google positioneert het als het werkpaard-model: dezelfde snelheid en prijs als de vorige versie, maar beter in softwareontwikkeling, in taken waarbij het model zelfstandig stappen achter elkaar zet, en in redeneren over meerdere stappen. Er is een tweede variant, 3.8 Flash Cyber, die gespecialiseerd is in het vinden en repareren van beveiligingslekken. Die tweede variant is niet vrij beschikbaar.

Wat kost Gemini 3.8 Flash per token?

Google rekent 0,75 dollar per miljoen invoertokens en 3,75 dollar per miljoen uitvoertokens. Dat is dezelfde introductieprijs als bij 3.7 Flash. Let op de kleine letters: die prijs geldt tot en met 31 december 2026. Vanaf 1 januari 2027 verdubbelt hij naar 1,50 dollar per miljoen invoertokens en 7,50 dollar per miljoen uitvoertokens. Bouw je iets waarvan de kosten er in 2027 nog toe doen, reken dan met het hogere tarief. Google meldt daarnaast dat 3.8 Flash op complexe taken meer tokens verbruikt dan zijn voorganger, omdat het model extra redeneerstappen zet.

Wie krijgt toegang tot Gemini 3.8 Flash Cyber?

Alleen partijen die Google als verdedigers beschouwt. De toegang loopt via het Fairwind Program, waar overheidsinstanties, beheerders van kritieke infrastructuur en onderhouders van software toegang kunnen aanvragen. Google zegt niet om welke overheden het gaat. De reden voor de beperking staat in de aankondiging: het cybermodel heeft minder ingebouwde rem dan het gewone model, omdat het anders zijn werk niet kan doen. Een model dat kwetsbaarheden vindt om ze te dichten, kan die kwetsbaarheden ook vinden om ze te misbruiken.

Heb ik Gemini 3.8 Flash al als ik een Google-abonnement heb?

Ja, als je Google AI Pro of Ultra hebt. Google zegt dat 3.8 Flash voor die abonnees beschikbaar is in de Gemini-app, in AI Mode binnen Google Search en in Gemini in Google Sheets. Ontwikkelaars kunnen erbij via Google AI Studio, Android Studio en Google Antigravity. Zakelijke gebruikers via Gemini Enterprise. Wat je er in de praktijk van merkt is vooral snelheid bij langere klussen: het model is getraind om meerdere stappen achter elkaar te zetten zonder tussentijds te stoppen.

Is 3.7 Flash nu verouderd?

Nee, en Google zegt dat zelf ook met zoveel woorden. 3.7 Flash blijft volledig ondersteund voor werk waarbij zuinigheid vooropstaat. Dat is geen beleefdheidsfrase: omdat 3.8 Flash op zware taken meer redeneerstappen zet en dus meer tokens verbruikt, kan het voor eenvoudige, hoogvolume taken duurder uitpakken dan zijn voorganger. Google adviseert in dat geval een lager effort-niveau te kiezen of gewoon bij 3.7 Flash te blijven. Wie een pijplijn heeft draaien op 3.7, hoeft dus niets te doen.

Bronnen

Waar deze informatie vandaan komt.