AI Nieuws6 minGevorderd

Wat is GPT-NL? Nederlands taalmodel klaar voor bredere uitrol

GPT-NL, het Nederlandse taalmodel van TNO, SURF en NFI, draait bij de eerste testgebruikers. Wat het kan, wat het niet wil zijn, en wanneer jij het merkt.

Miniatuur diorama-illustratie bij artikel 'Wat is GPT-NL? Nederlands taalmodel klaar voor bredere uitrol'

Terwijl de discussie over Amerikaanse AI-modellen en Europese data maar doorgaat, bouwt Nederland stilletjes aan een eigen antwoord. GPT-NL — het taalmodel van TNO, SURF en het Nederlands Forensisch Instituut — draait inmiddels bij de eerste testgebruikers, en een bredere uitrol staat gepland voor de tweede helft van dit jaar (Bron: Digitale Overheid). Tijd om te kijken wat er nu eigenlijk staat, en voor wie het bedoeld is.

Een model met een ander doel

GPT-NL begon eind 2023 met een startbudget van 13,5 miljoen euro van de overheid (Bron: SURF). Dat bedrag zegt meteen waar het project wél en níet over gaat. OpenAI en Anthropic verbranden zulke bedragen in een dag; wie daarmee een ChatGPT-concurrent verwacht, begrijpt de opdracht verkeerd. GPT-NL mikt op iets anders: een model waarvan de data, de infrastructuur en de zeggenschap in Nederland liggen.

Dat “soeverein” is geen marketingterm maar de kern van het ontwerp. De training gebeurt op rechtmatig verkregen data — het project sloot er onder meer een licentieovereenkomst voor met NDP Nieuwsmedia, de branchevereniging van commerciële nieuwsmedia (Bron: Digitale Overheid). Journalistieke teksten zitten dus met toestemming en tegen vergoeding in het model. Vergelijk dat met de aanpak van de grote spelers, waar rechthebbenden achteraf via rechtszaken moeten uitvinden wat er met hun werk is gebeurd — een spanning die we eerder beschreven rond de afspraken tussen AI-bedrijven en de Nederlandse boekenwereld.

Beginner-tip:een “soeverein” taalmodel betekent simpelweg: de belangrijkste knoppen zitten in eigen land. Wie het traint, waarop het getraind is, waar het draait en wie erbij kan — dat ligt vast in Nederland, in plaats van bij een bedrijf in San Francisco of Hangzhou. Voor jou als gebruiker voelt het model verder gewoon als een chatbot.

Wat het nu kan

De eerste versies worden getest door een beperkte groep gebruikers, en de resultaten zijn eerlijk gerapporteerd: op bepaalde taken, zoals het samenvatten van teksten, presteert het model beter dan oudere modellen (Bron: Dutch IT Channel). Dat is geen bescheidenheid uit beleefdheid; het is de realistische plek van een publiek gefinancierd model in een markt waar de frontier elke drie maanden opschuift.

De strategie daarachter is verstandiger dan hij klinkt. Voor een gemeente die bezwaarschriften wil samenvatten, een ziekenhuis dat verslagen wil structureren of een forensisch instituut dat met vertrouwelijk bewijsmateriaal werkt, is de vraag niet “welk model scoort het hoogst op benchmarks” maar “welk model mag dit überhaupt zien”. Precies daar positioneert GPT-NL zich: gerichte inzet waar soevereiniteit, compliance en controle zwaarder wegen dan de laatste procenten slimheid. Wie wil weten hoe Amerikaanse aanbieders met Europese data omgaan, leest ons eerdere stuk Is Claude Europees? — en hoe knellend Europese regels voor die modellen zijn, bleek uit het Aithos-onderzoek naar EU-compliance.

Gevorderden:de interessantste ontwerpkeuze zit in de dataketen. Omdat elke bron gedocumenteerd en gelicentieerd is, kan GPT-NL herleidbaar maken wat erin zit — wat audits onder de EU AI Act aanzienlijk simpeler maakt dan bij een model dat op webscrapes is getraind. De prijs daarvoor is een kleiner datavolume, en dus een plafond op de brede capaciteiten. Dat is geen bug maar de bewuste trade-off van het hele project.

Wat er nog aankomt

De roadmap na de bredere uitrol is al geschetst: er wordt gewerkt aan een opvolger die meerdere talen ondersteunt, met verbeterde RAG — het bevragen van eigen documenten — en spraakherkenning (Bron: Digitale Overheid). Vooral die RAG-kant is logisch: het combineert de kracht van een klein, controleerbaar model met de kennis uit organisatie-eigen documenten, precies het terrein waar soevereine modellen hun waarde bewijzen.

De uitrol zelf gaat mogelijk ook via hostingproviders lopen, wat het model bereikbaar maakt voor organisaties zonder eigen AI-infrastructuur. Details over prijzen en voorwaarden zijn er nog niet; het project noemt de tweede helft van 2026 als planning en die is inmiddels begonnen.

Wat jij hiervan merkt

Als burger: voorlopig weinig direct, en dat is bij dit soort infrastructuur eerder een goed teken dan een slecht. GPT-NL is geen app die je downloadt, maar een bouwsteen die straks onder diensten van overheden en bedrijven kan liggen. Merk je hem op, dan waarschijnlijk als een overheidsdienst of zorgverlener ineens AI-functies aanbiedt zonder de disclaimer dat je gegevens naar een Amerikaanse cloud gaan.

Als ondernemer of beleidsmaker is het interessanter om nu al te volgen. De bredere uitrol dit half jaar bepaalt of GPT-NL een levensvatbaar alternatief wordt voor de gevoelige use cases, of een goedbedoeld experiment blijft. De eerste testresultaten en de nette dataketen geven het project in elk geval een eerlijke kans — en dat is voor publiek gefinancierde technologie al meer dan gebruikelijk.

Veelgestelde vragen

Wat is GPT-NL precies?

GPT-NL is een Nederlands taalmodel dat TNO, SURF en het Nederlands Forensisch Instituut samen bouwen, met publieke financiering. Het doel is een model waarvan de trainingsdata, de infrastructuur en de zeggenschap in Nederland liggen, zodat organisaties met gevoelige data of strenge compliance-eisen niet afhankelijk zijn van Amerikaanse of Chinese aanbieders.

Is GPT-NL een concurrent van ChatGPT?

Nee, en dat zegt het project zelf ook. GPT-NL is veel kleiner dan de Amerikaanse frontier-modellen en mikt op gerichte inzet: teksten samenvatten, domeinspecifieke toepassingen en situaties waar soevereiniteit en controle essentieel zijn. Voor brede consumententaken blijft ChatGPT of Claude sterker; voor een overheidsdienst die met vertrouwelijke stukken werkt, kan GPT-NL juist de veiligere keuze zijn.

Wanneer kan ik GPT-NL zelf gebruiken?

De eerste versies worden op dit moment getest door een beperkte groep gebruikers. Een bredere uitrol staat gepland voor de tweede helft van 2026, mogelijk ook via hostingpartijen. Het model richt zich in eerste instantie op organisaties — overheid, zorg, zakelijke gebruikers — en niet op een gratis consumenten-chatbot.

Waarom bouwt Nederland een eigen taalmodel?

Digitale autonomie. Vrijwel alle grote taalmodellen zijn Amerikaans of Chinees, met trainingsdata waarvan de herkomst vaak schimmig is en voorwaarden die buiten Europese controle vallen. GPT-NL wil laten zien dat het anders kan: transparant over data, gebouwd op afspraken met rechthebbenden (zoals de licentiedeal met de Nederlandse nieuwsmedia via NDP), en toetsbaar aan Europese regels zoals de AI Act en de AVG.

Waarop is GPT-NL getraind?

Op rechtmatig verkregen Nederlandstalige en Engelstalige data. Het project sloot onder meer een licentieovereenkomst met NDP Nieuwsmedia, de branchevereniging van commerciële nieuwsmedia, zodat journalistieke teksten met toestemming en tegen vergoeding in de training zitten. Dat contrast met de 'schrapen en zien wat ervan komt'-aanpak van veel grote modellen is precies het punt dat het project wil maken.

Bronnen

Waar deze informatie vandaan komt.