AI Nieuws6 minGevorderd

Qwen 3.8 27B: gratis AI-model dat op je eigen computer draait

Alibaba gaf op 14 augustus een AI-model vrij dat je zelf mag draaien en commercieel mag gebruiken. Wat het kan, wat het kost en waar de haken zitten.

Miniatuur diorama-illustratie bij artikel 'Qwen 3.8 27B: gratis AI-model dat op je eigen computer draait'

Twee weken geleden gaf Meta zijn model Muse Glimmer vrij. Vier dagen later deed Alibaba hetzelfde met Qwen3.8-27B — en in het eerste weekend werd dat model ruim drie miljoen keer gedownload, nog voordat iemand van buiten het had kunnen testen. De open modellen zitten in een stroomversnelling. Dit is wat er precies is uitgebracht.

Wat er nieuw is

Qwen3.8-27B verscheen op 14 augustus 2026 onder de Apache 2.0-licentie. Dat laatste is het belangrijkste zinnetje van dit artikel: Apache 2.0 betekent dat je het model mag downloaden, aanpassen en commercieel gebruiken zonder toestemming vooraf en zonder afdracht (Bron: DataNorth).

Het is een dense model van 27 miljard parameters — geen mixture-of-experts, maar één samenhangend geheel dat bij elke vraag volledig wordt gebruikt. Het accepteert tekst, afbeeldingen én video als invoer, met een venster van 262.144 tokens dat Alibaba naar eigen zeggen tot een miljoen laat oprekken.

Beginner-tip“open weights” betekent dat het bestand waarin het model zit vrij te downloaden is. Dat is iets anders dan open source in de klassieke zin — de trainingsdata en het trainingsrecept blijven geheim. Wat je krijgt is het eindproduct, niet de keuken. Meer over dit onderscheid staat in ons overzicht vanopen-source AI in 2026.

De cijfers, en waarom je ze met een korrel zout neemt

Alibaba publiceerde een benchmarktabel die er goed uitziet. Op SWE-bench Pro, een test voor programmeerwerk, scoort Qwen3.8-27B 61,7 procent tegen 53,4 procent voor Claude Opus 4.6 Max. Op Terminal Bench 2.1 blijft het juist achter: 73,0 tegen 78,2 procent. Op algemeen redeneren is het beeld gemengd — 89,2 procent op GPQA Diamond tegen 91,3 voor Claude, maar 30,8 tegen 40,0 procent op Humanity’s Last Exam.

Drie kanttekeningen, want die horen erbij.

De eerste: dit zijn Alibaba’s eigen metingen. De testopstelling is wel gepubliceerd — alle modellen door dezelfde harness, temperatuur 1,0 — wat meer transparantie is dan de meeste vendors bieden, maar het blijft de partij die iets te verkopen heeft die de scores berekent.

De tweede: de allerbreedste marges staan op benchmarks die Alibaba zelf heeft gemaakt en waarvan geen takenlijst is gepubliceerd. Die zijn niet te controleren en dus niet te gebruiken.

De derde: Alibaba geeft aan een aantal taken in SWE-bench Pro te hebben gecorrigeerd en alle modellen op die aangepaste set opnieuw te hebben getest. Dat kan een verdedigbare technische keuze zijn, maar het maakt de getallen niet vergelijkbaar met scores die elders op de originele benchmark zijn gehaald.

GevorderdenDe architectuur is opvallender dan de scores. Het model draait 64 lagen in een herhalend patroon van drie Gated DeltaNet-blokken op één Gated Attention-blok, en is getraind met multi-token prediction. De contextvenster-uitbreiding naar een miljoen tokens loopt via YaRN, waarbij Alibaba in de eigen modelkaart waarschuwt dat de gangbare open-source frameworks YaRN statisch implementeren en daardoor nauwkeurigheid kunnen verliezen op korte invoer.

Wat het praktisch betekent

De belofte is dat een model dat op één zware desktop-GPU past nu het soort werk aankan waarvoor je tot voor kort een cloudmodel nodig had: langlopende taken met gereedschap erbij, code, documenten, schermafbeeldingen. Er is ook een FP8-variant die met een zuiniger getalformaat werkt en volgens Alibaba vrijwel dezelfde prestaties levert bij ongeveer de helft van het geheugen.

Voor wie liever niets zelf beheert: een eigen gehoste dienst van Alibaba is er nog niet. De modelkaart belooft “Qwen Cloud coming soon”, en die pagina gaf op 17 augustus nog een 404. Wie vandaag een endpoint wil, komt uit bij OpenRouter, dat 0,45 dollar per miljoen ingaande en 3,20 dollar per miljoen uitgaande tokens rekent. Ziet iemand een officiële Alibaba-prijs voor dit model langskomen, dan is die verzonnen.

Qwen3.8-27BMuse Glimmer (Meta)
Uitgebracht14 augustus 202610 augustus 2026
Omvang27 miljard parameters30 miljard parameters
LicentieApache 2.0Apache 2.0
InvoerTekst, beeld, videoTekst
Gehoste prijsNog geen officiëleNog geen officiële

Waarom dit ertoe doet

Wat je hier ziet is niet één modelrelease maar een tempo. Alibaba kondigde het 27B-model aan op 3 augustus bij de lancering van het veel grotere Qwen3.8-Max, en leverde elf dagen later. Meta ging vier dagen daarvoor. Beide bedrijven kozen dezelfde licentie en mikken op dezelfde plek: een model dat je zelf draait, dat niet elke vraag naar een Amerikaanse of Chinese server stuurt, en dat geen abonnement nodig heeft.

Voor de meeste mensen verandert er morgen niets. Je gebruikt ChatGPT of Copilot en dat blijft eenvoudiger. Maar voor iedereen die twijfelt of gevoelige documenten wel de deur uit moeten, wordt het alternatief elke maand serieuzer. Ondernemers die willen weten wat dat concreet betekent voor hun eigen data en AI-rekening, vinden op AI Platform MKB de zakelijke kant van dit verhaal — en wie het model daadwerkelijk wil installeren, kan terecht bij de Qwen-toolpagina op De Beste AI Tools.

Veelgestelde vragen

Wat is Qwen 3.8 27B precies?

Een AI-taalmodel van Alibaba met 27 miljard parameters, uitgebracht op 14 augustus 2026. Anders dan ChatGPT of Claude draait het niet verplicht in de cloud: de gewichten — het bestand waar het model uit bestaat — staan vrij te downloaden op Hugging Face en ModelScope. Het is een multimodaal model, wat betekent dat je er behalve tekst ook afbeeldingen en video in kunt stoppen. Uit komt tekst.

Is Qwen 3.8 27B echt gratis?

De gewichten wel. Ze staan onder de Apache 2.0-licentie, wat betekent dat je het model mag gebruiken, aanpassen en commercieel inzetten zonder omzetafdracht of toestemming vooraf. Dat is ruimer dan de eigen licentie die Alibaba aan het grotere Qwen3.8-Max hing. Wat niet gratis is, is het draaien: je hebt zware hardware nodig, of je huurt rekenkracht bij een aanbieder. Bij OpenRouter kost het model 0,45 dollar per miljoen ingaande tokens en 3,20 dollar per miljoen uitgaande.

Wat voor computer heb ik nodig om het lokaal te draaien?

Meer dan een gemiddelde laptop. Alibaba mikt op één high-end consumenten- of workstation-GPU. Er is ook een FP8-variant, Qwen3.8-27B-FP8, die met een zuiniger getalformaat werkt en volgens Alibaba nagenoeg even goed presteert — die halveert het geheugengebruik ruwweg. Voor het serveren zijn recepten gepubliceerd voor vLLM en SGLang. Wil je gewoon uitproberen zonder gedoe, dan is een gehoste route via een aanbieder eenvoudiger.

Hoe verhoudt het zich tot het gratis model van Meta?

Meta bracht op 10 augustus Muse Glimmer uit, een open-weight model van 30 miljard parameters onder dezelfde Apache 2.0-licentie en met hetzelfde doel: een lokale agent die altijd aan kan staan. Op de vier benchmarks waar Alibaba beide modellen naast elkaar zet, wint Qwen3.8-27B alle vier. Dat zijn wel Alibaba's eigen metingen van andermans model, dus de marges verdienen scepsis. De testopstelling en instellingen zijn in elk geval gepubliceerd, wat bij zulke vergelijkingen niet vanzelfsprekend is.

Maakt het uit dat het model uit China komt?

Voor het draaien op je eigen hardware technisch niet: de gewichten zijn een bestand, en offline gaat er geen data naar Alibaba. Gebruik je een gehoste versie, dan geldt hetzelfde verhaal als bij elke cloudaanbieder — kijk waar de servers staan en wat er met je invoer gebeurt. Inhoudelijk is het wel relevant dat Chinese modellen op politiek gevoelige onderwerpen andere antwoorden geven; dat is bij eerdere Qwen- en DeepSeek-versies herhaaldelijk vastgesteld.

Bronnen

Waar deze informatie vandaan komt.