Vraag om een PDF, krijg een woordenbrij terug. Dat overkwam deze week een deel van de Grok-gebruikers: paragrafenlang losse woorden achter elkaar, zonder dat er ergens een foutmelding verscheen. Op status.x.ai stond intussen dat alles naar behoren werkte. Dat verschil tussen “de dienst draait” en “de dienst doet iets zinnigs” is het echte verhaal hier.
Wat er gebeurde
De eerste klachten kwamen woensdagochtend 19 augustus binnen. Gebruikers die TechCrunch sprak, zeiden dat ze op Grok Lite zaten toen hun antwoorden ontspoorden. Eén van hen vroeg het model om een PDF te maken en kreeg als openingsregel: “match it without and your they and two for planets can practical and often cheese…” — en dat ging nog een paar alinea’s zo door (Bron: TechCrunch).
Een andere gebruiker klikte de bronlinks aan die onder zo’n antwoord stonden. Die verwezen naar sites over reinforcement-learning-onderzoek, wat niets met de gestelde vraag te maken had.
Het officiële Grok-account op X reageerde nuchter: dit was “a rare temporary generation glitch”, en de raad was om een nieuwe chat te beginnen of het antwoord opnieuw te laten genereren. Daarbij verwees het account naar status.x.ai, waar alle Grok-diensten volledig operationeel stonden. Verder liet xAI het erbij; op vragen van TechCrunch kwam geen aanvullende reactie.
Beginner-tipOnsamenhangende woordenbrij is iets anders dan een verzonnen feit. Bij wartaal lopen de zinnen niet eens. Bij eenhallucinatieleest het antwoord juist prima en klopt het alleen niet. Het eerste los je op met opnieuw proberen, het tweede met een tweede bron.
Waarom de statuspagina niets zag
Een statuspagina meet beschikbaarheid. Draaien de servers, komen er antwoorden terug binnen de normale tijd, staan de foutpercentages laag? Op al die meetpunten deed Grok het gewoon goed. Er kwamen keurig antwoorden uit het systeem, netjes op tijd. Dat die antwoorden uit willekeurige woorden bestonden, valt buiten wat de monitoring meet.
Dit is geen eigenaardigheid van xAI. Vrijwel elke AI-dienst met een publieke statuspagina meet infrastructuur, niet inhoud. Een klassieke webshop die kapot is, geeft een foutcode terug; een taalmodel dat kapot is, geeft een antwoord terug. Het lijkt van buiten identiek aan een geslaagd verzoek.
Voor jou als gebruiker betekent dat: de groene vinkjes op een statuspagina zeggen weinig over de vraag of je vandaag op de uitkomsten kunt bouwen. Meldingen van andere gebruikers op X of Reddit zijn in dit soort gevallen sneller en eerlijker dan de officiële pagina.
GevorderdenBouw je op een API, log dan niet alleen HTTP-status en latency maar ook een goedkope kwaliteitscanary: een vaste prompt met een verwacht antwoordpatroon, elke paar minuten. Woordsalade valt daar direct doorheen, terwijl je uptime-dashboard nergens van weet.
Hoe groot was het eigenlijk?
Dat weet niemand precies, en dat is onderdeel van het probleem. TechCrunch probeerde de fout na te bootsen en kreeg gewoon normale antwoorden. Gizmodo zag hetzelfde beeld: veel meldingen, weinig reproduceerbaarheid. Dat wijst op een klein deel van het verkeer, mogelijk beperkt tot bepaalde modelvarianten of bepaalde servers.
Zonder cijfers van xAI blijft het gissen. Wie de dienst gebruikt voor werk, zit dan in een lastige positie: je weet niet of jij in de getroffen groep zit, en de officiële kanalen geven je geen manier om dat te controleren.
Wat je zelf kunt doen
Een paar dingen die vandaag al helpen, ongeacht welke assistent je gebruikt:
- Start een nieuwe chat zodra een antwoord ontspoort. Bij een generatiefout is dat vaak genoeg.
- Blijf niet regenereren als het twee keer misgaat. Wissel dan naar een andere assistent voor die taak.
- Houd belangrijk werk niet in één chatvenster. Kopieer tussenresultaten naar een document dat van jou is.
- Kijk verder dan de statuspagina. Zoek de naam van de dienst op X; storingen die de monitoring mist, zie je daar het eerst.
- Controleer wat je doorstuurt. Dit geldt sowieso, maar helemaal op een dag dat een model zich vreemd gedraagt.
GevorderdenDraai je een agent die zonder toezicht doorwerkt, zet er dan een sanity-check achter die de output afkeurt bij te lage taalcoherentie. Een agent die woordsalade doorgeeft aan een volgende stap, vervuilt je hele keten voordat iemand het merkt.
Het patroon achter dit incident
Grok had dit jaar al vaker last van storingen door de sterk gegroeide vraag, en eerder deze zomer speelde een aparte kwestie rond prompt-injectie via profielteksten. Losse incidenten, maar ze wijzen op hetzelfde: AI-diensten schalen sneller dan de instrumenten om ze te bewaken.
Voor de gewone gebruiker verschuift daarmee iets fundamenteels. Bij een kapotte website weet je dat ‘ie kapot is. Bij een kapot taalmodel moet je dat zelf zien aan de tekst. Dat vraagt een vorm van oplettendheid die we bij software niet gewend zijn — en die geen enkele statuspagina voor je overneemt.
Kreeg je deze week zelf wartaal uit Grok en heb je daarop iets gebaseerd? Loop dat werk nog even na.
