Je klikt op een bronlink onder een artikel uit 2019 en krijgt een 404. Je zoekt een oud persbericht terug en het staat er niet meer. Het overkomt iedereen wel eens, en het voelt als pech. Het is inmiddels eerder de regel.
Pew Research Center telde webpagina’s die tussen 2013 en 2023 online stonden en kwam erop uit dat een kwart daarvan verdwenen is. Dat verschijnsel heet link rot en bestaat al zolang het web bestaat. Wat er in 2026 bij is gekomen, is een tweede beweging die de eerste versnelt.
Update 25 september 2026De passage over Cloudflare is gecorrigeerd. Het gaat om al het botverkeer, waar AI-crawlers en -agents deel van uitmaken: volgens Cloudflare doen bots sinds begin juni 2026 voor het eerst meer webverzoeken dan mensen (Tom’s Hardware). Ook beschrijven we het omzeilen van blokkades via de Wayback Machine nu als wat uitgevers vrezen, omdat het bewijs daarvoor niet openbaar is.
Het archief wordt buitengesloten
De afgelopen twee jaar hebben veel uitgevers AI-crawlers de toegang tot hun site ontzegd. Begrijpelijk: ze willen niet dat hun werk gratis in een taalmodel verdwijnt dat vervolgens hun lezers wegkaapt.
Daarna ontstond een nieuwe zorg: AI-bedrijven zouden alsnog bij die artikelen kunnen komen via de Wayback Machine. Het archief bewaarde immers al een kopie, en dat archief blokkeerde niemand. The New York Times noemt die vrees als reden om het archief te weren, schrijft de EFF.
De reactie van uitgevers laat zich raden. Steeds meer nieuwssites houden nu ook het Internet Archive buiten de deur. De Electronic Frontier Foundation waarschuwde in maart 2026 dat dit de AI-training nauwelijks zal tegenhouden, terwijl het wél het historische register van het web uitwist. Uitgevers verdedigen zich tegen de ene partij en raken daarbij de dienst kwijt die hun eigen werk bewaarde.
Zo verdwijnt het geheugen van het web niet omdat iemand dat wil, maar als bijvangst van een conflict tussen twee andere partijen.
Er lopen meer machines dan mensen
Ondertussen verschuift wie het web eigenlijk nog bezoekt. Cloudflare, dat een groot deel van het internetverkeer ziet langskomen, meldde begin juni 2026 dat bots voor het eerst meer verzoeken doen dan mensen: 57,5 tegen 42,5 procent (Tom’s Hardware). Onder die bots vallen ouderwetse zoekmachinecrawlers, maar ook AI-crawlers en AI-agents die namens gebruikers surfen. Topman Matthew Prince had die omslag pas in 2027 verwacht.
Voor een site betekent dat iets ongemakkelijks: de pagina wordt vaker opgehaald dan ooit, en tegelijk komt er minder bezoek. Wikipedia is daar het duidelijkste voorbeeld van. De Wikimedia Foundation telde in de zomer van 2025 zo’n 8 procent minder menselijke paginaweergaven dan in dezelfde maanden van 2024, en wijt dat mede aan generatieve AI (Wikimedia). De encyclopedie wordt door vrijwel elke chatbot geraadpleegd, maar de lezer die vroeger op de bronvermelding klikte en soms bleef hangen of doneerde, blijft weg. Het materiaal circuleert, de infrastructuur eronder niet.
Wat je zelf kunt doen
Voor de meeste mensen is dit een probleem dat pas zichtbaar wordt op het moment dat je iets wilt nakijken. Een paar dingen helpen dan wel:
- Bewaar wat je nodig hebt, meteen. Op web.archive.org staat onderaan Save Page Now. Plak de URL en er wordt direct een kopie gemaakt, als de site dat toelaat.
- Link naar de archiefkopie naast het origineel. In een scriptie, offerte of raadsstuk voorkomt dat dat je bron over twee jaar niets meer bewijst.
- Vertrouw een chatbot-antwoord niet zonder werkende bron. Verwijst het naar een pagina die niet meer bestaat, dan valt er ook niets te controleren.
Er komt geen moment waarop het web ineens leeg is. Het slijt, pagina voor pagina, en het valt pas op als je iets terug wilt zoeken dat er vorig jaar nog stond.
