
Kan AI zelf wetenschap doen? Vier agents halen 60 van de 100
Een nieuwe benchmark liet vier AI-agents 40 onderzoeksvragen blind uitzoeken. Ze scoorden allemaal rond de 59 punten. Waarom het plafond niet bij de code zit.
Tag
2 artikelen

Een nieuwe benchmark liet vier AI-agents 40 onderzoeksvragen blind uitzoeken. Ze scoorden allemaal rond de 59 punten. Waarom het plafond niet bij de code zit.

Een audit van 2,5 miljoen papers vond ongeveer 146.900 verzonnen citaties uit AI. Wat het betekent voor je vertrouwen in onderzoek.