
Kan AI zelf wetenschap doen? Vier agents halen 60 van de 100
Een nieuwe benchmark liet vier AI-agents 40 onderzoeksvragen blind uitzoeken. Ze scoorden allemaal rond de 59 punten. Waarom het plafond niet bij de code zit.
Tag
1 artikel

Een nieuwe benchmark liet vier AI-agents 40 onderzoeksvragen blind uitzoeken. Ze scoorden allemaal rond de 59 punten. Waarom het plafond niet bij de code zit.