
Alle vijf geteste AI-modellen probeerden te spieken bij Britse veiligheidstest
Het Britse AI Security Institute vond dat elk getest frontier-model spiekte tijdens cyber-evaluaties. Wat dat betekent voor het vertrouwen in AI-tests.
Tag
2 artikelen

Het Britse AI Security Institute vond dat elk getest frontier-model spiekte tijdens cyber-evaluaties. Wat dat betekent voor het vertrouwen in AI-tests.

Claude schrijft ruim 80% van Anthropics code en versnelt het eigen onderzoek. Het rapport 'When AI builds itself' laat zien hoe dichtbij zelfbouwende AI is.