Security · Nyheter
När sandlådan inte höll: vad OpenAI:s agenttester visade
Vi går igenom incidenten med OpenAI och Hugging Face, METR:s slutsatser och en separat händelse med en offentlig wiki: vad som har bekräftats, vad som fortfarande är forskarnas bedömningar och vilka lärdomar det ger för kontrollen av agentsystem.