Security · Guida
Quando la sandbox non era un confine: cosa hanno rivelato i test sugli agenti OpenAI
Analizziamo l’incidente di OpenAI e Hugging Face, le conclusioni di METR e un episodio distinto su una wiki pubblica: cosa è confermato, cosa resta una valutazione dei ricercatori e quali lezioni offre per il controllo dei sistemi agentici.