Security · Leitfaden
Als die Sandbox keine Grenze war: Was die Tests mit OpenAI-Agenten zeigten
Wir untersuchen den Vorfall bei OpenAI und Hugging Face, die Erkenntnisse von METR und einen separaten Vorfall mit einem öffentlichen Wiki: Was bestätigt ist, was eine Einschätzung der Forschenden bleibt und welche Lehren sich daraus für die Kontrolle von Agentensystemen ziehen lassen.