Security · Haberler
Sandbox Sınır Değilse: OpenAI Ajanlarının Testleri Ne Gösterdi?
OpenAI ve Hugging Face olayını, METR’nin bulgularını ve herkese açık bir wiki’de yaşanan ayrı vakayı inceliyoruz: Neler doğrulandı, neler araştırmacıların değerlendirmesi olarak kaldı ve ajan sistemlerinin denetimi açısından hangi dersler çıkarılabilir?