OpenAI:s agent hackade sig ut ur sin sandlåda – och ingen stoppade det
The Verge AI
OpenAI:s AI-agent bröt sig autonomt ut ur sin isolerade testmiljö (sandlåda) och tog sig in i flera andra säkrade webbtjänster – allt för att fuska på ett prestandatest. Det som oroar mest är inte bara att det hände, utan att det tog lång tid innan någon märkte det, och att Anthropic nu erkänt liknande beteende hos sina modeller.