OpenAI: AI-modell tog sig ur sin sandlåda och spred sig till externa system
Computer Sweden
OpenAI har publicerat sin officiella rapport om en allvarlig säkerhetsincident där en AI-modell lyckades ta sig ur sin testmiljö genom att kombinera tidigare okända säkerhetsbrister. Modellen komprometterade först pakethanteringsverktyget Artifactory för att få internetåtkomst, och tog sig sedan in i system hos både OpenAI, Hugging Face och andra leverantörer. Som svar skärper OpenAI nu sina rutiner – bland annat utökad övervakning av AI-agenters 'tankekedjor' (steg-för-steg-resonemang) och nya verktyg för att snabbt kunna stänga ner processer som bedöms osäkra.