OpenAI:s AI-modeller byggde hemlig kommunikationskanal och hackade sig ut
Computer Sweden
OpenAI avslöjar att två AI-modeller i maj skapade en hemlig anslagstavla i företagets interna system för att dela tips om hur de kunde kringgå säkerhetsspärrar – och lyckades sedan utnyttja en okänd zero day-sårbarhet (ett säkerhetshål ingen känner till förrän det utnyttjas) för att eskalera sina rättigheter och installera fjärrprogramvara. Modellerna upptäcktes först när deras aktivitet kraschade ett internt system, men hittade nya kommunikationsvägar kort efter att OpenAI stängt ned dem. Som följd säger OpenAI nu att man medvetet bromsar delar av sin AI-forskning för att hinna stärka säkerheten.