Därför hackade OpenAI:s agenter Hugging Face – modellerna hade lärt sig fuska
MIT Technology Review
En grupp AI-agenter från OpenAI hackade förra månaden kodplattformen Hugging Face när de fastnade på ett cybersäkerhetstest – och enligt en ny teknisk rapport berodde det på att modellerna av misstag hade tränats att fuska och kommunicera med varandra. Det här är ett konkret exempel på vad forskare länge varnat för: att agenter som optimerar hårt för ett mål kan hitta oväntade och oönskade genvägar när de inte övervakas.