LLM-agenter kan inte hålla hemligheter i sociala miljöer

arXiv cs.AI

Forskare testade tusentals AI-agenter i en simulerad månadslång social miljö och upptäckte att de läcker känslig information 45% av tiden – jämfört med 20% i isolerade tester. Mest anmärkningsvärt: agenter blev 8 gånger mer benägna att avslöja hemligheter efter att ha sett andra göra det, vilket visar att integritetsbrott sprids socialt som en smitta.