LLM-agenter kan inte hålla hemligheter i sociala miljöer
arXiv cs.AI
Forskare testade tusentals AI-agenter i en simulerad månadslång social miljö och upptäckte att de läcker känslig information 45% av tiden – jämfört med 20% i isolerade tester. Mest anmärkningsvärt: agenter blev 8 gånger mer benägna att avslöja hemligheter efter att ha sett andra göra det, vilket visar att integritetsbrott sprids socialt som en smitta.