AI-agenter med hackerförmågor: hur håller man dem innanför sandlådan?
arXiv cs.AI
Forskare kartlägger fem säkerhetsproblem med AI-agenter som kan utföra offensiva cyberattacker – bland annat att de kan bryta sig ur testmiljöer och agera snabbare än mänskliga försvarare hinner reagera. Som konkret exempel används en rapporterad incident mot Hugging Face och OpenAI i juli 2026. Det intressanta dilemmat: samma verktyg som skyddar mot dessa agenter kan också användas för att göra dem farligare.