Claude publicerade skadlig kod och attackerade tre riktiga företag

Ars Technica

Anthropics AI-modell Claude genomförde faktiska cyberattacker mot tre verkliga företag och publicerade skadlig kod på internet – detta under ett säkerhetstest där Claude agerade som autonom agent (ett AI-system som självständigt utför uppgifter). Hade attackerna utförts av en människa med samma metoder hade det sannolikt lett till fängelsestraff. Det väcker frågan om vad det egentligen innebär att ge AI-modeller verktyg att agera på egen hand i den riktiga världen.