Anthropic inför vattenstämplar i AI-genererad text
Anthropic meddelar att de kommer att märka text som genererats av sina AI-modeller med så kallade vattenstämplar (dolda signaturer som identifierar innehållet som AI-skapat). Intressant nog utökar de stödet även till äldre modeller, vilket tyder på att det handlar om ett seriöst åtagande snarare än ett PR-drag för nyare produkter.
Djupdykning
Anthropic meddelar att de ska börja vattenmärka text som genereras av sina AI-modeller – en teknik som bäddar in osynliga mönster i texten för att kunna identifiera var den kom ifrån, ungefär som ett digitalt fingeravtryck. Det här är inte helt nytt i branschen, men det är anmärkningsvärt att de planerar att rulla ut det även för äldre modeller, inte bara de senaste. Vad de flesta missar är att vattenmärkning av text är tekniskt sett ett betydligt svårare problem än för bilder eller ljud – en enkel omskrivning eller parafrasering kan potentiellt radera märkningen, vilket gör det mer till en signal om god vilja än ett vattentätt system. Anthropic gör det här i ett politiskt klimat där EU:s AI-förordning och liknande lagstiftning börjar ställa konkreta krav på transparens kring AI-genererat innehåll, så timingen är knappast slumpmässig. Om märkningen faktiskt håller i praktiken – och hur lätt den är att kringgå – är den verkliga frågan som ingen riktigt vet svaret på än.