Claude får osynlig stämpel på varje ord

EU:s AI-förordning kräver att AI-genererad text ska vara spårbar, och Anthropic har nu förklarat hur de löser det i praktiken: Claude manipulerar vilka ord modellen väljer, på ett sätt som skapar ett maskinläsbart mönster utan att texten ser annorlunda ut för en mänsklig läsare.
Tekniken heter SynthID-Text och är utvecklad av Google DeepMind. Den är öppen källkod, vilket är anmärkningsvärt, och Anthropic kör alltså en version av den snarare än att bygga något eget. Det är ett pragmatiskt val: varför uppfinna hjulet när DeepMind redan gjort jobbet och EU inte ställer krav på att lösningen ska vara proprietär?
Hur fungerar det? I korthet: när modellen ska välja nästa ord finns det oftast flera rimliga alternativ med liknande sannolikhet. SynthID-Text justerar dessa sannolikheter subtilt för att bädda in ett statistiskt mönster. Läs texten som människa och du märker ingenting. Kör den genom en detektor och mönstret syns.
Det finns en uppenbar svaghet som ingen låtsas ignorera: om du redigerar texten tillräckligt mycket, klipper och klistrar eller bara skriver om ett stycke, försvinner mönstret. Vattenstämpeln är robust mot läsning, inte mot aktivt sabotage. Det gör den mer användbar som spårningsverktyg i goda tider än som bevis i en domstol.
För den som bygger produkter på Claude är implikationerna konkreta. All text som genereras via API:et inom EU-marknaden kommer bära dessa markeringar, oavsett om du som bygger vill det eller inte. Det betyder att om din produkt presenterar AI-genererat innehåll som opåmärkt, är det inte längre ett val du kan göra, det är ett tekniskt faktum nedanför ditt lager.
Anthropics beslut att välja ett öppet, delat ramverk snarare än en proprietär lösning skapar också ett intressant prejudikat. Om fler aktörer konvergerar kring SynthID-Text blir detektering enklare och mer standardiserad, vilket är precis vad lagstiftarna vill. En gemensam standard tjänar alla utom de som hoppades slippa undan.



