Är det lagligt att träna AI på upphovsrättsskyddade böcker?

TechCrunch AI

Frågan om AI-bolag får använda upphovsrättsskyddade böcker för att träna sina modeller är juridiskt olöst – de flesta publicerade författare har bidragit till AI-verktygens utveckling utan att veta om det eller ge sitt samtycke. Det är en situation som kan vara olaglig, men svaret beror på hur domstolar till slut tolkar begreppet 'fair use' (en amerikansk undantagsregel som tillåter viss användning av skyddat material).

Djupdykning

De flesta stora språkmodeller – GPT, Claude, Gemini och deras kusiner – har tränats på enorma textdatamängder som innehåller miljontals upphovsrättsskyddade böcker, scrapad från internet eller digitala bibliotek som Z-Library. Författarna visste inte om det, fick ingen ersättning, och fick inte säga nej. Men huruvida det faktiskt är olagligt är genuint oklart, eftersom "fair use"-doktrinen i USA tillåter viss användning av upphovsrättsskyddat material utan tillstånd – och AI-bolagen argumenterar att träning på text är mer likt att *läsa* en bok än att *kopiera* den. Det pågår just nu ett dussintal rättegångar i USA där författare, tidningar och förlag försöker testa den teorin i domstol. Det de flesta missar är att den juridiska striden egentligen handlar om en djupare fråga: vad räknas som en kopia? Om en AI läser en miljon böcker och sedan kan generera text i din stil, har den kopierat dig – eller bara lärt sig som en människa gör? Svaret på den frågan kommer inte bara avgöra dessa rättegångar, utan i praktiken bestämma om det AI-ekosystem vi bygger nu var lagligt från början eller ett gigantiskt immaterialrättsbrott i slow motion.