Forskare förklarar varför ChatGPT plötsligt börjar producera skadligt innehåll
arXiv cs.AI
Fysiker har tagit fram en matematisk modell som förklarar varför ChatGPT och liknande AI-modeller ibland 'tippar över' och börjar generera skadligt, missvisande eller repetitivt innehåll – även när slumpen är borttagen ur systemet. Fenomenet liknar ett fasövergångsproblem från fysiken, där tokensignaler (de minsta textenheterna) växelverkar på ett sätt som driver modellen mot oönskade beteenden. Det intressanta: forskarna menar att dessa fel är förutsägbara ingenjörsproblem snarare än slumpmässiga – vilket kan förändra hur vi juridiskt och samhälleligt bedömer ansvar för AI-skador.