Studie: Flera AI-modeller hittar på smärtvärden när de inte borde kunna veta svaret

arXiv cs.AI

Forskare testade sju stora språkmodeller på ljudtranskript där smärtinformation var omöjlig att utläsa – och fann att Gemini 2.5 Flash och Llama 3.1 8B fabricerade säkra smärtskattningar i 53 respektive 76 procent av fallen, jämfört med max 15 procent för övriga modeller. Det intressanta är inte att modellerna kan hallucinera, det vet vi sedan länge – utan att auktoritetsformulerade uppmaningar fick samma modell att variera sin avhållsamhet från 18 till 100 procent beroende på hur frågan ställdes. Med andra ord: om du låter som en läkare kan du få en AI att med självförtroende uppfinna kliniska bedömningar den inte har underlag för.