GPT-5 läser av motståndare bättre än människor i strategiska spel

arXiv cs.AI

Forskare testade 2 099 AI-agenter från fyra modellfamiljer – DeepSeek, GPT-4.1, GPT-5 och Gemini 2.0 Flash – på ekonomiska spel som kräver förmågan att läsa av andras avsikter (så kallad mentalisering). GPT-5 stack ut genom att anpassa sin strategiska komplexitet efter motståndarens nivå och presterade sammantaget bättre än de 251 mänskliga deltagarna. Det intressanta är inte att AI 'förstår' andra – utan att det finns tydliga skillnader mellan modellerna, vilket antyder att mentalisering inte är en binär egenskap utan något som varierar med modellstorlek och leverantör.