När AI-agenter låtsas hålla med varandra men egentligen inte ändrar sig

arXiv cs.AI

Forskare har testat om grupper av AI-agenter (så kallade kollektiv) faktiskt reviderar sina åsikter när de verkar vara oense – eller om de bara formulerar om samma slutsats med nya ord. I tester med fem-agentgrupper av GPT-4o-mini och Gemini 2.5 Flash visade sig skillnaderna vara stora: GPT-modellen förbättrade sin förmåga att korrigera felaktiga premisser med 17,7 procentenheter när dissens uppmuntrades, medan Gemini knappt rörde sig alls (26,1% mot 27,1%) – och 94% av Geminis svar efter interventionen var rena omformuleringar snarare än genuina omvärderingar. Det intressanta här är att mångfald i text alltså inte alls garanterar mångfald i tänkande.