Två API-inställningar tredubblande GPT-5.6:s poäng på ARC-AGI-3

OpenAI Blog

OpenAI visar hur två API-inställningar – att spara resonemangstrådar mellan anrop och komprimera långa kontexter – tredubblande GPT-5.6:s resultat på ARC-AGI-3, ett test som mäter hur bra AI klarar nya problemtyper den inte tränat på. Det intressanta här är inte bara poängen i sig, utan att prestandalyftet kom utan att ändra modellen – enbart genom hur man konfigurerar anropen. En påminnelse om att mycket av AI-prestanda handlar om hur du ställer frågorna, inte bara vilken modell du använder.