Ny metod låter AI förbättra sin egen videotolkning utan att ändra modellen
arXiv cs.AI
Forskare har utvecklat VideoHarness-RSI, ett system som automatiskt förbättrar hur en fryst språkmodell (en AI som inte tränas om) väljer ut och bearbetar information från långa videor. Istället för att justera själva modellen söker systemet rekursivt efter bättre 'ramprogram' – kod som styr vad modellen får se – och slår konsekvent flera handdesignade varianter. Det intressanta är att förbättringarna även fungerar på nya videobenchmarks utan ytterligare sökning, vilket tyder på att kontextkonstruktion är ett eget optimeringslager som hittills underskattats.