Forskare kan nu styra hur ofta AI-agenter använder externa verktyg – utan träning
arXiv cs.AI
Forskare har hittat en enda linjär riktning i en språkmodells interna representationer som styr hur ofta modellen väljer att anropa externa verktyg – och genom att justera den här 'ratten' kan man flytta anropsfrekvensen från nära 0% till över 90%. Metoden kräver ingen omskolning av modellen och fungerar direkt vid inferenstillfället, vilket gör den betydligt smidigare än dagens alternativ som prompt-engineering eller fin-tuning. I praktiken nästan fördubblade tekniken träffsäkerheten på öppna frågor (från 0,29 till 0,56) och fungerade över flera olika modelltyper.