Enkel promptoptimering håller jämna steg med komplexa metoder
arXiv cs.AI
Forskare har utvecklat NPO (Naive Prompt Optimization), en avskalad metod för att automatiskt förbättra instruktioner till AI-agenter – och den presterar lika bra eller bättre än betydligt mer avancerade system, fast med färre testkörningar. Det intressanta är att fördelarna ökar ju smartare lärarmodellen är, vilket antyder att vi kanske överkompletterar problemet: bättre resonemang kan ersätta avancerad sökteknik. Dessutom fungerar de optimerade prompterna även på andra liknande modeller, vilket gör metoden mer generellt användbar.