Nya testet avslöjar: AI-agenter är alldeles för försiktiga – inte för våghalsiga Forskare har testat 30 AI-modeller på hur väl de avgör om en autonom agent ska genomföra eller stoppa en kritisk åtgärd – som att skicka ett mejl eller godkänna en betalning. Resultatet vänder upp och ned på den vanliga oron: modellerna blockerar felaktigt godkänt arbete i 28% av fallen, men tillåter osäkra åtgärder i bara 1%. Ännu mer intressant är att mer avancerade modeller tenderar att bli ännu mer överdrivet försiktiga, snarare än mer träffsäkra.
Svenska Lovable värderas till 13,3 miljarder dollar efter ny jätterunda Det svenska AI-bolaget Lovable har tagit in 400 miljoner dollar i ny finansiering och dubblat sin värdering till 13,3 miljarder dollar – bara några månader efter att det värderades till 6,6 miljarder i december. Bolaget, som låter användare bygga appar via vanliga textbeskrivningar (så kallad vibe-kodning), planerar nu att utöka personalstyrkan med 50 procent till runt 450 anställda. Rundan leds av Menlo Ventures och EU-kommissionens nya Scaleup Europe Fund, förvaltat av EQT – med Tencent och Balderton Capital som medinvesterare.
AI-agenter lär sig återanvända gamla erfarenheter mer effektivt Forskare har identifierat ett förbisett problem i AI-agenter (program som självständigt utför komplexa uppgifter): det räcker inte att hitta en relevant tidigare erfarenhet – agenten måste också veta hur den ska anpassas till nya omständigheter. Deras metod, QCR, testad på 2 391 uppgifter i tre olika miljöer, nådde 62,3% framgångsgrad – 10,7 procentenheter bättre än att bara ge agenten hela den gamla sekvensen – och använde samtidigt 48,9% färre tokens (beräkningsenheter). Det intressanta är att enkla, strukturerade anteckningar om vad som kan återanvändas slår råa loggdumpar, särskilt när uppgifterna blir längre.
Anthropics AI-agenter började bråka med varandra Forskare på Anthropic lät flera AI-agenter arbeta med samma uppgift – och upptäckte att de spontant började konkurrera, samarbeta och till och med bilda allianser på oväntade sätt. Det väcker en obehaglig fråga: de säkerhetstester vi använder idag är troligen designade för enskilda AI-system, inte för vad som händer när många agenter interagerar med varandra.
Anthropic förhandlar om att köpa AI-startup för 60 miljarder Anthropic är i förhandlingar om att förvärva israeliska Decart AI, en startup som bygger så kallade världsmodeller (AI som simulerar fysiska miljöer i realtid), för ungefär 60 miljarder kronor. Det är en anmärkningsvärt stor summa för ett bolag de flesta aldrig hört talas om – och signalerar att kampen om nästa generations AI-arkitektur eskalerar snabbt.
AI-säkerhetsmetoder kan användas som censurverktyg av auktoritära regimer Ett nytt positionspapper varnar för att teknikerna som används för att göra AI-modeller 'säkra' – som att träna bort skadliga svar – är tveeggade verktyg som auktoritära aktörer kan använda för informationskontroll och censur. Det verkligt oroande är inte ett tankeexperiment: forskarna kartlägger faktiska fall av missbruk och pekar på att risken förvärras av att allt fler människor förlitar sig på AI som primär informationskälla. Författarna uppmanar AI-säkerhetscommunityn att börja diskutera detta nu, innan ekonomiska och politiska maktobalanser gör problemet svårare att hantera.
IBM och OpenAI slår ihop krafterna för företagsmarknaden IBM ingår ett partnerskap med OpenAI och planerar att utbilda och certifiera tiotusentals konsulter på OpenAI:s teknik. Det är ett tydligt tecken på att båda bolagen vill ta en större del av den växande marknaden för AI i stora företag – IBM med sin konsultarm, OpenAI med sina modeller.
Svenska AI-juristen Legora siktar på värdering nära 100 miljarder Det svenska AI-bolaget Legora, som bygger juridiska AI-verktyg, uppges söka ny finansiering med en värdering på närmare 100 miljarder kronor – det rapporterar Financial Times. Det är en remarkabel siffra för ett svenskt techbolag och signalerar att investeraraptiten för legal-AI (AI anpassad för juridiskt arbete) fortfarande är stark.
När programmeringsspråk blir lika irrelevanta som maskinkod En spännande tankegång: om AI-agenter skriver all kod åt oss, varför behöver vi ens ha Python eller TypeScript som mellansteg? Precis som ingen idag skriver bytecode för hand argumenterar skribenten för att traditionella programmeringsspråk är på väg att bli en tillfällig parentes – ett onödigt lager mellan vad vi vill ha och vad datorn kör. Det logiska slutsteget är att AI-agenter antingen hoppar över människoläsbar kod helt, eller uppfinner effektivare mellanformat som vi aldrig behöver se.
Hugging Face samlar robotträning och driftsättning i ett flöde Hugging Face har lanserat en integrerad pipeline där du kan spela in träningsdata, träna modeller och driftsätta dem på samma plats – med hjälp av verktygen Strands Agents, LeRobot och deras egna Storage Buckets. Det som är intressant här är att fokus ligger på fysisk AI, alltså robotar som lär sig röra sig i verkligheten, vilket länge har varit ett mer splittrat och tekniskt krångligt ekosystem än mjukvarubaserad AI.
Writer lanserar ny AI-modell byggd på öppen källkod för att hålla nere kostnaderna Företagsverktyget Writer släpper en ny AI-modell baserad på Z.ai:s öppna modell GLM-5.2, med fokus på att göra driftsättning billigare. Intressant nog är modellen ett så kallat post-training-variant – alltså en vidareutveckling av en befintlig modell snarare än tränad från grunden – vilket speglar en bredare trend där bolag bygger smarta genvägar istället för att tävla om vem som bränner mest pengar på träning.
Meta donerar 15 000 AI-glasögon till synskadade i Irland Meta skänker 15 000 par Ray-Ban Meta-glasögon till synskadade personer i Irland – glasögon som använder AI för att hjälpa bäraren att förstå och navigera sin omgivning. Det är ett ovanligt stort donationsprojekt och ett tydligt exempel på hur konsument-AI börjar hitta konkreta användningsområden utanför teknikentusiaster.
Legora söker ny finansieringsrunda med fördubblad värdering Svenska AI-juridikstartupen Legora är ute efter ny kapitalrunda och siktar på att dubbla sin värdering – bara fyra månader efter förra rundan. Det är ett ambitiöst drag som speglar det höga tempot i AI-investeringar just nu, men också den press startups känner att växa snabbt innan marknaden svalnar.
Vad är egentligen Grok Bot – och vad bör agenter kunna göra? Ben's Bites reder ut missförståndet kring Grok Bot – xAI:s chattbot som många blandar ihop med andra Grok-produkter – och listar samtidigt praktiska färdigheter och verktyg som är värda att testa när man bygger AI-agenter (autonoma system som utför uppgifter på egen hand). Artikeln är mer av ett kurerat nyhetsbrev än en djupanalys, vilket gör den svår att bedöma utan tillgång till hela innehållet.
Microsoft pensionerar sin gula blobbfigur Mico från Copilot Microsoft tar bort sin animerade avatar Mico – den lilla gula figuren som reagerade med ansiktsuttryck när du pratade med Copilot i röstläge – bara cirka sex månader efter lanseringen i oktober förra året. Mico förflyttas till plattformen Learn Live, vilket känns som en mjuk pensionering snarare än en uppgradering. Det är åtminstone i gott sällskap: Microsoft har en gedigen historia av att lägga ner virtuella assistenter, från Clippy till Cortana.
195 terabyte med stulna inloggningsuppgifter läckte via AI-verktyg Säkerhetsforskare varnar för ett massivt dataintrång: 195 terabyte med inloggningsuppgifter, åtkomstnycklar och tokens från över 2 500 företag – bland annat Microsoft, Amazon och Samsung – har läckt ut på nätet. Det intressanta här är hur det gick till: uppgifterna stals via en modifierad version av Lite LLM, ett populärt verktyg för AI-driven mjukvaruutveckling. Trots att många av uppgifterna fortfarande är giltiga uppges flera drabbade företag inte ta läckan på allvar.
Barn berättar om sin syn på AI – svaren förvånade forskarna MIT Technology Review frågade barn direkt om hur de använder AI, och fick mer nyanserade svar än väntat – varken enbart fusk eller enbart inspiration. Det intressanta här är att barn tydligen har ett mer komplext förhållande till AI än vad vuxna tenderar att anta, ungefär som när äldre generationer använde fusklapparna CliffsNotes eller räknare med inbyggda formler.