USA ställer sig bakom OpenAI i upphovsrättsstriden Den amerikanska regeringen har tagit OpenAIs sida i frågan om AI-bolag får träna sina modeller på upphovsrättsskyddat material utan tillstånd. I ett juridiskt yttrande argumenterar regeringen för att USA:s starka intresse av att leda den globala AI-utvecklingen väger tungt – vilket i praktiken kan ge techbolagen ett viktigt stöd i de pågående rättsprocesserna mot förlag och upphovsmän.
Google DeepMind lanserar Gemini 2.5 Flash och en cybersäkerhetsvariant Google DeepMind släpper Gemini 2.5 Flash, en snabb och kostnadseffektiv modell, tillsammans med en specialiserad variant kallad 2.5 Flash Cyber som är optimerad för cybersäkerhetsuppgifter. Det intressanta här är att de aktivt bygger domänspecifika versioner av sina modeller – ett tecken på att den generella AI-eran börjar ge vika för mer riktade verktyg.
Nytt riktmärke testar AI-agenter i Civilization VI – och resultaten är nedslående Forskare har skapat CivBench, ett öppet testramverk där AI-agenter spelar Civilization VI under 300+ omgångar för att mäta långsiktig planering och verktygsanvändning. Resultaten visar på ett tydligt mönster: agenterna ignorerar strategiskt viktig information de faktiskt har tillgång till – trots instruktioner kollade de på victory progress var 30–75:e omgång istället för var 20:e – och fullföljer bara 48–66% av de planer de själva formulerat. Det intressanta här är att problemet inte verkar handla om bristande förmåga, utan om att agenterna inte följer sina egna instruktioner.
Trump-administrationen stödjer OpenAI i upphovsrättsstriden med NYT Trump-administrationen har lagt sig i New York Times stämning mot OpenAI – och tar AI-företagets sida. Regeringen argumenterar att det faller under 'fair use' (en amerikansk upphovsrättslig princip som tillåter visst återbruk av skyddat material) att träna språkmodeller på tidningsartiklar. Stämningen, som lämnades in i december 2023, kräver miljarder i skadestånd från både OpenAI och Microsoft.
Anthropic lanserar Claude Fable 5.1 – 25 procent billigare än föregångaren Anthropic har släppt två nya AI-modeller: Claude Fable 5.1 och Mythos 5.1. Fable 5.1 är upp till 25 procent billigare att köra än sin föregångare – och för agentbaserade uppgifter (där AI:n självständigt utför flera steg i rad) kan kostnaden sjunka med hela 45 procent. Mythos 5.1 är än så länge bara tillgänglig för en begränsad krets amerikanska användare inom Project Glasswing.
Claude lanserar ny toppmodell med kraftigt sänkta cachingpriser Anthropic har släppt Claude Fable/Mythos 5.1, som sätter nytt rekord (SOTA – state of the art) inom sin prestandaklass. Priset för caching sänks med 75 procent, men antalet output-tokens ökar med 70 procent – vilket betyder att kostnadsbilden beror helt på hur man använder modellen.
Google lanserar Gemini 3.8 Flash – kan bli dyrare trots samma prislapp Google har släppt Gemini 3.8 Flash, bara några veckor efter föregångaren 3.7. Modellen kostar samma på ytan – 0,75 dollar per miljon inmatade tokens och 3,75 dollar per miljon genererade – men Google varnar själva för att den kan använda fler tokens för att lösa komplexa uppgifter, vilket gör att slutnotan ändå kan bli högre. Utvecklare som vill hålla kostnaderna nere kan alltså fortsätta använda 3.7 Flash.
SafeEvolve: Nytt ramverk låter AI-agenter lära sig säkerhet från egna misstag Forskare har tagit fram SafeEvolve, ett system där AI-agenter kontinuerligt förbättrar sin egen säkerhet genom att analysera tidigare interaktioner – ungefär som att lära sig av sina misstag i realtid. För modellen Qwen3.5-4B minskade antalet lyckade attacker (attack success rate) med tre gånger på benchmark-testet AgentDojo, samtidigt som nyttoförmågan faktiskt ökade något från 59,79% till 61,86%. Det intressanta är att systemet balanserar två saker på en gång: både hur agenten beter sig internt och de yttre regler som styr den.
Så bygger Schneider Electric, Vodafone och monday.com AI-agenter i stor skala Tre stora företag – Schneider Electric, Vodafone och monday.com – delar med sig av hur de faktiskt driftsätter AI-agenter i produktion, inte bara i testmiljö. Gemensamma teman är delade agentplattformar, LLMOps (verktyg för att övervaka och hantera språkmodeller i drift) och multi-agent-arkitekturer där flera AI-agenter samarbetar med bättre kontroll och uppföljning. Det intressanta här är att fokus ligger på det tråkiga men viktiga: stabilitet, observerbarhet och utvärdering – inte på att bygga häftiga demos.
New York förbjuder AI för 600 000 yngre skolelever New York City inför nu ett av de mest omfattande AI-förbuden i skolan hittills: runt 600 000 elever får inte använda AI i undervisningen förrän de börjar high school, och AI-chattbotar för emotionellt stöd förbjuds helt i alla årskurser. Borgmästare Zohran Mamdani är tydlig med budskapet – att AI är nödvändigt för små barn är en sanning som tech-branschen själv hittat på. Lärare får däremot fortsätta använda AI för planering och översättning, men inte för att sätta betyg eller ge råd till elever i kris.
Nytt ramverk för att lära sig av AI-misstag i vården Forskare föreslår ett strukturerat system – kallat AI M&M (Morbidity and Mortality) – för att systematiskt granska när klinisk AI gör fel eller nästan gör fel i patientvård. Ramverket liknar de traditionella mortalitetskonferenser som sjukvården redan använder, men är anpassat för att förstå hur misstag uppstår i samspelet mellan AI-system, läkare och arbetsflöden. I ett test med fem fallstudier och två oberoende granskare uppnåddes full enighet i samtliga 20 klassificeringar – vilket är lovande, men storskaliga utvärderingar återstår.
Anthropic lanserar nya modeller och sänker priser – ett svar på Kina Anthropic lanserar två nya versioner av sina AI-modeller och sänker priset för vissa användningstyper. Analytikern Herman Ohlsson på Brock Milton Capital tolkar det som ett direkt svar på konkurrensen från Kina och varnar för att 'flertalet mjukvarubolag kommer att öppna i rött i dag' – prissänkningar från en stor aktör sätter press på hela branschen.
Vem ansvarar egentligen för vad en AI-text 'betyder'? En ny artikel pekar på ett återkommande problem när LLM-texter används i juridik, utbildning och policyarbete: att AI:ns tolkningar behandlas som färdiga svar snarare än som ett förslag som kräver mänsklig granskning och motivering. Forskaren kallar det 'interpretive misplacement' (tolkningsfelplacering) och menar att det inte bara handlar om faktafel – utan om att ansvarskedjan försvinner när ingen kan spåra varför en tolkning gjordes. Utifrån filosofisk hermeneutik (läran om tolkning och förståelse) föreslår artikeln designprinciper för hur människa och AI bör samarbeta kring tolkningsuppgifter, med krav på tydliga källor, normativa ramar och bevarade alternativa läsningar.
Fambot vill bli AI-stabschef för stressade föräldrar Amerikanska Fambot lanserar en AI-assistent riktad mot barnfamiljer – tänkt att hålla koll på mejl, kalender och WhatsApp-grupper så att föräldrarna slipper. Bolaget har hittills tagit in drygt 33 miljoner kronor. Det är ett välkänt problem de siktar på, men frågan är om familjelogistik verkligen är det som brister – eller om det är tid och energi.
AI-genererat innehåll sprider sig till jobbansökningar och försäkringsärenden AI-genererad text och bilder dyker nu upp inte bara i sociala medier utan även i jobbansökningar, produktrecensioner och försäkringsärenden – vilket skapar ett växande trovärdhetsproblem på nätet. Pangrams grundare Max Spero menar att det är betydligt svårare att upptäcka AI-innehåll än vad folk tror, och en handfull startups försöker nu lösa problemet.
HiddenLayer säkrar 1 miljard kronor för att skydda företagens AI-system HiddenLayer, som specialiserar sig på säkerhet för AI-modeller, har tagit in 100 miljoner dollar i en Series B-runda med investerare som Microsoft och Morgan Stanley. Det intressanta här är att säkerhet specifikt riktad mot AI-system (alltså att skydda själva modellerna från attacker och manipulation) börjar bli en affär i sig – ett tecken på att företag börjar ta AI-risker på allvar.
llm-gemini 0.34 släppt med uppdaterat Gemini-stöd Simon Willison har släppt version 0.34 av llm-gemini, ett plugin (tillägg) till kommandoradsverktyget LLM som låter användare köra Googles Gemini-modeller lokalt. Uppdateringen är ett underhållssläpp utan dramatiska nyheter – men visar att ekosystemet kring öppna LLM-verktyg fortsätter växa steg för steg.
AI kan slå ut tusentals jobb på svenska banker AI-utvecklingen väntas få betydande konsekvenser för sysselsättningen inom den svenska banksektorn. Artikeln från Dagens Industri belyser hur många anställda som riskerar att förlora sina jobb till följd av ökad automatisering – ett tema som banker globalt börjat ta på allvar.
Talentiums kassa krymper – men vd:n är lugn AI-bolaget Talentium, backat av EQT och techprofiler från Klarna, Voi och Sana, ser sin kassa minska enligt senaste bokslutet. Vd Sebastian Hjärne är ändå obekymrad och hävdar att bolaget just nu växer mycket snabbt.