Google DeepMind lanserar agentisk videoförståelse i Gemini Google DeepMind introducerar ny förmåga i Gemini där modellen självständigt kan analysera och resonera kring videoinnehåll – så kallad agentisk videoförståelse, där AI:n aktivt styr sin egen analys snarare än att bara svara på direkta frågor. Det intressanta här är skiftet från passiv fråge-svar till att modellen på egen hand kan navigera och dra slutsatser ur rörligt material, vilket öppnar för mer komplexa användningsfall inom allt från övervakning till innehållsanalys.
Ny metod låter lagtext styra AI:ns beteende – minskar skadligt innehåll med upp till 59 procentenheter Forskare föreslår en teknik kallad 'Statutory AI' där AI-modeller använder faktisk lagstiftning som riktlinje för att granska och rätta sina egna svar – ungefär som att ge modellen en juridisk regelbok att följa. I tester med 1 000 provocerande frågor inom fem juridiska teman (bl.a. diskriminering, bedrägeri och våld) minskade metoden skadligt innehåll med 52–59 procentenheter, vilket är cirka 10 procentenheter bättre än den populära Constitutional AI-metoden. Dessutom halverades beräkningstiden, vilket gör det till ett praktiskt alternativ när AI-reglering ska omsättas i faktisk systemprestanda.
AI-agenter som förbättrar sina egna förmågor – och slår mänskliga experter Forskare har byggt ett system kallat reSolve där AI-agenter självständigt utvecklar och förfinar sina egna 'skills' (återanvändbara instruktionspaket) utan mänsklig hjälp. Resultatet landade på 74,9% korrekthet – 14,8 procentenheter bättre än mänskligt kurerade skills och till och med bättre än GPT-4.5 med OpenHands (67,3%). Det intressanta är att en billigare modell alltså kan slå dyrare alternativ, bara genom att systemet är smartare på att verifiera och söka igenom lösningar.
Ny metod hittar rotorsaken till fel i AI-agentsystem med hälften så många försök När flera AI-agenter samarbetar kan fel uppstå som ingen enskild agent bär skulden för – ett klassiskt diagnostikproblem. Forskare har utvecklat metoden GCJR som identifierar exakt vilka meddelanden mellan agenter som tillsammans orsakade ett fel, och lyckas göra det med 55% färre testkörningar jämfört med att prova allt. På ett kontrollerat riktmärke med 90 testfall nådde metoden perfekt träffsäkerhet – vilket är intressant inte minst för den som försöker felsöka komplexa AI-pipelines i praktiken.
Anthropic lanserar billigare och mer tillåtande AI-modell Anthropic har släppt Fable 5.1, en uppdaterad version av sin AI-modell som kostar mindre att köra och ger färre falska larm från säkerhetsfiltren (de spärrar som hindrar oönskat innehåll). Kortfattat: modellen ska bli både billigare för utvecklare och mindre onödigt restriktiv i vardagsanvändning.
EU beställer AI-superdator för 4,3 miljarder till Finland EU-projektet EuroHPC beställer en ny superdator kallad Lumi-AI från franska statliga Bull, till en kostnad av 387,8 miljoner euro (4,3 miljarder kronor). Datorn placeras i Kajana, Finland, och ska vara igång under andra halvåret 2027 – byggd specifikt för AI-uppgifter med AMD:s 256-kärniga Epyc-processorer och grafikkortet Instinct MI430X. Det är EU:s tydligaste satsning hittills på att bygga AI-beräkningskraft som kan mäta sig med vad USA och Kina erbjuder.
AI identifierar hjärtsjukdom på under två sekunder Forskare vid Imperial College London har tränat ett AI-verktyg på miljoners EKG-data som kan upptäcka hjärtsvikt hos 81 procent och hjärtklaffsjukdom hos 90 procent av patienterna – på under två sekunder. I en studie med 67 000 amerikanska patienter visade verktyget att det kan hitta mönster som inte syns för det mänskliga ögat. Det ersätter inte ultraljud och andra undersökningar, men kan snabbt sålla fram vilka patienter som bör prioriteras.
Pentagon ger tre miljoner anställda tillgång till egna versioner av ChatGPT och Grok Det amerikanska försvarsdepartementet har öppnat upp anpassade versioner av ChatGPT och Grok för sina cirka tre miljoner civila och militära anställda via portalen GenAI.mil. ChatGPT Mil riktar sig mot rutinarbete som administration och planering, medan Grok for Government är tänkt för analys och inköp. Det intressanta är hur snabbt kommersiella AI-modeller nu formaliseras in i militär infrastruktur – med Googles Gemini redan på plats sedan tidigare.
ChatGPT Health låter läkare hämta patientdata från Epic OpenAI integrerar nu ChatGPT Health med journalsystemet Epic, vilket ger vårdpersonal läsåtkomst till patientjournaler direkt i chattgränssnittet. Det är ett tydligt steg mot att positionera ChatGPT som ett kliniskt verktyg – men att det just nu bara handlar om läsåtkomst (inte skrivåtkomst) säger en del om hur försiktigt man trampar fram i sjukvårdsvärlden.
AI-agenter ersätter öppen källkod-bidragsgivare i stora projekt Populära open source-projekt som Vercels AI SDK och tldraw byter ut traditionella community-bidrag mot så kallade 'software factories' – team av AI-agenter som självständigt implementerar buggfixar och nya funktioner. Det handlar om en tydlig förskjutning: i stället för att hantera tusentals pull requests från externa bidragsgivare låter man agenter sköta det löpande underhållet. Intressant nog signalerar det att AI-genererad kod nu är tillräckligt pålitlig för att köra i kärnan av välanvända utvecklarverktyg.
Ny AI-modell genererar video snabbare än realtid Fal's H3 Max Live kan nu skapa video i snabbare takt än den spelas upp – det vill säga att genereringstiden är kortare än videons faktiska längd. Det är en teknisk tröskel som länge begränsat praktisk användning av AI-video. Vad det faktiskt leder till vet ingen riktigt än, men det öppnar dörren för riktigt realtidsbaserade videoapplikationer.
Sony och Warner stämmer Anthropic för påstådd musikpiratkopiering Sony och Warner – två av världens största musikförlag – stämmer AI-bolaget Anthropic och påstår att företaget systematiskt använt upphovsrättsskyddad musik utan tillstånd för att träna sin AI-modell Claude. Låtarna ska vara tiotusentals till antalet, från 'Hallelujah' till 'All I Want for Christmas Is You'. Det är en del av en bredare juridisk trend där innehållsägare börjar kräva betalt för det material som faktiskt byggde upp dagens AI-modeller.
AI-verktyg upptäcker hjärtsjukdom på 2 sekunder via EKG Läkare har utvecklat ett AI-verktyg som kan identifiera hjärtsvikt och hjärtklaffssjukdom direkt från ett vanligt EKG-test på bara två sekunder. Verktyget presenterades på världens största hjärtkonferens och kan potentiellt fånga upp sjukdomar som annars missas i rutinvård.
Storbritannien satsar 1,3 miljarder kronor på inhemska AI-startups Storbritanniens regering öronmärker 100 miljoner pund (1,3 miljarder kronor) – en femtedel av sin Sovereign AI-fond – för upphandling av inhemska AI-startups som ska bygga digitala tjänster till offentlig sektor. Tanken är att minska beroendet av utländska AI-tjänster och istället stödja brittiska bolag inom allt från sjukvård till försvar. Det är i grunden ett sätt att köpa sig teknisk självständighet med skattepengar – intressant att se om det faktiskt lockar fram konkurrenskraftiga alternativ.
Google lanserar AI-drivet designverktyg för att utmana Canva Google ger sig in i kampen om kreativa verktyg med Google Pics – ett designprogram där du beskriver vad du vill ha i text istället för att dra och släppa element själv. Det är ett direkt svar på Canva och Adobes dominans, men med AI som motor snarare än traditionell redigering.
Efter 75 AI-projekt på tre år: Nu lanserar han en molndator som jobbar medan du sover Hamed Mohammadpour har tillbringat tre år med att bygga 75 AI-projekt och lanserar nu Matrix OS – en personlig dator i molnet som körs autonomt dygnet runt åt användaren. Konceptet påminner om en AI-agent (ett program som självständigt utför uppgifter) som inte behöver att du sitter vid tangentbordet. Hur produkten faktiskt presterar i verkligheten återstår att se, men ambitionen är tydlig.
Claude Code får användargränser – och debatten om AI-genererat skräpinnehåll Anthropic har infört hastighetsbegränsningar (rate limits) för Claude Code, sitt kodningsverktyg, vilket påverkar hur intensivt utvecklare kan använda tjänsten. Samtidigt blossar debatten upp kring 'Infinite Slop' – begreppet för den ökande floden av lågkvalitativt AI-genererat innehåll som riskerar att dränka webben.
NVIDIA och CrowdStrike lanserar AI-drivet cybersäkerhetssystem NVIDIA:s Jensen Huang och CrowdStrikes George Kurtz presenterade tillsammans CrowdStrike SafeMind – ett agentbaserat system (där AI självständigt fattar och agerar på beslut) för cybersäkerhet – på konferensen Fal.Con 2026 i Las Vegas. Logiken bakom är enkel: när cyberattacker i dag körs automatiserat måste försvaret göra detsamma. Det intressanta här är att två av techvärldens tyngsta namn väljer att rama in AI-agenter som en nödvändighet snarare än ett val.
Microsoft publicerar sin ansvariga AI-rapport för 2026 Microsoft har släppt sin årliga transparensrapport om ansvarsfull AI-användning, där företaget redovisar hur de bygger och driftsätter AI på ett ansvarsfullt sätt. Rapporten täcker styrning, verktyg och rutiner – men utan konkreta siffror i sammanfattningen är det svårt att bedöma hur mycket som faktiskt är nytt kontra välputsad PR.
Codex levereras nu med LibreOffice OpenAIs kodningsverktyg Codex har börjat inkludera LibreOffice (ett gratis alternativ till Microsoft Office) i sin miljö. Det möjliggör för Codex att hantera och manipulera kontorsdokument som en del av sina arbetsuppgifter.