Google DeepMind släpper AI-modell som styr humanoida robotar Google DeepMind har lanserat Gemini Robotics ER 2, en AI-modell som kan styra flera typer av robotar – inklusive humanoida – genom att tolka videoströmmar i realtid, planera flerstegsjobb och korrigera sina egna misstag längs vägen. Nytt är också att flera robotar kan samarbeta och dela information för att lösa uppgifter tillsammans. Modellen finns tillgänglig för utvecklare via Gemini API och Google AI Studio.
AI-system utvärderar varandras forskning – med blandade resultat Forskare har testat om AI kan bedöma AI-genererade vetenskapliga artiklar, genom att låta tre stora språkmodeller (GPT, Gemini och Claude) recensera 75 artiklar från fyra olika AI-forskarsystem. FARS kommersiella system fick genomgående högst betyg (2,14–2,47 av 5), mer än dubbelt så högt som närmaste konkurrent – men GPT-5.4 stack ut som oenig bedömare med svag korrelation till de andra två, vilket antyder att modellerna mäter kvalitet på olika sätt. Det intressanta här är inte vinnaren utan själva upplägget: att använda AI som peer review (granskning av forskning) kan bli ett skalbart sätt att jämföra autonoma forskningssystem.
EU börjar verkställa AI-lagen den 2 augusti Från och med den 2 augusti 2026 börjar EU:s AI-kontor och nationella myndigheter tillämpa AI-lagen på allvar – chatbotar måste tala om att de är AI, och deepfakes måste märkas. Över 180 organisationer har redan skrivit under ett uppförandekodex om transparens. Det intressanta är att vi nu går från regeltext till faktisk efterlevnad, något som länge saknats i EU:s digitala lagstiftning.
ThinkReset: Ny metod låter AI-modeller "glömma och fortsätta" vid långa resonemang När AI-modeller arbetar med komplexa problem tenderar de att fylla sitt kontextfönster (det minnesutrymme modellen har tillgängligt) med onödig information – och när utrymmet tar slut börjar modellen gissa svar i stället för att tänka vidare. ThinkReset löser detta genom att låta modellen skriva en komprimerad mellansammanfattning och sedan rensa historiken, så att resonemanget kan fortsätta utan att tappa tråden. Metoden visar förbättrade resultat på flera riktmärken för långt resonemang inom fasta kontextfönster.
DeepSeek släpper ny snabb AI-modell: V4-Flash DeepSeek har släppt DeepSeek-V4-Flash-0731, en ny version av sin stora språkmodell som är optimerad för hastighet. Simon Willison dyker ner i vad modellen faktiskt kan – intressant nog kommer ett nytt Flash-alternativ från det kinesiska AI-laboratoriet som tidigare skakade om branschen med sin kostnadseffektiva approach.
OpenAI avslöjade kambodjiansk bluffarmy som använde ChatGPT OpenAI har slagit till mot en kambodjiansk bedrägerioperation som använde ChatGPT för att driva investeringsbedrägerier, romantikbedrägerier, falska spelsidor och identitetsförfalskning. Det intressanta här är inte bara att AI missbrukas – utan att OpenAI själva aktivt jagar den typen av missbruk och väljer att berätta om det offentligt.
Smallest.ai får 13 miljoner dollar för att bygga röst-AI som låter mänsklig Startupen Smallest.ai har tagit in 13 miljoner dollar för att utveckla röstmodeller som ska göra det svårt att skilja AI-samtal från riktiga människor – med andra ord klara ett slags telefonversion av Turingtestet. Det intressanta här är inte pengarna i sig, utan att röst-AI börjar bli tillräckligt bra för att det faktiskt är en utmaning att avgöra vem man pratar med.
OpenAI löser tio långvariga matematikproblem OpenAI presenterar nya resultat inom matematik och teoretisk datavetenskap – områden som geometri, kryptografi och komplexitetsteori (hur svåra problem egentligen är att lösa). Det intressanta här är att det handlar om genuint öppna forskningsproblem, inte benchmark-tester, vilket gör det till ett mer konkret test av vad AI faktiskt kan bidra med inom grundforskning.
EU satsar 10 miljarder euro på sju AI-gigafabriker EU-kommissionen finansierar sju AI-gigafabriker med 10 miljarder euro och hoppas locka ytterligare 20 miljarder i privata investeringar – Sverige är ett av 18 länder som anslutit sig. Anläggningarna ska ge startups, forskare och offentlig sektor tillgång till kraftfull beräkningsinfrastruktur för att träna och köra stora AI-modeller. De första fabrikerna väntas vara igång inom 18 månader efter att avtalen skrivs under, med ansökningsdeadline den 12 november 2026.
Tre nya öppna AI-modeller visar att träningskapacitet sprids allt bredare Tre nya öppna modeller – Laguna S2.1, Inkling och Kimi K3 – placerar sig på det så kallade Pareto-fronten (den optimala avvägningen mellan prestanda och kostnad), vilket signalerar att fler aktörer nu kan träna konkurrenskraftiga modeller. Det är inte längre bara de stora techgiganterna som kan leverera toppresultat med öppna vikter. Trenden är tydlig: kapaciteten att bygga starka modeller sprider sig snabbare än väntat.
Litet testverktyg för att utvärdera AI-modeller och promptar Simon Willison har publicerat 'smevals', ett minimalistiskt testpaket (eval suite) för att mäta hur väl AI-modeller, promptar och körningsramverk presterar. Tanken är enkel: istället för stora, tunga benchmarks får utvecklare ett lättviktigt verktyg att snabbt testa sina egna uppsättningar. Det är den sortens praktiskt, no-nonsense-verktyg som faktiskt används i vardagen.
OpenAI förklarar hur man följer EU:s AI-regler OpenAI har publicerat en genomgång av hur bolagets säkerhets- och transparensarbete passar in i det europeiska regelverket, särskilt EU AI Act som nu rullas ut. Inget nytt avslöjas egentligen – det är mer en PR-genomgång än en teknisk djupdykning – men det signalerar att OpenAI tar det europeiska regelverket på allvar och vill positionera sig som en ansvarsfull aktör innan kraven skärps.
Simon Willison utforskar stateless MCP och bygger nya verktyg Utvecklaren Simon Willison har fördjupat sig i stateless MCP (Model Context Protocol – ett sätt för AI-assistenter att kommunicera med externa verktyg utan att hålla koll på tidigare interaktioner), vilket inspirerade honom att bygga två nya projekt: mcp-explorer och datasette-mcp. Det intressanta här är att stateless-varianten av protokollet verkar sänka trösklarna för att faktiskt bygga och experimentera med MCP-integrationer.
Simon Willison om öppna AI-modeller och vad de faktiskt betyder Simon Willison gästar podden Oxide and Friends för att diskutera 'open weight'-revolutionen – det vill säga AI-modeller vars vikter (de tränade parametrarna) är fritt tillgängliga för nedladdning och eget bruk. Det är en djupdykning i vad det egentligen innebär att en modell är 'öppen' och varför distinktionen mot helt sluten AI spelar roll för både utvecklare och användare.
Simon Willison lanserar llm-mcp-client – ett nytt plugin för AI-verktygsintegration Simon Willison har släppt en tidig alfaversion (0.1a0) av llm-mcp-client, ett plugin till hans LLM-verktyg som låter det prata med MCP-servrar (Model Context Protocol – ett standardiserat sätt för AI-modeller att använda externa verktyg och datakällor). Det är en tidig release, så förvänta dig inte polerat – men det är ett intressant steg mot att göra LLM-verktyg mer flexibla och sammankopplade.
Meta vill sälja AI-tjänster till företag – och börjar med annonskunderna Mark Zuckerberg meddelade i samband med Metas senaste kvartalsrapport att bolaget vill växa rejält inom företags-AI. Planen är trestegig: AI-agenter för kundservice via Facebook, Instagram och WhatsApp, interna verktyg för programmering och produktivitet till större bolag, samt försäljning av ledig kapacitet i Metas AI-datacenter. Intressant nog betonar Zuckerberg att kortsiktiga intäkter inte får gå före den egna AI-utvecklingen – vilket antyder att det här är en långsiktig positionering snarare än en snabb pengamaskin.
Google använde AI för att hitta 1 072 säkerhetsbrister i Chrome Google meddelar att AI-verktyg har identifierat och åtgärdat 1 072 säkerhetsbrister i Chrome version 149 och 150 – fler än i de föregående 23 uppdateringarna tillsammans. En av bristerna hade legat oupptäckt i 13 år. Framöver planerar Google att skicka ut säkerhetsuppdateringar varje vecka, och på sikt möjligen två gånger i veckan.
LinkedIn skärper kampen mot AI-genererat skräpinnehåll LinkedIn är trötta på att plattformen översvämmas av AI-genererat skräp och lanserar nu flera nya åtgärder för att hålla det borta. Exakt vilka verktyg det rör sig om framgår inte i detalj, men det är ett tydligt tecken på att problemet med AI-spam blivit tillräckligt stort för att kräva aktiv motåtgärd.