DRACO lär AI-agenter av detaljerad feedback – utan att veta om de lyckades Forskare har utvecklat DRACO, en metod för att träna AI-agenter på långa, komplexa uppgifter där det saknas tydliga rätt-eller-fel-svar. Istället för ett enda slutbetyg bryter systemet ner bedömningen i dynamiska delkriterier och kopplar dem till de specifika steg i agentens beteende som faktiskt spelade roll – vilket ger mycket skarpare träningssignal. På benchmark-testet AppWorld presterade DRACO 15,9 procentenheter bättre än basmodellen, och håller sig stark även på uppgifter den aldrig tränats på.
Google släpper Gemini 3.8 Flash – bara tre veckor efter förra versionen Google håller ett högt tempo: tre veckor efter Gemini 3.7 Flash lanseras nu 3.8 Flash med förbättringar inom programmering, problemlösning och agentiska uppgifter (där AI:n självständigt utför flerstegsuppgifter). Samtidigt släpps en specialvariant, Gemini 3.8 Flash Cyber, inriktad på att hitta och åtgärda säkerhetssårbarheter. Priserna är i princip oförändrade.
Meta erbjuder 95% rabatt – mot att du delar dina AI-konversationer Meta lanserar modellen Muse Spark, byggd för att styra så kallade agenter (AI som utför uppgifter självständigt), och lockar användare med upp till 95% prisrabatt om de går med på att dela sina promptar och modellsvar för framtida träning. Det är ett ovanligt öppet utbyte: du betalar med data istället för pengar, vilket gör det tydligare än de flesta tjänster – men inte nödvändigtvis mer betryggande.
OpenAI lanserar ny modell kallad Astra OpenAI har släppt Astra, en ny AI-modell som enligt företaget självt är snabbare, mer träffsäker och säkrare än tidigare alternativ – och särskilt byggd för att styra datorer och webbläsare åt användaren. Uppgifterna kommer dock enbart från OpenAI själva, så det återstår att se om de håller i oberoende tester.
Nvidia låter dina vilande datorer jobba ihop som ett mini-AI-datacenter Nvidia lanserar PAIR (Personal AI Router), ett gratis och öppen källkod-verktyg som kopplar ihop flera datorer i samma nätverk för att köra AI-modeller lokalt – tänk Ollama eller LM Studio fast fördelat över flera maskiner. Verktyget fungerar med Nvidias egna RTX 20-serien och nyare GPU:er (grafikprocessorer), men också med Apples M4-chip, vilket är ovanligt generöst av Nvidia. Idén är smart: istället för att köpa ny hårdvara kan du helt enkelt utnyttja det du redan har stående hemma.
Ny AI-arkitektur låter språkmodeller delta i möten utan att tiga ihjäl sig Forskare har byggt CAPA, ett system där en AI-agent kan representera en frånvarande mötesdeltagare i realtid. Vanliga språkmodeller missar hela 51,4% av tillfällena att bidra i ett möte – CAPA sänker den siffran till 2,5% och halverar dessutom problemet med att agenten hittar på saker (hallucination) till 0,6%. Det intressanta är att lösningen inte handlar om att mata modellen med mer kontext, utan om att ge den en strukturerad bild av mötets tillstånd – vem har sagt vad, vad återstår att täcka.
Googles nya AI-vädermodell ska minska antalet överblivna paraplyer Google lanserar WeatherNext 3, en vädermodell byggd på djupinlärning (AI tränad på stora datamängder) som företaget säger är mer träffsäker än traditionella prognoser. Modellen ska börja mata in data i vad användare ser när de söker väder i Google Search, Maps och Gemini. Det är en del av en bredare omvälvning inom meteorologin, där AI-modeller på kort tid utmanat system som tagit decennier att bygga upp.
80% av Fortune 500-företagen testar AI-agenter – men skalning är knepig Hela 80% av Fortune 500-företagen har börjat använda agentisk AI (system där AI-modeller självständigt utför uppgifter i flera steg), men att gå från pilotprojekt till verklig skala i hela organisationen visar sig vara svårt. Utmaningen handlar om att få olika AI-agenter att samarbeta, koppla upp dem mot rätt data och system, och se till att de agerar säkert i affärskritiska flöden.
AI-agenter genomförde ransomware-attack på under 10 timmar Forskare på Palo Alto Networks Unit 42 har dokumenterat en ransomware-attack där angriparen använde AI-agenter för att ta sig igenom ett företagsnätverk på under 10 timmar – ett arbete som bedöms ha tagit mänskliga operatörer ungefär två veckor. Agenterna kartlade interna tjänster, grävde fram inloggningsuppgifter i källkod och kapade slutligen offrets egna AI-resurser som attackinfrastruktur. Det som är intressant här är att attacken inte var helt autonom – en människa styrde, men AI skötte de taktiska detaljerna, vilket i praktiken gör det svårt för säkerhetsteam att hinna reagera i tid.
Google DeepMind lanserar WeatherNext 3 – sin mest exakta väder-AI hittills Google DeepMind har släppt WeatherNext 3, en AI-modell för global väderprognoser som påstås vara deras mest precisa hittills. Väderprognoser är ett klassiskt AI-problem där maskininlärning på senare år börjat slå traditionella fysikbaserade modeller – det intressanta är att vi nu ser tredje generationen av den här typen av system, vilket tyder på ett område i snabb mognad.
Var tionde riksdagsmotion skriven med AI – ingen politiker har berättat det Forskare från Chalmers och Edinburgh Napier University har granskat 3 000 riksdagsmotioner och kommit fram till att ungefär en tiondel troligen är skrivna med hjälp av AI – utan att någon enda politiker har redovisat det. Problemet är inte bara etiskt utan också praktiskt: AI-genererade texter är ofta välformulerade och övertygande, vilket gör att fel kan passera oupptäckta. Från och med 2 augusti gäller EU-kommissionens nya transparensregler, så politikerna måste börja vara öppna med hur de skriver sina motioner.
Startup bygger affär på att ta bort AI-säkerhetsspärrar Abliteration.ai erbjuder AI-modeller utan inbyggda begränsningar (så kallade guardrails), med argumentet att säkerhetsforskare behöver tillgång till samma verktyg som angripare för att kunna försvara sig effektivt. Det är ett kontroversiellt men inte ovanligt resonemang inom cybersäkerhet – frågan är om affärsmodellen håller när regulatorer börjar titta närmare.
NVIDIA och Microsoft satsar på lokal AI med ny kompakt hårdvara På elektronikmässan IFA 2026 presenterade NVIDIA och Microsoft ett samarbete för att göra det enklare att köra AI-agenter lokalt på datorn – utan att behöva skicka data till molnet. I oktober lanseras även en ny serie kompakta Windows-datorer kallade RTX Spark, riktade mot utvecklare och kreatörer som vill ha AI-kraft hemma på skrivbordet. Det intressanta här är att trenden tydligt pekar mot att AI i allt högre grad ska köras på din egen maskin snarare än på någon annans server.
AI-assistenten Ollie satsar på integritet för att locka barnfamiljer Ollie är en AI-assistent riktad mot familjer som vill ha tillgång till detaljerna i ditt vardagsliv – men lovar att inte använda datan för att träna sina modeller eller dela den med tredje part. Det intressanta här är att de försöker ta sig in på en trång marknad genom att spela på just det som många oroar sig för med AI-assistenter: vad händer egentligen med all personlig information?
OpenAI satsar 1 miljard dollar på cybersäkerhet för samhällskritiska verksamheter OpenAI lanserar 'Daybreak for Frontline Defenders' – ett åtagande på 1 miljard dollar för att ge sjukhus, energinät och andra samhällsviktiga verksamheter tillgång till AI-verktyg för cybersäkerhet, utbildning och support. Tanken är att organisationer som ofta saknar resurser för avancerat cyberskydd ska kunna ta del av samma teknik som stora företag. Det är en ovanlig satsning från OpenAI som går längre än vanlig produktlansering och handlar mer om infrastrukturskydd i bred mening.
Google låter dig prata med Gmail, Docs och Keep Google rullar ut röststyrning för Gmail, Docs och Keep – kallat Gmail Live, Docs Live och Keep Live – där du kan ställa frågor och hantera innehåll utan att behöva knappa. Det är samma teknik som ligger bakom Gemini Live, och tanken är att det ska vara praktiskt när du rör på dig och inte kan använda händerna, till exempel för att snabbt hitta vad din kids nästa skolaktivitet är utan att leta igenom mejltrådar.
New York förbjuder generativ AI i skolan för 600 000 elever New Yorks borgmästare Zohran Mamdani inför ett ettårigt förbud mot generativ AI för nästan 600 000 elever från förskolan upp till årskurs åtta – det mest omfattande skolförbudet av sitt slag i USA. Motiveringen är att barn behöver lära sig att tänka självständigt, men kritiker menar att ett år inte är tillräckligt långt.
Kan finanssektorn hålla koll på AI utan att bromsa utvecklingen? OECD AI Observatory lyfter frågan om hur finanssektorn ska balansera tillsyn av AI-innovation med behovet av att hålla tempot uppe – en klassisk regleringsknivig. Kärnan i dilemmat är att traditionella tillsynsmodeller ofta är för långsamma för att hänga med när AI-verktygen utvecklas i rasande fart inom bank och finans.
Klättrare räddades efter att ha litat på Geminis bergsplanerare En grupp klättrare planerade bestigning av Mount Shasta med hjälp av Googles AI-tjänst Gemini – och fick betala priset. Chatboten lovade en åtta timmars vandring, men verkligheten bjöd på det dubbla bara upp till toppen, och gruppen fick till slut räddas av skogsvakter och polis. En påminnelse om att AI-tjänster fortfarande är dåliga på att förstå skillnaden mellan karta och terräng.