Kinesiska Kimi K3 skrämmer Silicon Valley med låga priser Kinesiska Moonshot AI:s nya öppna modell Kimi K3 levererar prestanda i världsklass till en bråkdel av vad amerikanska konkurrenter tar betalt – vilket fått techmiljardärer i Silicon Valley att reagera och Vita huset att överväga förbud. Det intressanta är inte bara att en kinesisk modell håller jämna steg med de bästa, utan att den är öppen och billig nog att hota hela affärsmodellen hos etablerade AI-bolag.
USA överväger att svartlista kinesiska AI-laboratorier Trumpadministrationen diskuterar återigen att begränsa amerikanska företags tillgång till kinesiska AI-modeller, enligt Axios. Bland förslagen finns att svartlista kinesiska AI-laboratorier – vilket skulle kräva licens för att använda deras teknik – samt ett presidentdekret med säkerhetskrav. Frågan ska ha fått nytt liv efter personförändringar i administrationen och växande säkerhetsfarhågor, delvis drivet av att kinesiska modeller som DeepSeek blivit ett billigare alternativ till amerikanska tjänster.
MUX: Ny metod låter AI tänka mer effektivt i komprimerade steg Forskare föreslår MUX, en metod som komprimerar språkmodellers resonemangssteg till täta 'multiplexade' tokens i ett latent rum – i stället för att slösa beräkningskraft på att formulera varje delsteg i vanliga ord. Metoden är förlustfri, vilket innebär att de ursprungliga resonemangsstegen kan återkonstrueras fullt ut, och den slår befintliga latenta resoneringsmetoder i 32 av 32 testscenarier över fyra olika språkmodeller. Det intressanta här är inte bara hastighetsvinsten – utan att modellen faktiskt verkar resonera mer troget, inte bara snabbare.
AI-detektorer kan paradoxalt nog öka användningen av AI-genererat innehåll Ny forskning visar att verktyg som försöker upptäcka AI-skriven text kan ge rakt motsatt effekt: när användare vet att de övervakas anpassar de sitt beteende strategiskt, vilket faktiskt ökar deras LLM-användning och i vissa fall försämrar textkvaliteten. Forskarna byggde en modell för hur användare rationellt väljer att dölja AI-spår, och bekräftade ett tydligt mönster i verkliga arXiv-abstrakt – det som mäts påverkas alltså av själva mätningen, ett klassiskt goodhartproblem (när ett mått blir ett mål slutar det vara ett bra mått).
Ny metod identifierar vilka resonemangssteg som faktiskt bidrar i AI-modeller Forskare har tagit fram 'Parallel Shapley', ett träningsramverk som använder spelteori (Shapley-värden från kooperativ spelteori) för att avgöra vilka av en språkmodells parallella resonemangssteg som faktiskt bidrar till rätt svar – och vilka som bara åker snålskjuts. Problemet idag är att alla steg får samma belöning oavsett om de hjälper eller stjälper, vilket ger röriga träningssignaler. I tester på matematiska resonemangsbenchmarks presterade metoden bättre än befintliga alternativ och gav stabilare träning.
Google DeepMind lanserar tre nya Gemini-modeller Google DeepMind presenterar tre nya AI-modeller: Gemini 3.6 Flash, 3.5 Flash-Lite och 3.5 Flash Cyber. Flash-serien är Googles snabbare och mer kostnadseffektiva modeller – det intressanta här är att de nu även lanserar en variant specifikt inriktad på cybersäkerhet med Flash Cyber.
Deepfake-forskning missar det verkliga problemet: sexuella övergrepp med AI-genererade bilder En ny position paper pekar på att AI-forskningen om deepfakes nästan uteslutande fokuserar på att avgöra om bilder är äkta eller falska – men ignorerar det vanligaste missbruket: AI-genererade sexuella bilder av verkliga personer utan deras samtycke (AIG-NCII). Problemet är att veta att en bild är syntetisk inte minskar skadan för den drabbade personen – ibland kan det till och med förvärra situationen. Forskarna argumenterar för att fältet behöver flytta fokus från 'är detta äkta?' till 'skadar detta någon?'
Nativ: Kör AI-modeller lokalt på din Mac Nativ är ett nytt verktyg som låter dig köra AI-modeller direkt på din Mac, utan att data skickas till molnet. Det intressanta här är inte bara integritetsaspekten – utan att lokal körning (inference) på konsumenthårdvara börjar bli genuint användbar i vardagen.
Microsoft investerar mångmiljardbelopp i franska Mistral Microsoft har ingått ett avtal om att investera ett 'mångmiljardbelopp' i franska AI-bolaget Mistrals europeiska infrastruktur. Det är en intressant rörelse – Mistral är en av de få europeiska aktörerna som på allvar utmanar de amerikanska AI-jättarna, och nu väljer alltså en av dem att pumpa in kapital i bolaget.
Trumps AI-chef avgår efter 90 dagar Den person som ledde USA:s statliga AI-satsning lämnar sitt uppdrag efter bara 90 dagar – och det verkar vara ett mönster, inte ett undantag. Turbulensen kring den amerikanska regeringens AI-strategi fortsätter, och det är oklart vem som nu tar rodret.
Bakom kulisserna på Claude Code – ett samtal med teamet Simon Willison sammanfattar ett samtal med Cat och Thariq från Anthropics Claude Code-team, där de delar med sig av tankarna bakom verktyget som låter Claude skriva och köra kod direkt i terminalen. Intressant nog verkar mycket av designfilosofin handla om att ge AI-agenten (ett autonomt AI-system som utför uppgifter på egen hand) tillräckligt med frihet att vara användbar, utan att tappa användarkontroll.
Google utvecklar specialchipp för Gemini – sex till tio gånger effektivare Google arbetar enligt The Information på ett nytt AI-chipp med kodnamnet 'Frozen v2', byggt specifikt för att köra Gemini-modellerna mer effektivt. Genom att baka in delar av modellens arkitektur direkt i kretsen ska chippet leverera 6–10 gånger fler AI-tokens per förbrukad energienhet jämfört med dagens TPU-generation. Google siktar på driftsättning runt 2028, men har inte bekräftat uppgifterna.
NVIDIAs nya Vera Rubin-chip rullas ut hos stora molnleverantörer NVIDIAs senaste AI-chip, Vera Rubin NVL72, börjar nu levereras i stor skala till molnjättarna CoreWeave, Google Cloud, Microsoft Azure och Oracle Cloud Infrastructure. Produktionen sker via ett nätverk av över 350 fabriker i 30 länder – det är intressant att notera hur mycket NVIDIA nu satsar på att bygga en diversifierad leveranskedja, troligtvis för att undvika de flaskhalsar som drabbade tidigare generationer. Chipet marknadsförs med fokus på prestanda per watt och lägre kostnad per genererad token (det vill säga priset för att köra AI-modeller).
Wistron öppnar 30 000 kvadratmeter stor fabrik i Texas för att tillverka Nvidias AI-chips Taiwanesiska kontraktstillverkaren Wistron har öppnat sin första amerikanska fabrik i Fort Worth, Texas – en 324 000 kvadratfot (cirka 30 000 kvm) stor anläggning som ska producera Nvidias avancerade AI-acceleratorer. Det är en del av den bredare trenden där AI-hårdvarutillverkning flyttas till USA, delvis driven av politiskt tryck och säkerhetsintressen. Intressant nog är det inte Nvidia själva som bygger – det är ett taiwanesiskt bolag som gör jobbet på amerikansk mark.
NVIDIAs nya nätverkschip Spectrum-6 ska hålla ihop AI-fabriker med hundratusentals GPU:er NVIDIA lanserar Spectrum-6, ett nätverkschip byggt för att hantera kommunikationen i så kallade AI-fabriker – datacenter med hundratusentals GPU:er som tränar stora AI-modeller. På den här skalan blir nätverkshastigheten en direkt flaskhals för hur snabbt modeller kan genereras, vilket är precis det problem Spectrum-6 är tänkt att lösa. Chipet är anpassat för NVIDIAs kommande GPU-generation Vera Rubin.
Xaira Therapeutics bygger AI-modeller för läkemedelsutveckling med egenproducerad data Xaira Therapeutics satsar hårt på att generera sin egen träningsdata för att bygga kausala AI-modeller (modeller som försöker förstå orsak och verkan, inte bara mönster) för läkemedelsutveckling. Grundtanken är enkel men viktig: vill du att en modell ska förstå biologi på riktigt, kan du inte bara mata den med data som samlats in av andra anledningar – du måste designa datainsamlingen från grunden. Det är en resurskrävande strategi, men potentiellt mer robust än att återanvända befintliga dataset.