Nya studien avslöjar att AI-modeller bedömer forskningsartiklar helt annorlunda än människor Forskare har testat hur fem stora språkmodeller bedömer vetenskapliga artiklar genom att analysera 11 000 AI-genererade recensioner av 1 000 forskningspapper. AI-modellerna visade sig vara betydligt mer positiva och mindre kritiska än mänskliga granskare, samtidigt som de ofta missar viktiga svagheter som människor identifierar - vilket ifrågasätter hur användbara de verkligen är för vetenskaplig peer review.
Forskare kartlägger Claude 3 Sonnets inre funktioner med 34 miljoner identifierbara drag Anthropics forskare har lyckats identifiera och kartlägga 34 miljoner tolkningsbara funktioner i Claude 3 Sonnet genom sparse autoencoders – en teknik som gör AI-modellens beslutsmekanism mer transparent. De hittade funktioner för allt från sarkasm och kodfel till mer problematiska beteenden som manipulation och maktbegär, vilket kan hjälpa till att förstå och kontrollera AI-beteende bättre.
Forskare minskar AI-hallucinationer med 35% genom flernivåagenter En ny studie visar att ett system med tre AI-agenter som granskar varandras svar kan minska felaktiga påståenden (hallucinationer) med upp till 35,9%. Systemet använder också semantisk cachning som träffade rätt i 47% av fallen, vilket halverade antalet AI-anrop och minskade energiförbrukningen – ett smart sätt att göra faktakontroll både mer pålitlig och mer hållbar.
Deepminds vd: AGI kan vara här om tre år Google DeepMinds vd Demis Hassabis har flyttat fram sin prognos för AGI (artificiell generell intelligens) från omkring 2030 till möjligen 2029 eller tidigare. Han varnar för att samhället inte tar utvecklingen tillräckligt seriöst och ser dagens AI-agenter som en "övningsrunda" inför betydligt kraftfullare AI som kan förbättra sig själv.
AI-modellers säkerhet fallerar när kontexten ändras Forskare visar att säkerhetstränade AI-modeller fastnar i rigida regler även när situationen förändrats så att 'säker' handling blir skadlig - ett problem de kallar 'brittle safety'. Tester av 12 modeller visar att standardmetoder för innehållsmoderation missar alla fall där konsekvenserna vänt, medan en ny kontextmedveten metod fångar alla utan falsklarm. Det antyder att nuvarande säkerhetssystem är systematiskt blinda för när omständigheterna ändrar vad som verkligen är säkert.
Ny metod löser AI-modellers problemfakta-uppdateringar Forskare har utvecklat CODE, en teknik som låter AI-modeller uppdatera sin kunskap genom kausala samband istället för att bara skriva över fakta. Metoden minskar självmotsägelser från 95,6% till endast 1,8% när modeller som LLaMA-3.1 får ny information, vilket gör kunskapsuppdateringar mycket mer pålitliga.
LLM-agenter kan inte hålla hemligheter i sociala miljöer Forskare testade tusentals AI-agenter i en simulerad månadslång social miljö och upptäckte att de läcker känslig information 45% av tiden – jämfört med 20% i isolerade tester. Mest anmärkningsvärt: agenter blev 8 gånger mer benägna att avslöja hemligheter efter att ha sett andra göra det, vilket visar att integritetsbrott sprids socialt som en smitta.
OpenAI presenterar sitt ramverk för AI-säkerhet OpenAI har publicerat sitt Frontier Governance Framework som beskriver hur företaget ska hantera säkerhet och risker för framtida AI-system. Ramverket är utformat för att följa kommande EU-regler och Kaliforniens AI-lagstiftning, vilket visar hur teknikjättar förbereder sig för strängare regulering.
Frontier-modeller presterar under 50% på första AI-agentbenchmark för företags-IT De mest avancerade AI-modellerna från OpenAI, Anthropic och Google klarar endast 40-50% av uppgifterna i ITBench-AA, det första benchmarket som testar AI-agenters förmåga att utföra verkliga IT-uppgifter i företagsmiljöer. Benchmarket, utvecklat av Artificial Analysis och IBM, visar att även de bästa modellerna fortfarande har svårt med komplexa arbetsflöden som kräver flera steg och verklig problemlösning.
Anthropic och OpenAI har hittat sin marknad Simon Willison menar att både Anthropic och OpenAI äntligen har hittat product-market fit för sina AI-modeller. Efter år av experimentering med olika användningsområden verkar företagen nu ha funnit hållbara affärsmodeller som faktiskt levererar värde till kunderna.
AI-företag spenderar miljoner mot politiker som vill reglera dem OpenAI och Anthropic har hamnat i en miljonkostnad maktkamp kring Alex Bores, en tidigare okänd New York-politiker som skrev AI-säkerhetsreglering. Ironiskt nog har företagens försök att stoppa honom gjort honom till en känd symbol för AI-reglering inför kongressvalet i juni.
Cisco och OpenAI automatiserar kodning med AI-verktyg Cisco använder OpenAIs Codex för att automatisera felreparationer och påskynda AI-utveckling inom företaget. Samarbetet fokuserar på att göra Cisco till ett mer AI-drivet teknikföretag genom automatiserad kodgenerering och säkerhetsarbete.
YouTube flyttar AI-märkningar så du faktiskt ser dem YouTube flyttar sina AI-märkningar från den dolda videobeskrivningen till en synlig plats direkt under videospelaren, där det nu tydligt står "AI" bredvid en informationsikon. Plattformen kommer också att börja automatiskt identifiera och märka AI-genererat innehåll, vilket är en del av Googles bredare satsning på AI-verifiering.
OpenAI lanserar Rosalind Biodefense för amerikanska myndigheter OpenAI har lanserat Rosalind Biodefense, som ger amerikanska myndighetsparter och utvalda utvecklare tillgång till den specialiserade AI-modellen GPT-Rosalind för biologisk försvar och pandemiförberedelser. Verktyget är designat för att hjälpa till med folkhälsofrågor och bioförsvar genom att använda OpenAIs mest avancerade AI-teknologi.
Anthropics intäkter når 47 miljarder kronor årligen AI-företaget Anthropic, som ligger bakom Claude-modellen, har nått en årlig intäktsnivå på 47 miljarder dollar enligt nya uppgifter. Det innebär en kraftig tillväxt för företaget som konkurrerar direkt med OpenAI om marknaden för stora språkmodeller.
OpenAI publicerar riktlinjer för oberoende AI-utvärderingar OpenAI har släppt en handbok för hur externa organisationer ska utvärdera AI-modeller på ett tillförlitligt sätt. Guiden täcker hur man ska testa modellernas förmågor, säkerhetsåtgärder och validitet - särskilt för de mest avancerade systemen.
AI-kodning kräver duktiga utvecklare Utvecklarna bakom AI-agenten Open Claw varnar för att AI-kodningsverktyg översvämmer mjukvaran med 'vibe slop' - kod som ser trovärdig ut men saknar genomtänkt design och testning. Även om Google rapporterar att 75% av deras nya kod nu genereras av AI, betonar kritikerna att det svåra i mjukvaruutveckling aldrig varit att skriva kod utan att förstå, underhålla och översätta affärsbehov till teknisk implementation.
BlazeEdit: Bildredigerare för mobiler med 195 miljoner parametrar Google-forskare har utvecklat BlazeEdit, en AI-modell för bildredigering som är så kompakt (195M parametrar) att den kan köras direkt i mobilen utan internetuppkoppling. Modellen klarar fem olika uppgifter som objektborttagning och ljuskorrigering på bara 290 millisekunder på en Pixel 10 – betydligt snabbare än molnbaserade alternativ som kräver dataöverföring.
Googles AI kan inte stava Google (eller något annat) Googles AI-modeller har problem med stavning – ironiskt nog kan de inte ens stava företagets eget namn korrekt. Detta belyser en märklig svaghet hos stora språkmodeller som annars kan lösa komplexa problem men snubblar på enkla textuppgifter.
Världens största AI-chiplån ska hjälpa Anthropic Riskkapitaljättarna Apollo och Blackstone försöker samla ihop hundratals miljarder kronor i skuldfinansiering för att hjälpa AI-bolaget Anthropic få tillgång till Googles chip. Det här skulle bli världens största AI-chiplån någonsin – en tydlig signal om hur desperat AI-bolagen behöver processorkraft för att träna sina modeller.
Braintrust använder Codex för att omvandla kundförfrågningar till kod Braintrust visar hur deras ingenjörer använder OpenAI:s Codex tillsammans med GPT-5.5 för att automatisera kodgenerering från kundförfrågningar. Företaget kan nu köra experiment och utveckla kod betydligt snabbare genom att låta AI:n översätta naturligt språk direkt till fungerande kod.
Anthropics monsterrunda klar – värderas till 9000 miljarder Claude-skaparen Anthropic har stängt en runda på 65 miljarder dollar och når nu en värdering på 965 miljarder dollar – över 9000 miljarder kronor. Det betyder att AI-företaget nu är värderat högre än OpenAI, vilket visar hur intensivt AI-racet har blivit mellan de stora språkmodellbolagen.
AI-agenter presterar lika bra som människor vid biologisk dataannotering Forskare testade fem stora språkmodeller från Anthropic och OpenAI på att annotera biologiska fenotyper (fysiska egenskaper hos organismer) - en tidskrävande process som tidigare krävt expertkunskap. Alla AI-agenter presterade inom samma intervall som mänskliga kuratorer och slog tidigare automatiska verktyg rejält, vilket kan lösa en viktig flaskhals inom biologisk forskning.
AI-chatbotar rekommenderar olika varumärken beroende på vem de tror frågar Forskare testade hur AI-modeller från OpenAI och Anthropic svarar på samma fråga ("bästa CRM-mjukvara") när den kommer från olika personas - en solo-grundare kontra en företags-VP. Resultatet: rekommendationerna skiljer sig markant åt beroende på vem modellen tror frågar, särskilt för mindre kända varumärken som kan byta ut 75% av sina rekommendationer. Stora etablerade varumärken påverkas däremot knappt av persona-bytet.
Google visar 11 demos av Gemini Omni och Gemini 3.5 Google har släppt 11 videodemos som visar kapaciteterna hos deras nya AI-modeller Gemini Omni och Gemini 3.5, som presenterades på Google I/O 2026. Videorna demonstrerar modellernas förmågor i praktiken, vilket ger en konkret bild av vad nästa generation av Googles AI faktiskt kan göra.
12 stora AI-nyheter från Google I/O 2026 Google presenterade stora uppdateringar av sina AI-modeller på I/O 2026, inklusive nya Gemini Omni och Gemini 3.5 Flash. Företaget fortsätter att pusha gränserna för vad deras språkmodeller kan göra, även om detaljerna om prestanda och tillgänglighet ännu inte är helt klara.
Rusning till Duckduckgo i protest mot Googles AI-sök Google meddelade nyligen att AI-sök ska ersätta den klassiska sökrutan, vilket lett till en protestreaktion bland användare. Nedladdningarna av sökappen Duckduckgo har ökat med över 30 procent sedan beskedet, och företagets AI-fria version har sett allt fler besökare. Duckduckgos vd betonar att de inte samlar in sökhistorik eller använder data för AI-träning.
Gleans AI-söktjänst passerar 300 miljoner dollar i omsättning Enterprise AI-söktjänsten Glean tredubblade sin årliga omsättning till över 300 miljoner dollar genom att sälja in sig som ett sätt att minska AI-kostnader. Företaget lyckas hålla takten trots att teknikjättar som Google och Microsoft konkurrerar i samma kategori.
AI-hypen möter studenter som buhar Googles tidigare VD Eric Schmidt blev utbuad när han berättade för studenter vid University of Arizona att deras uppgift är att hjälpa till att forma AI:s framtid. Det visar en växande skepsis bland unga mot AI-branschens löften, särskilt när de själva ska ut på en arbetsmarknad där AI hotar många traditionella jobb.
Google visar att SEO-strategier måste anpassas för AI-drivna sökresultat Google I/O bekräftade att AI-genererade svar nu är centrala i sökningen, vilket innebär att traditionella SEO-strategier byggt kring "10 blå länkar" inte längre fungerar. De flesta varumärken har minimal insyn i hur AI beskriver dem för kunder, vilket kräver en omtänkning av hela sökmarknadsföringen.
Google skapar I/O 2026-quiz med AI Studio Google har använt sitt AI Studio-verktyg för att skapa ett quiz om sina största tillkännagivanden från I/O 2026-konferensen. Det här är mer en marknadsföringsgrej än teknisk nyhet, men visar hur Google använder sina egna AI-verktyg för innehållsskapande.
Investeringsjättar frigör kapital inför OpenAI-notering Stora amerikanska fonder säljer av aktier i befintliga innehav för att frigöra kapital inför väntade börsnoteringar av OpenAI och SpaceX. Fonderna positionerar sig för att kunna delta i vad som väntas bli några av årets största börsintroduktioner.
Facebook lanserar Plus-prenumerationer med AI-funktioner Meta rullar ut betalversioner av Facebook, Instagram och WhatsApp globalt för 3,99-2,99 dollar per månad och börjar testa prenumerationer för Meta AI. Flyttet är del av techföretagens jakt på nya intäktsströmmar efter tunga AI-investeringar, precis som Google nyligen sänkte priserna på sina premium-tjänster.
Google justerar Health-appen efter Fitbit-användarnas klagomål Google rullar ut förändringar i sin Health-app denna vecka efter en våg av klagomål från Fitbit-användare som inte gillade den nya designen. Bland annat kommer Today-instrumentpanelen att göras mer flexibel så att hälsomått kan visas i hela skärmen, inte bara i den övre halvan.
Crowdstrike slår ut omfattande botnät Crowdstrike har tillsammans med Google och Shadowserver tagit ner Glassworm, ett botnät som funnits sedan 2024 och specialiserat sig på att stjäla lösenord från utvecklare inom öppen källkod. I över 300 fall lyckades hackarna även plantera skadlig kod i Github-projekt innan botnätet stängdes ner.
AI bygger om grunden för modern marknadsföring Google presenterade nya AI-verktyg för annonsering under Marketing Live 2026. Teamet bakom dagens största tillkännagivanden diskuterade hur AI förändrar marknadsföringens grundstruktur i den avslutande sessionen av Ads Decoded.
Ziggy Marley blir röstguide i Waze Navigationsappen Waze har samarbetat med musikern Ziggy Marley för att låta honom guida användare med sin lugnande röst. Samarbetet lanseras för att fira hans nya album och ger förare 'good vibes' under resan.
Muntert i Asien – LG rusar på Google-avtal LG Electronics aktie stiger kraftigt på nyheter om ett nytt samarbetsavtal med Google, medan börshumöret i Asien generellt är positivt efter uppgifter om ett möjligt fredsavtal kring Iran. Detaljerna kring LG-Google-samarbetet har inte specificerats.
OpenAI delar upp marknadsföringschef-rollen i två positioner OpenAI har delat upp sin marknadsföringschef-roll i två separata CMO-positioner för att stärka sin marknadsföring mot konkurrenter som Anthropic. Flytten signalerar att företaget satsar hårdare på marknadsföring i en alltmer konkurrensutsatt AI-marknad.
Nya Hormuz-strider tynger Asienbörser USA har attackerat Iran som svarat med motåtgärder, vilket driver upp oljepriset och pressar ned börserna i Asien. Även europeiska terminer visar kraftiga nedgångar inför handelsstarten.
Börsen bröt röda sviten – kursraketen fladdrade runt Stockholmsbörsen steg under eftermiddagen och stängde nära dagshögsta efter att Donald Trump meddelade nya besked om Iran. Sivers, som rapporterat stark kursutveckling, uppvisade stora svängningar under dagen men slutade ändå på minus.
Börsen vänder ner – kursraketen skakar Stockholmsbörsen öppnar försiktigt efter gårdagens positiva nyheter om minskade spänningar mellan USA och Iran. Chipbolaget Sivers aktie rör sig efter morgonens kvartalsrapport.
Tredje rekorddagen i rad på Wall Street De amerikanska börserna slog nya rekord för tredje dagen i rad på torsdagen, drivet av rapporter om att USA och Iran närmar sig en överenskommelse trots Irans offentliga förnekanden. Marknaden verkar ta fasta på diplomatiska framsteg bakom kulisserna.
Wall Street reser sig till nya rekordnivåer Wall Street stängde på rekordnivåer efter rapporter om att USA och Iran är nära ett diplomatiskt avtal. Handeln såg initialt trist ut men sentimentet vände kraftigt uppåt under dagen.
Axios satsar på AI för att göra lokaljournalistik lönsam Mediehuset Axios expanderar sitt lokala nyhetsprogram med hjälp av OpenAI:s finansiering, efter att ha nått sina intäktsmål för första halvåret tidigare än väntat. Strategin bygger på att använda AI för att göra lokala nyheter ekonomiskt hållbara marknad för marknad.
Asienbörserna avslutar veckan i dur Flera asiatiska börser stängde veckan med uppgångar när investerare väger nya spänningar mellan USA och Iran mot möjligheten att ett fredsavtal kan nås. Marknadssentimentet påverkas av geopolitisk osäkerhet.
Tredje röda börsdagen i rad – Saab mot strömmen Stockholmsbörsen föll för tredje dagen i rad trots rapporter om framsteg i USA-Iran-förhandlingarna. Saab stack ut positivt efter nya besked kring Gripen-fighter, medan det allmänna börshumöret förblev dystert.
Google-utvecklare åtalas efter insider-betting En Google-utvecklare har åtalats för insiderhandel efter att ha tjänat 1,2 miljoner dollar på Polymarket genom att satsa på vilka söktermer som skulle toppa Google Sök-listorna. Utvecklaren använde konfidentiell marknadsföringsinformation från företaget för sina vadslagningar och har nu permitterats från Google.
Toyota backar tredje månaden i rad Toyotas globala försäljning föll för tredje raka månaden i april, med en dramatisk nedgång på 92 procent i Mellanöstern kopplat till Irankriget. Den japanska biljätten fortsätter att kämpa med geopolitiska utmaningar som påverkar marknaden.
Google-anställd tjänade miljoner på spel – åtalas En Google-anställd åtalas för att ha tjänat miljonbelopp genom spel med insiderinformation. Fallet visar hur även techgiganterna kan drabbas av klassiska finansbrott, även om det inte har med deras kärnverksamhet att göra.
Små röda rörelser på Wall Street Wall Street höll sig kring oförändrade nivåer efter fyra timmars handel på onsdagen, medan oljepriserna föll på rapporter om möjligt avtal mellan Iran och USA. Halvledarsektorn fortsatte sin uppgång med Micron Technology som ledde utvecklingen efter tisdagens rally.
Nya Iran-uppgifter – Stockholmsbörsen på rött Stockholmsbörsen fick först ett uppsving när iransk tv visade ett påstått utkast till avtal mellan USA och Iran, men lyftet blev kortvarigt och börsen vände sedan nedåt. Marknaden reagerade snabbt på geopolitiska rykten som senare visade sig vara osäkra.
Iranska medier: Inte överens med USA än USA och Iran rapporteras vara nära ett avtal enligt amerikanska källor, men iranska medier dementerar genom Tasnim. Typisk diplomatisk förvirring där olika sidor levererar motstridiga signaler genom anonyma källor.
Trump i möte för att ta 'slutgiltigt beslut' USA:s president Donald Trump meddelar att han ska fatta ett slutgiltigt beslut om Iran-avtalet efter ett möte i situation room. Han gjorde tillkännagivandet på sin plattform Truth Social.
USA dementerar Iranuppgifter USA förnekar iranska mediers påståenden från onsdagen och kallar dem för "helt fabricerade" enligt Sky News. Oklart vad de specifika påståendena handlade om från den korta artikeln.
Trump har inte fattat beslut om Iran-avtal Donald Trump har ännu inte tagit något beslut om Irans vapenvileavtal trots att han tidigare under fredagen sa att han skulle samla sina rådgivare för ett "slutgiltigt beslut". Beslutet rör förlängning av vapenvilan och öppnandet av Hormuzsundet.
Revolutionsgardet: Svar riktat mot USA-bas USA:s militär genomförde nya attacker i Iran under natten, enligt amerikanska mediekällor. Som svar säger sig det iranska Revolutionsgardet ha riktat in sig på en amerikansk bas, rapporterar statliga medier.
Vance: Nära avtal men "inte där än" USA:s vicepresidentkandidat JD Vance kommenterar att landet "inte där än" når ett avtal med Iran. Uttalandet kommer mitt i pågående diplomatiska diskussioner mellan länderna.