Anthropic-forskare: Mer än 10% risk att AI utrotar mänskligheten

Breakit

En ledande säkerhetsforskare på Anthropic uppger att risken för att AI 'skulle kunna döda alla människor' inom det kommande decenniet är över tio procent. Det är en anmärkningsvärt hög siffra från någon som arbetar inifrån ett av världens mest inflytelserika AI-företag — inte från en extern domedagsprofet.

Djupdykning

Anthropic är inte vilket AI-bolag som helst – det är företaget bakom Claude, grundat av tidigare OpenAI-anställda med ett uttalat fokus på just AI-säkerhet. Så när deras egna säkerhetsforskare sätter en tvåsiffrig procentrisk på mänsklig utrotning är det inte en extern kritiker som larmar, utan någon som bygger tekniken inifrån. Tio procent låter kanske litet, men det är ungefär samma odds som att du dör om du spelar rysk roulett med en tiofaldig revolver – och de flesta skulle tacka nej till det spelet. Det som ofta missas i den här typen av uttalanden är att de inte nödvändigtvis är ett argument för att bromsa utvecklingen, tvärtom argumenterar många på Anthropic för att det är just därför *de* måste vara med och bygga det, för att annars gör någon annan det utan säkerhetsfokuset. Det är en logik som liknar kärnvapenforskarna på Manhattan-projektet, som övertygade sig själva om att det var bättre att demokratierna fick bomben först – ett argument som i efterhand visat sig vara både rätt och fruktansvärt komplicerat på samma gång.