NVIDIAs nya Vera Rubin-chip rullas ut hos stora molnleverantörer
NVIDIAs senaste AI-chip, Vera Rubin NVL72, börjar nu levereras i stor skala till molnjättarna CoreWeave, Google Cloud, Microsoft Azure och Oracle Cloud Infrastructure. Produktionen sker via ett nätverk av över 350 fabriker i 30 länder – det är intressant att notera hur mycket NVIDIA nu satsar på att bygga en diversifierad leveranskedja, troligtvis för att undvika de flaskhalsar som drabbade tidigare generationer. Chipet marknadsförs med fokus på prestanda per watt och lägre kostnad per genererad token (det vill säga priset för att köra AI-modeller).
Djupdykning
NVIDIA döpte sin nya chipgeneration efter astronomen Vera Rubin – en kvinna som fick vänta decennier på erkännande för sin banbrytande forskning om mörk materia – och nu levererar chipsen i industriell skala till de fyra molnjättarna CoreWeave, Google Cloud, Azure och Oracle. NVL72 är ett rack-format chip, vilket betyder att 72 GPU:er sitter sammankopplade i ett enda hylla-format system och delar minne och bandbredd på ett sätt som gör dem mer effektiva än om de kördes separat. Prestanda per watt (hur mycket beräkningskraft du får per förbrukad kilowattimme) och kostnad per token (vad det faktiskt kostar att generera ett AI-svar) är de två mätetal som avgör vem som överlever i molnbranschen just nu – inte råhastighet. Det de flesta missar i den här typen av lanseringstext är att "350+ fabriksanläggningar i 30 länder" inte är en marknadsföringsdetalj utan en geopolitisk positionering: NVIDIA sprider aktivt sin tillverkningsbas för att minska sårbarhet mot exportrestriktioner och försörjningskedjechock, precis det som nästan knäckte dem när Biden-administrationens chipexportförbud slog till mot Kina. När konkurrenter som AMD och Googles egna TPU-chips kämpar för att ta marknadsandelar är NVIDIA:s verkliga vallgrav inte längre bara tekniken – det är att ingen annan har den logistikapparat som krävs för att leverera i den här skalan.