Google utvecklar nytt AI-chip för Gemini
Google ska enligt källor till The Information utveckla ett nytt serverchip internt kallat Frozen V2, designat för att köra Gemini-modeller betydligt mer effektivt. Det är ett led i teknikjättarnas kapplöpning om att bygga egna chips anpassade för sina AI-modeller, snarare än att förlita sig på Nvidia.
Djupdykning
Google har länge tillverkat egna chips – kallade TPU:er (Tensor Processing Units) – specifikt för att träna och köra AI-modeller, istället för att vara beroende av Nvidias dyra GPU:er. Frozen V2 verkar ta det ett steg längre: att baka in Geminis specifika arkitektur direkt i hårdvaran, ungefär som om du designade ett motorblock exakt kring ett enda bilmärkes motor. Det gör modellen snabbare och billigare att köra, men låser dig hårdare till just det designvalet. Det som de flesta missar i chip-nyheter är att kampen om AI-dominans lika mycket handlar om inferens – alltså att köra färdiga modeller – som om träning, och den kostnaden är enorm när hundratals miljoner användare ställer frågor dygnet runt. Om Google lyckas köra Gemini markant billigare än vad OpenAI kan köra GPT på Microsofts Nvidia-infrastruktur, är det en konkurrensfördel som syns i marginaler länge innan den syns i produkter.