Google lanserar Gemini 3.8 Flash – kan bli dyrare trots samma prislapp

The Verge AI

Google har släppt Gemini 3.8 Flash, bara några veckor efter föregångaren 3.7. Modellen kostar samma på ytan – 0,75 dollar per miljon inmatade tokens och 3,75 dollar per miljon genererade – men Google varnar själva för att den kan använda fler tokens för att lösa komplexa uppgifter, vilket gör att slutnotan ändå kan bli högre. Utvecklare som vill hålla kostnaderna nere kan alltså fortsätta använda 3.7 Flash.

Djupdykning

Google fortsätter sin snabba releasetakt och det börjar likna ett löpande band – 3.7 var knappt varm i handen innan 3.8 dök upp. Det centrala här är egentligen inte modellversionen i sig, utan hur Google pratar om kostnader: samma pris per token, men modellen kan använda *fler* tokens för att lösa svårare uppgifter. Det kallas ibland "compute scaling at inference" – alltså att modellen tänker mer under körning istället för att bara vara tränad bättre från start, vilket kan bli dyrt i skala om du kör miljontals anrop. För en enskild utvecklare kanske det är försumbart, men för ett företag som bygger en produkt ovanpå API:et kan skillnaden mellan 3.7 och 3.8 snabbt bli kännbar på fakturan utan att man märker det förrän månadsrapporten trillar in. Det Google egentligen erkänner är att de säljer "mer ansträngning" som en feature – och det är en ganska ärlig men också lite obekväm position, eftersom du som kund inte alltid har koll på när modellen bestämmer sig för att "anstränga sig extra."