GPT-4.1 och Claude håller jämna steg med Googles nya multimodala embeddingmodell

arXiv cs.AI

Google lanserade i mars 2026 Gemini Embedding 2 – deras första modell som samlar text, bilder, video och ljud i ett gemensamt vektorrumrum (ett sätt att matematiskt representera innehåll för sökning). En ny studie visar att GPT-4.1 och Claude Sonnet 4.6 presterar lika bra som Gemini Embedding 2 på bildåtervinning, men med en viktig skillnad: när embeddingarna väl är förberäknade är dedikerade embeddingmodeller snabbare och mer lämpade för realtidsapplikationer.