GPT-4.1 och Claude håller jämna steg med Googles nya multimodala embeddingmodell
arXiv cs.AI
Google lanserade i mars 2026 Gemini Embedding 2 – deras första modell som samlar text, bilder, video och ljud i ett gemensamt vektorrumrum (ett sätt att matematiskt representera innehåll för sökning). En ny studie visar att GPT-4.1 och Claude Sonnet 4.6 presterar lika bra som Gemini Embedding 2 på bildåtervinning, men med en viktig skillnad: när embeddingarna väl är förberäknade är dedikerade embeddingmodeller snabbare och mer lämpade för realtidsapplikationer.