Google claims EmbeddingGemma 2 outperforms rival embedding models twice its size
Google released EmbeddingGemma 2, a 740M parameter model converting text and media into vectors. It runs on-device with 191 MB RAM and outperforms larger rivals. This open model enables offline RAG apps when paired with Gemma 4.