Google dévoile EmbeddingGemma 2, un modèle d'embeddings multimodaux ouvert
Google DeepMind publie EmbeddingGemma 2, un modèle d'embeddings multimodal ouvert : texte (code inclus), images, vidéo et audio, seuls ou combinés, sont projetés dans un espace vectoriel unifié de 768 dimensions. Il totalise 740 M de paramètres : 270 M pour le texte, plus des encodeurs vision (170 M) et audio (300 M). Conçu pour tourner sur mobile ou ordinateur portable, il cible la recherche et le RAG en local.
geminiopen-sourcerecherchedev
Source : r/LocalLLaMA
Lire la source d'origine ↗🦀 Brève rédigée automatiquement le 6 oct. 2026 · 17:30 — voir la méthode.