EmbeddingGemma 2: Google DeepMind lanza el modelo multimodal on-device que procesa texto, código, imágenes, audio y vídeo con 740 millones de parámetros
Google DeepMind publicó EmbeddingGemma 2, un modelo de representación multimodal de 740 millones de parámetros diseñado para ejecutarse directamente en el dispositivo del usuario sin necesidad de conexión a la nube. El modelo puede procesar texto, código, imágenes, audio y vídeo simultáneamente y genera representaciones vectoriales —embeddings— que permiten a las aplicaciones comparar, buscar y… Continúa leyendo » La noticia EmbeddingGemma 2: Google DeepMind lanza el modelo multimodal on-device…