Saltar al contenido
Volver al catálogo

Gemini Embedding 2

Google · EE. UU. · google/gemini-embedding-2

Licencia: PropietarioOrigen: EE. UU.Banda de precio: No comparableNivel: Especializado

Para qué sirve

Modelo de embeddings multimodal que proyecta texto, imágenes, video, audio y PDF en un mismo espacio vectorial. Sirve para búsqueda semántica y recuperación sobre contenidos de distintos formatos, no para conversar.

Mejor para

  • búsqueda semántica
  • recuperación multimodal
  • clasificación por similitud
  • RAG con varios formatos

Evitar para

  • chat
  • generación de texto
  • razonamiento

Fortalezas

Embeddings multimodalesEspacio unificadoRecuperación

Redactado por IA a partir de las fuentes citadas · 29 sept 2026 ·models.dev

Tabla de costos

US$
ConceptoTramoPrecioVerificaciónFuenteFecha
EntradaBaseUS$ 0,200 / M tokensCruzadogoogle-pricing +129 sept 2026
Batch · entradaBaseUS$ 0,100 / M tokensVerificadogoogle-pricing29 sept 2026
Audio · entradaBaseUS$ 6,50 / M tokensVerificadogoogle-pricing29 sept 2026
Imagen · entradaBaseUS$ 0,450 / M tokensVerificadogoogle-pricing29 sept 2026

Precio mezclado 3:1

—

No comparable por token

Costo por 1 000 ejecuciones

  • Chat corto (2 K → 400)— *
  • RAG con 80 % de caché (20 K → 800 · 80 % caché)— *
  • Agente largo (150 K → 12 K · 60 % caché)— *

Especificaciones

Ventana de contexto
8 KFuente única
Salida máxima
1Fuente única
Entrada
text, image, audio, video, pdfFuente única
Salida
textFuente única
Capacidades
vision, audioFuente única
Pesos abiertos
NoFuente única
Licencia
—
Parámetros
—
Lanzamiento
22 abr 2026Fuente única
Conocimiento hasta
2025-11Fuente única

Clasificación

Licencia
Propietario
Modalidad
AudioTextoVideoVisión (imagen de entrada)
Origen
EE. UU.
Banda de precio
No comparable
Nivel
Especializado85 %
Casos de uso
Voz y audioVisión

Historial de precios

Fuentes de esta ficha

También se publica como: gemini-embedding-2