Gemini 3.1 Flash TTS Preview
Google · EE. UU. · google/gemini-3-1-flash-tts-preview
Licencia: PropietarioOrigen: EE. UU.Banda de precio: Medio (US$2–10)Nivel: EspecializadoPreview
Para qué sirve
Modelo de Google que convierte texto en voz con baja latencia, con indicaciones dirigibles y etiquetas de audio expresivas. Es una versión preliminar y solo produce audio.
Mejor para
- narración
- voz sintética
- audio expresivo
- asistentes de voz
Evitar para
- producción crítica
- chat de texto
- código
Fortalezas
Voz expresivaBaja latenciaControl de estilo
Redactado por IA a partir de las fuentes citadas · 29 sept 2026 ·models.dev
Tabla de costos
US$| Concepto | Tramo | Precio | Verificación | Fuente | Fecha |
|---|---|---|---|---|---|
| Entrada | Base | US$ 1,00 / M tokens | Cruzado | google-pricing +1 | 29 sept 2026 |
| Salida | Base | US$ 20,00 / M tokens | Fuente única | modelsdev | 29 sept 2026 |
| Batch · entrada | Base | US$ 0,500 / M tokens | Verificado | google-pricing | 29 sept 2026 |
| Audio · salida | Base | US$ 20,00 / M tokens | Verificado | google-pricing | 29 sept 2026 |
Precio mezclado 3:1
US$ 5,75
(3 × entrada + salida) / 4, en US$ por millón de tokens.
Costo por 1 000 ejecuciones
- Chat corto (2 K → 400)US$ 9,50
- RAG con 80 % de caché (20 K → 800 · 80 % caché)US$ 36 *
- Agente largo (150 K → 12 K · 60 % caché)US$ 390 *
Especificaciones
- Ventana de contexto
- 8 KFuente única
- Salida máxima
- 16 KFuente única
- Entrada
- textFuente única
- Salida
- audioFuente única
- Capacidades
- reasoning, audioFuente única
- Pesos abiertos
- NoFuente única
- Licencia
- —
- Parámetros
- —
- Lanzamiento
- 15 abr 2026Fuente única
- Conocimiento hasta
- 2025-01Fuente única
Clasificación
- Licencia
- Propietario
- Modalidad
- AudioTexto
- Origen
- EE. UU.
- Banda de precio
- Medio (US$2–10)
- Nivel
- Especializado90 %
- Casos de uso
- Voz y audioRazonamiento
Historial de precios
Fuentes de esta ficha
- models.dev (MIT)29 sept 2026
- google-pricing29 sept 2026
También se publica como: gemini-3.1-flash-tts-preview