Saltar al contenido
Volver al catálogo

GLM-4.5-Flash

Z.ai (Zhipu) · China · zai/glm-4-5-flash

Licencia: Pesos abiertosOrigen: ChinaBanda de precio: No comparableNivel: Rápido y económico

Para qué sirve

Modelo GLM eficiente para razonamiento rápido, programación y flujos de agentes. Es solo texto, de pesos abiertos, con herramientas y caché de prompts.

Mejor para

  • razonamiento rápido
  • programación
  • agentes
  • chat de bajo costo

Evitar para

  • tareas con imágenes
  • entrada de audio

Fortalezas

RapidezEficienciaPesos abiertos

Redactado por IA a partir de las fuentes citadas · 29 sept 2026 ·models.dev

Tabla de costos

US$
ConceptoTramoPrecioVerificaciónFuenteFecha
EntradaBaseUS$ 0,00 / M tokensCruzadozai-pricing +229 sept 2026
SalidaBaseUS$ 0,00 / M tokensCruzadozai-pricing +229 sept 2026
Lectura de cachéBaseUS$ 0,00 / M tokensCruzadozai-pricing +129 sept 2026
Escritura de cachéBaseUS$ 0,00 / M tokensFuente únicamodelsdev29 sept 2026

Precio mezclado 3:1

—

No comparable por token

Costo por 1 000 ejecuciones

  • Chat corto (2 K → 400)— *
  • RAG con 80 % de caché (20 K → 800 · 80 % caché)— *
  • Agente largo (150 K → 12 K · 60 % caché)— *

Especificaciones

Ventana de contexto
131 KFuente única
Salida máxima
98 KNo verificado
Entrada
textFuente única
Salida
textFuente única
Capacidades
tools, reasoning, cachingFuente única
Pesos abiertos
SíFuente única
Licencia
—
Parámetros
—
Lanzamiento
28 jul 2025Fuente única
Conocimiento hasta
2025-04Fuente única

Clasificación

Licencia
Pesos abiertos
Modalidad
Texto
Origen
China
Banda de precio
No comparable
Nivel
Rápido y económico65 %
Casos de uso
Agentes y herramientasChat generalRazonamiento

Historial de precios

Fuentes de esta ficha

También se publica como: glm-4.5-flash · GLM-4.5-Flash