Saltar al contenido

Softlanding Global · Inteligencia de modelos de IA

AI Cost Dashboard

Modelos de IA, lo que cuestan y para qué sirven — con la fuente de cada dato.

306 modelos26 proveedorestodas las fuentes al día

Mostrando 306 de 306

Origen:EE. UU.136

gpt-oss-20b

OpenAI · EE. UU.

Rápido y económicoPesos abiertosRazonamiento

Para qué sirve

Modelo de pesos abiertos de OpenAI con licencia permisiva y arquitectura de mezcla de expertos, que activa solo una parte pequeña de sus parámetros. Solo texto, con razonamiento, herramientas, salida estructurada y procesamiento por lotes.

Entrada
US$ 0,018
Salida
US$ 0,090
/ M tokensFuente única
Contexto: 131 K

Granite 4.0 Micro

IBM · EE. UU.

Rápido y económicoPesos abiertos

Para qué sirve

Modelo pequeño de la familia Granite de IBM, afinado para contexto largo y uso de bajo costo. Solo texto y con pesos abiertos, sin capacidades declaradas de herramientas o razonamiento.

Entrada
US$ 0,017
Salida
US$ 0,112
/ M tokensFuente única
Contexto: 131 K

gpt-oss-120b

OpenAI · EE. UU.

Rápido y económicoPesos abiertosRazonamiento

Para qué sirve

Modelo de pesos abiertos de expertos mezclados diseñado para razonamiento alto, agentes y uso general en producción. Solo texto, con herramientas y salida estructurada.

Entrada
US$ 0,037
Salida
US$ 0,170
/ M tokensFuente única
Contexto: 131 K

Nemotron 3.5 Lightning

NVIDIA · EE. UU.

Rápido y económicoPesos abiertosRazonamiento

Para qué sirve

Modelo abierto de expertos mezclados con pocos parámetros activos, adecuado para cargas agénticas de alto rendimiento y tareas especializadas. Solo texto, con razonamiento y salida estructurada.

Entrada
US$ 0,060
Salida
US$ 0,160
/ M tokensFuente única
Contexto: 262 K

Nemotron 3 Nano 30B A3B

NVIDIA · EE. UU.

Rápido y económicoPesos abiertosRazonamiento

Para qué sirve

Modelo pequeño de mezcla de expertos de NVIDIA, con alta eficiencia de cómputo, pensado para que los desarrolladores construyan sistemas de agentes especializados. Solo texto, con razonamiento, herramientas y salida estructurada, y pesos abiertos.

Entrada
US$ 0,050
Salida
US$ 0,200
/ M tokensFuente única
Contexto: 262 K

Granite 4.2 8B

IBM · EE. UU.

Rápido y económicoPesos abiertosRazonamiento

Para qué sirve

Modelo denso de razonamiento de IBM, adecuado para matemáticas, generación de código, diálogo multilingüe y agentes que requieren varios pasos. Solo texto, con herramientas, salida estructurada y pesos abiertos. Es pequeño y ligero.

Entrada
US$ 0,060
Salida
US$ 0,250
/ M tokensFuente única
Contexto: 131 K
Rápido y económicoRazonamientoVisión

Para qué sirve

Nivel de bajo costo de un modelo de razonamiento de Meta para desarrolladores, con mejoras en generación de código, depuración y comprensión de repositorios. Acepta texto, imagen, video, PDF y audio, con contexto muy largo y herramientas.

Entrada
US$ 0,100
Salida
US$ 0,200
/ M tokensCruzado
Contexto: 1 M
Rápido y económicoRazonamientoVisión

Para qué sirve

Nivel económico de un modelo multimodal de razonamiento de Meta, para experimentación, aprendizaje y flujos iniciales con agentes, varios agentes y programación. Mejora la colaboración de agentes de larga duración y la eficiencia al programar.

Entrada
US$ 0,100
Salida
US$ 0,200
/ M tokensCruzado
Contexto: 1 M
Origen:China146

Ling 3.0 Flash VL

inclusionAI (Ant Group) · China

EspecializadoPesos abiertosRazonamientoVisión

Para qué sirve

Modelo de mezcla de expertos de InclusionAI que añade percepción visual nativa y razonamiento visual avanzado a su versión de texto. Acepta texto, imagen y video, con herramientas y salida estructurada. Tiene pesos abiertos.

Entrada
US$ 0,021
Salida
US$ 0,062
/ M tokensFuente única
Contexto: 262 K

Ling 3.0 Flash

inclusionAI (Ant Group) · China

Rápido y económicoPesos abiertosRazonamiento

Para qué sirve

Modelo de mezcla de expertos de gran tamaño total pero con pocos parámetros activos por token, diseñado para eficiencia de tokens e inferencia agéntica a escala de producción. Es solo texto, de pesos abiertos, con razonamiento y herramientas.

Entrada
US$ 0,021
Salida
US$ 0,063
/ M tokensFuente única
Contexto: 262 K

Qwen3-ASR Flash

Alibaba (Qwen) · China

Rápido y económico

Para qué sirve

Modelo de transcripción de voz que convierte audio en texto con precisión, útil para subtitulado y flujos de transcripción.

Entrada
US$ 0,035
Salida
US$ 0,035
/ M tokensFuente única
Contexto: 53 K

Qwen3.7 Flash

Alibaba (Qwen) · China

Rápido y económicoRazonamientoVisión

Para qué sirve

Modelo ligero y multimodal de Qwen para tareas de texto, imagen y video con alto rendimiento. Es adecuado para agentes multimodales, código visual, búsqueda e interacción con interfaces.

Entrada
US$ 0,030
Salida
US$ 0,130
/ M tokensCruzado
Contexto: 1 M

Seed 1.6 Flash

ByteDance (Seed) · China

Rápido y económicoRazonamientoVisión

Para qué sirve

Modelo de baja latencia para chat de alto volumen, extracción de datos y uso ligero de herramientas. Acepta texto e imágenes y ofrece razonamiento y salida estructurada.

Entrada
US$ 0,022
Salida
US$ 0,223
/ M tokensFuente única
Contexto: 256 K

Hy-MT2-1.8B

Tencent (Hunyuan) · China

Rápido y económicoPesos abiertos

Para qué sirve

Modelo compacto de traducción de Tencent que cubre muchos pares de idiomas y algunos dialectos y lenguas minoritarias chinas. Ofrece flujos con glosario, contexto y control de estilo. Pesos abiertos.

Entrada
US$ 0,044
Salida
US$ 0,177
/ M tokensFuente única
Contexto: 8 K

Ling 3.0 Flash Fin

inclusionAI (Ant Group) · China

Rápido y económicoRazonamiento

Para qué sirve

Modelo de expertos mezclados orientado a finanzas, construido sobre una base rápida y pensado para tareas reales de inversión. Solo texto, con razonamiento, herramientas y salida estructurada.

Entrada
US$ 0,060
Salida
US$ 0,180
/ M tokensFuente única
Contexto: 262 K

DeepSeek V4 Flash 0423

DeepSeek · China

Rápido y económicoPesos abiertosRazonamiento

Para qué sirve

Modelo de mezcla de expertos de DeepSeek optimizado en eficiencia y pensado para inferencia rápida, con contexto muy largo. Es solo texto, de pesos abiertos, con razonamiento, herramientas y salida estructurada.

Entrada
US$ 0,076
Salida
US$ 0,153
/ M tokensNo verificado
Contexto: 1 M
Origen:Europa16

Ministral 3 3B 2512

Mistral AI · Francia

Rápido y económicoPesos abiertosVisión

Para qué sirve

El modelo más pequeño de su familia: un modelo diminuto y eficiente con capacidad de visión. Acepta texto e imágenes, con herramientas y salida estructurada, y pesos abiertos.

Entrada
US$ 0,100
Salida
US$ 0,100
/ M tokensCruzado
Contexto: 131 K

Mistral Small 3.2 24B

Mistral AI · Francia

Rápido y económicoPesos abiertosVisión

Para qué sirve

Modelo pequeño de pesos abiertos optimizado para seguir instrucciones, reducir repeticiones y mejorar la llamada a funciones. Acepta texto e imágenes, con salida estructurada.

Entrada
US$ 0,094
Salida
US$ 0,250
/ M tokensFuente única
Contexto: 256 K

Ministral 3 8B 2512

Mistral AI · Francia

Rápido y económicoPesos abiertosVisión

Para qué sirve

Modelo pequeño y eficiente de la familia Ministral de Mistral, con capacidad de visión. Acepta texto e imagen, con herramientas, salida estructurada y procesamiento por lotes. Tiene pesos abiertos y sirve para chat y agentes ligeros.

Entrada
US$ 0,150
Salida
US$ 0,150
/ M tokensCruzado
Contexto: 262 K

Mistral Small 3.2

Mistral AI · Francia

Rápido y económicoPesos abiertosVisión

Para qué sirve

Modelo eficiente de Mistral de pesos abiertos para chat rápido, extracción de datos y asistentes en producción. Acepta texto e imagen, responde con texto y admite herramientas.

Entrada
US$ 0,100
Salida
US$ 0,300
/ M tokensFuente única
Contexto: 128 K

Voxtral Small 24B 2507

Mistral AI · Francia

Rápido y económicoPesos abiertos

Para qué sirve

Modelo de Mistral que suma entrada de audio a un modelo de texto ya sólido. Destaca en transcripción, traducción y comprensión de audio, y también acepta texto y PDF. Responde con texto, con herramientas y pesos abiertos.

Entrada
US$ 0,100
Salida
US$ 0,300
/ M tokensFuente única
Contexto: 33 K

Ministral 3 14B 2512

Mistral AI · Francia

Rápido y económicoPesos abiertosVisión

Para qué sirve

El mayor modelo de la familia Ministral, con capacidades y rendimiento comparables a los de un modelo Mistral Small superior. Es eficiente, de pesos abiertos, acepta texto e imagen y ofrece herramientas y salida estructurada.

Entrada
US$ 0,200
Salida
US$ 0,200
/ M tokensCruzado
Contexto: 262 K

Mistral Small 4

Mistral AI · Francia

Rápido y económicoPesos abiertosRazonamientoVisión

Para qué sirve

Fast Mistral production model for chat, extraction, and cost-sensitive agents

Entrada
US$ 0,150
Salida
US$ 0,600
/ M tokensCruzado
Contexto: 256 K

Codestral 2508

Mistral AI · Francia

Especializado

Para qué sirve

Modelo de Mistral especializado en programación, para tareas de baja latencia y alta frecuencia como completar código intermedio, corregir código y generar pruebas. Admite herramientas, salida estructurada y procesamiento por lotes.

Entrada
US$ 0,300
Salida
US$ 0,900
/ M tokensCruzado
Contexto: 256 K
Origen:Otros8

Jamba Mini

AI21 Labs · Israel

Rápido y económicoPesos abiertos

Para qué sirve

Modelo ligero y eficiente con arquitectura híbrida (SSM y Transformer), pensado para tareas variadas con buena eficiencia. Trabaja solo con texto, admite herramientas y salidas estructuradas, y tiene pesos abiertos. Encaja en chat y agentes sencillos con contexto largo.

Entrada
US$ 0,200
Salida
US$ 0,400
/ M tokensFuente única
Contexto: 256 K

Command A+

Cohere · Canadá

EquilibradoRazonamientoVisión

Para qué sirve

Modelo insignia de Cohere para flujos de agentes empresariales. Acepta texto e imagen, con llamadas a herramientas de esquema estricto, salida estructurada y razonamiento.

Entrada
US$ 0,300
Salida
US$ 1,50
/ M tokensFuente única
Contexto: 192 K

Jamba Large

AI21 Labs · Israel

EquilibradoPesos abiertos

Para qué sirve

Modelo de texto de arquitectura híbrida pensado para agentes empresariales y generación basada en fuentes. Maneja contexto largo, uso de herramientas y salida estructurada, y sus pesos son abiertos.

Entrada
US$ 2,00
Salida
US$ 8,00
/ M tokensFuente única
Contexto: 256 K

Command A Plus

Cohere · Canadá

EquilibradoPesos abiertosRazonamientoVisión

Para qué sirve

Modelo de Cohere más potente de su línea Command, orientado a agentes multilingües y flujos empresariales. Acepta texto e imagen, responde con texto y ofrece razonamiento, herramientas y salida estructurada. Sus pesos son abiertos.

Entrada
US$ 2,50
Salida
US$ 10,00
/ M tokensNo verificado
Contexto: 128 K

Command A Reasoning

Cohere · Canadá

EquilibradoPesos abiertosRazonamiento

Para qué sirve

Modelo de razonamiento de Cohere para agentes empresariales multilingües, uso de herramientas y flujos complejos. Solo procesa texto y sus pesos son abiertos.

Entrada
US$ 2,50
Salida
US$ 10,00
/ M tokensFuente única
Contexto: 256 K

Command A Translate

Cohere · Canadá

EquilibradoPesos abiertos

Para qué sirve

Modelo de Cohere especializado en traducción: conversión entre idiomas, localización y flujos multilingües. Trabaja solo con texto, admite herramientas y tiene pesos abiertos. Su ventana de contexto es corta.

Entrada
US$ 2,50
Salida
US$ 10,00
/ M tokensFuente única
Contexto: 8 K

Command A Vision

Cohere · Canadá

EspecializadoPesos abiertosVisión

Para qué sirve

Modelo de visión de Cohere con pesos abiertos para analizar documentos multilingües, reconocer texto en imágenes (OCR) y entender imágenes. Recibe texto e imagen y responde con texto.

Entrada
US$ 2,50
Salida
US$ 10,00
/ M tokensFuente única
Contexto: 128 K

North Mini Code

Cohere · Canadá

Rápido y económicoPesos abiertosRazonamiento

Para qué sirve

Modelo de programación de Cohere, pequeño y rápido, para ingeniería de software práctica y ediciones de código con agentes. Solo procesa texto y ofrece razonamiento, herramientas, salida estructurada y pesos abiertos.

0 por token: se factura por otra unidad (imagen, audio, solicitud) o es gratuito

Contexto: 256 K