Saltar al contenido
Volver al catálogo

StepAudio 2.5 ASR

StepFun · China · stepfun/stepaudio-2-5-asr

Licencia: PropietarioOrigen: ChinaBanda de precio: No comparableNivel: Equilibrado

Para qué sirve

Modelo de reconocimiento de voz de StepFun que convierte audio en texto con precisión, útil para transcripción y subtitulado. Recibe solo audio y responde con texto. No genera voz ni admite herramientas.

Mejor para

  • transcripción de audio
  • subtitulado
  • voz a texto

Evitar para

  • chat
  • tareas con imágenes
  • generar voz

Fortalezas

transcripciónprecisiónaudio

Redactado por IA a partir de las fuentes citadas · 29 sept 2026 ·models.dev

Tabla de costos

US$

Sin precio publicado

Precio mezclado 3:1

—

No comparable por token

Costo por 1 000 ejecuciones

  • Chat corto (2 K → 400)— *
  • RAG con 80 % de caché (20 K → 800 · 80 % caché)— *
  • Agente largo (150 K → 12 K · 60 % caché)— *

Especificaciones

Ventana de contexto
0Fuente única
Salida máxima
0Fuente única
Entrada
audioFuente única
Salida
textFuente única
Capacidades
audioFuente única
Pesos abiertos
NoFuente única
Licencia
—
Parámetros
—
Lanzamiento
24 abr 2026Fuente única
Conocimiento hasta
—

Clasificación

Licencia
Propietario
Modalidad
AudioTexto
Origen
China
Banda de precio
No comparable
Nivel
Equilibrado80 %
Casos de uso
Voz y audioChat general

Historial de precios

Fuentes de esta ficha

También se publica como: stepaudio-2.5-asr