Saltar al contenido
Volver al catálogo

StepAudio 2.5 TTS

StepFun · China · stepfun/stepaudio-2-5-tts

Licencia: PropietarioOrigen: ChinaBanda de precio: No comparableNivel: Especializado

Para qué sirve

Modelo de StepFun que convierte texto en voz, con control sobre la voz, la narración y la entrega del audio. Solo recibe texto y solo produce audio.

Mejor para

  • narración
  • voz sintética
  • audio controlable
  • asistentes de voz

Evitar para

  • chat de texto
  • código
  • análisis de imágenes

Fortalezas

Voz controlableNarraciónEspecializado

Redactado por IA a partir de las fuentes citadas · 29 sept 2026 ·models.dev

Tabla de costos

US$

Sin precio publicado

Precio mezclado 3:1

—

No comparable por token

Costo por 1 000 ejecuciones

  • Chat corto (2 K → 400)— *
  • RAG con 80 % de caché (20 K → 800 · 80 % caché)— *
  • Agente largo (150 K → 12 K · 60 % caché)— *

Especificaciones

Ventana de contexto
0Fuente única
Salida máxima
0Fuente única
Entrada
textFuente única
Salida
audioFuente única
Capacidades
audioFuente única
Pesos abiertos
NoFuente única
Licencia
—
Parámetros
—
Lanzamiento
16 abr 2026Fuente única
Conocimiento hasta
—

Clasificación

Licencia
Propietario
Modalidad
AudioTexto
Origen
China
Banda de precio
No comparable
Nivel
Especializado90 %
Casos de uso
Voz y audio

Historial de precios

Fuentes de esta ficha

También se publica como: stepaudio-2.5-tts