StepAudio 2.5 TTS
StepFun · China · stepfun/stepaudio-2-5-tts
Licencia: PropietarioOrigen: ChinaBanda de precio: No comparableNivel: Especializado
Para qué sirve
Modelo de StepFun que convierte texto en voz, con control sobre la voz, la narración y la entrega del audio. Solo recibe texto y solo produce audio.
Mejor para
- narración
- voz sintética
- audio controlable
- asistentes de voz
Evitar para
- chat de texto
- código
- análisis de imágenes
Fortalezas
Voz controlableNarraciónEspecializado
Redactado por IA a partir de las fuentes citadas · 29 sept 2026 ·models.dev
Tabla de costos
US$Sin precio publicado
Precio mezclado 3:1
—
No comparable por token
Costo por 1 000 ejecuciones
- Chat corto (2 K → 400)— *
- RAG con 80 % de caché (20 K → 800 · 80 % caché)— *
- Agente largo (150 K → 12 K · 60 % caché)— *
Especificaciones
- Ventana de contexto
- 0Fuente única
- Salida máxima
- 0Fuente única
- Entrada
- textFuente única
- Salida
- audioFuente única
- Capacidades
- audioFuente única
- Pesos abiertos
- NoFuente única
- Licencia
- —
- Parámetros
- —
- Lanzamiento
- 16 abr 2026Fuente única
- Conocimiento hasta
- —
Clasificación
- Licencia
- Propietario
- Modalidad
- AudioTexto
- Origen
- China
- Banda de precio
- No comparable
- Nivel
- Especializado90 %
- Casos de uso
- Voz y audio
Historial de precios
Fuentes de esta ficha
- models.dev (MIT)29 sept 2026
También se publica como: stepaudio-2.5-tts