Step TTS 2
StepFun · China · stepfun/step-tts-2
Licencia: PropietarioOrigen: ChinaBanda de precio: No comparableNivel: Especializado
Para qué sirve
Modelo de generación de voz con control sobre la voz, la narración y la entrega del audio. Recibe texto y devuelve audio.
Mejor para
- narración
- locución
- voz sintética
Evitar para
- generar texto
- razonamiento
- tareas con imágenes
Fortalezas
Voz controlableNarración
Redactado por IA a partir de las fuentes citadas · 29 sept 2026 ·models.dev
Tabla de costos
US$Sin precio publicado
Precio mezclado 3:1
—
No comparable por token
Costo por 1 000 ejecuciones
- Chat corto (2 K → 400)— *
- RAG con 80 % de caché (20 K → 800 · 80 % caché)— *
- Agente largo (150 K → 12 K · 60 % caché)— *
Especificaciones
- Ventana de contexto
- 0Fuente única
- Salida máxima
- 0Fuente única
- Entrada
- textFuente única
- Salida
- audioFuente única
- Capacidades
- audioFuente única
- Pesos abiertos
- NoFuente única
- Licencia
- —
- Parámetros
- —
- Lanzamiento
- 1 mar 2026Fuente única
- Conocimiento hasta
- —
Clasificación
- Licencia
- Propietario
- Modalidad
- AudioTexto
- Origen
- China
- Banda de precio
- No comparable
- Nivel
- Especializado90 %
- Casos de uso
- Voz y audio
Historial de precios
Fuentes de esta ficha
- models.dev (MIT)29 sept 2026
También se publica como: step-tts-2