Saltar al contenido
Volver al catálogo

Step TTS 2

StepFun · China · stepfun/step-tts-2

Licencia: PropietarioOrigen: ChinaBanda de precio: No comparableNivel: Especializado

Para qué sirve

Modelo de generación de voz con control sobre la voz, la narración y la entrega del audio. Recibe texto y devuelve audio.

Mejor para

  • narración
  • locución
  • voz sintética

Evitar para

  • generar texto
  • razonamiento
  • tareas con imágenes

Fortalezas

Voz controlableNarración

Redactado por IA a partir de las fuentes citadas · 29 sept 2026 ·models.dev

Tabla de costos

US$

Sin precio publicado

Precio mezclado 3:1

—

No comparable por token

Costo por 1 000 ejecuciones

  • Chat corto (2 K → 400)— *
  • RAG con 80 % de caché (20 K → 800 · 80 % caché)— *
  • Agente largo (150 K → 12 K · 60 % caché)— *

Especificaciones

Ventana de contexto
0Fuente única
Salida máxima
0Fuente única
Entrada
textFuente única
Salida
audioFuente única
Capacidades
audioFuente única
Pesos abiertos
NoFuente única
Licencia
—
Parámetros
—
Lanzamiento
1 mar 2026Fuente única
Conocimiento hasta
—

Clasificación

Licencia
Propietario
Modalidad
AudioTexto
Origen
China
Banda de precio
No comparable
Nivel
Especializado90 %
Casos de uso
Voz y audio

Historial de precios

Fuentes de esta ficha

También se publica como: step-tts-2