Chatterbox
chatterboxResemble AI's open Chatterbox TTS. Zero-shot voice cloning from a short audio prompt with an exaggeration control for emotion intensity, plus CFG weight to balance pacing and fidelity.
- Precio
- USD 0.030/1.000 caracteres
- Entrada → Salida
- Texto → Audio
- Desarrollador
- Resemble AI
- Actualizado
- 23 de septiembre de 2026
Clone a voice
- 1
Your voice
Voice sample *Record up to 30 s · file up to 60 s, 10 MB10 to 30 seconds of clear speech, one speaker, no music or background noise.
Only your own voice or a voice you have verifiable permission for. Imitating other people without their consent is not allowed, see our Terms of Service.
- 2
Text
Example text, change it as you like.103 / 4,000 - 3
Listen
USD 0.0031 per run
Playground
Probar Chatterbox
Entrada y salida
Esta ejecución
USD 0.0001 · 0.01 créditos
¿Nuevo aquí?
10 créditos gratis (USD 0.10) cuando te registras con Google
Utilizable 24 horas después del registro, hasta 5 ejecuciones por día y como máximo 2 créditos por ejecución. Otros métodos de inicio de sesión comienzan sin créditos. Suficiente para 1,000 ejecuciones de este modelo.
Examples
- Duración: 0:39
Prompt
We're excited to introduce Chatterbox, our first production-grade open source TTS model. Licensed under MIT, Chatterbox has been benchmarked against leading closed-source systems like ElevenLabs, and is consistently preferred in side-by-side evaluations. Whether you're working on memes, videos, games, or AI agents, Chatterbox brings your content to life. It's also the first open source TTS model to support emotion exaggeration control, a powerful feature that makes your voices stand out. Try it now on our Hugging Face Gradio app. If you like the model but need to scale or finetune it for higher accuracy, check out our competitively priced TTS service (link). It delivers reliable performance with ultra-low latency of sub 200ms—ideal for production use in agents, applications, or interactive media.
- Duración: 0:19
Prompt
Now let's make my mum's favourite. So three mars bars into the pan. Then we add the tuna and just stir for a bit, just let the chocolate and fish infuse. A sprinkle of olive oil and some tomato ketchup. Now smell that. Oh boy this is going to be incredible.
Acerca de Chatterbox
Chatterbox es un modelo de Resemble AI en la categoría Síntesis de voz. En Railwail, Chatterbox cuesta USD 0.030 por 1,000 caracteres.
Precios
| 1,000 caracteres | USD 0.030 por 1,000 caracteres |
|---|
- 1 crédito = USD 0.01
Calculadora de costos
Calculadora de precios
Total
USD 3.00
300 créditos
Por ejecución
USD 0.03 · 3 créditos
Precio fijo por ejecución, conocido antes de que inicie.
API
Sin ejemplo de API verificado
La API pública pasa un formato de entrada diferente al que necesita este modelo. Usa el playground anterior.
Especificaciones
- ID del modelo
chatterbox- Desarrollador
- Resemble AI
- Categoría
- Síntesis de voz
- Entrada
- Texto
- Salida
- Audio
- Facturación
- Precio fijo, conocido antes de la ejecución
- Entrada del catálogo actualizada
- 23 de septiembre de 2026
Parámetros de entrada
Entradas y configuraciones del esquema de entrada del modelo. El ejemplo en la sección API muestra cuáles de ellas acepta la API.
promptrequeridoText to speak
Tipo: TextoPredeterminado: –Valores permitidos: hasta 4,000 caracteresseed0 = random
Tipo: Número enteroPredeterminado:0Valores permitidos: –audioOptional reference clip (5-60 s) to clone the voice from; requires consent
Tipo: –Predeterminado: –Valores permitidos: –cfg_weightTipo: NúmeroPredeterminado:0.5Valores permitidos: 0.2 a 1temperatureTipo: NúmeroPredeterminado:0.8Valores permitidos: 0.05 a 5exaggerationTipo: NúmeroPredeterminado:0.5Valores permitidos: 0.25 a 2
Etiquetas
- replicate
- resemble-ai
- tts
- voice-cloning
- expressive
Casos de uso
Preguntas frecuentes
¿Qué es Chatterbox?
Chatterbox es un modelo de Resemble AI en la categoría Síntesis de voz.
¿Cuánto cuesta Chatterbox en Railwail?
En Railwail, Chatterbox cuesta USD 0.030 por 1,000 caracteres. El precio se conoce antes de que comience la ejecución. El uso se paga con créditos prepagados; 1 crédito equivale a USD 0.01.
¿Qué configuraciones admite Chatterbox?
Según su esquema de entrada, Chatterbox conoce estos parámetros: prompt (hasta 4,000 caracteres), seed, audio, cfg_weight (0.2 a 1), temperature (0.05 a 5) y exaggeration (0.25 a 2).
¿Qué tan rápido es Chatterbox?
Aún no hay suficientes ejecuciones medidas de Chatterbox en Railwail para indicar un tiempo de ejecución. Depende de la entrada, la configuración y la carga en el proveedor.
¿Es Chatterbox mejor que AudioLDM 2?
Eso depende de la tarea. Chatterbox (Resemble AI) y AudioLDM 2 (Haohe Liu) son ambos modelos en la categoría Síntesis de voz. La página de comparación muestra sus precios y especificaciones lado a lado.
Comparar Chatterbox y AudioLDM 2Modelos comparables
Todos en esta categoría- OpenAI TTS-1OpenAI
OpenAI's text-to-speech model. Six built-in voices with natural intonation.
- OpenAI TTS-1 HDOpenAI
OpenAI's high-definition TTS model. Better quality for production use cases.
- Qwen3 TTSAlibaba (Qwen)
A unified Text-to-Speech demo featuring three powerful modes: Voice, Clone and Design
Todos los modelos a través de una API
Una clave API para todos los modelos en Railwail. El uso se cobra con créditos prepagados, 1 crédito = USD 0.01.