Chatterbox
chatterboxResemble AI's open Chatterbox TTS. Zero-shot voice cloning from a short audio prompt with an exaggeration control for emotion intensity, plus CFG weight to balance pacing and fidelity.
- Prix
- 0,030 $US/1 000 caractères
- Entrée → Sortie
- Texte → Audio
- Développeur
- Resemble AI
- Mis à jour
- 23 septembre 2026
Clone a voice
- 1
Your voice
Voice sample *Record up to 30 s · file up to 60 s, 10 MB10 to 30 seconds of clear speech, one speaker, no music or background noise.
Only your own voice or a voice you have verifiable permission for. Imitating other people without their consent is not allowed, see our Terms of Service.
- 2
Text
Example text, change it as you like.103 / 4 000 - 3
Listen
0,0031Â $US per run
Playground
Essayer Chatterbox
Entrée et résultat
Cette exécution
0,0001 $US · 0,01 crédits
Nouveau par ici ?
10 crédits gratuits (0,10 $US) à l'inscription avec Google
Utilisable 24 heures après l'inscription, jusqu'à 5 exécutions par jour et au maximum 2 crédits par exécution. Les autres méthodes de connexion commencent sans crédits. Suffisant pour 1 000 exécutions de ce modèle.
Examples
- Durée : 0:39
Prompt
We're excited to introduce Chatterbox, our first production-grade open source TTS model. Licensed under MIT, Chatterbox has been benchmarked against leading closed-source systems like ElevenLabs, and is consistently preferred in side-by-side evaluations. Whether you're working on memes, videos, games, or AI agents, Chatterbox brings your content to life. It's also the first open source TTS model to support emotion exaggeration control, a powerful feature that makes your voices stand out. Try it now on our Hugging Face Gradio app. If you like the model but need to scale or finetune it for higher accuracy, check out our competitively priced TTS service (link). It delivers reliable performance with ultra-low latency of sub 200ms—ideal for production use in agents, applications, or interactive media.
- Durée : 0:19
Prompt
Now let's make my mum's favourite. So three mars bars into the pan. Then we add the tuna and just stir for a bit, just let the chocolate and fish infuse. A sprinkle of olive oil and some tomato ketchup. Now smell that. Oh boy this is going to be incredible.
À propos de Chatterbox
Chatterbox est un modèle de Resemble AI dans la catégorie Synthèse vocale. Sur Railwail, Chatterbox coûte 0,030 $US par 1 000 caractères.
Tarification
| 1 000 caractères | 0,030 $US par 1 000 caractères |
|---|
- 1 crédit = 0,01 $US
Calculatrice de coûts
Calculatrice de prix
Total
3,00Â $US
300 crédits
Par exécution
0,03 $US · 3 crédits
Prix fixe par exécution, connu avant le démarrage.
API
Aucun exemple API vérifié
L'API publique transmet un format d'entrée différent de celui dont ce modèle a besoin. Utilisez le playground ci-dessus.
Spécifications
- ID du modèle
chatterbox- Développeur
- Resemble AI
- Catégorie
- Synthèse vocale
- Entrée
- Texte
- Sortie
- Audio
- Facturation
- Prix fixe, connu avant l'exécution
- Entrée du catalogue mise à jour
- 23 septembre 2026
Paramètres d'entrée
Entrées et paramètres du schéma d'entrée du modèle. L'exemple dans la section API montre lesquels l'API accepte.
promptObligatoireText to speak
Type: TextePar défaut: –Valeurs autorisées: Jusqu'à 4 000 caractèresseed0 = random
Type: Nombre entierPar défaut:0Valeurs autorisées: –audioOptional reference clip (5-60 s) to clone the voice from; requires consent
Type: –Par défaut: –Valeurs autorisées: –cfg_weightType: NombrePar défaut:0.5Valeurs autorisées: 0,2 à 1temperatureType: NombrePar défaut:0.8Valeurs autorisées: 0,05 à 5exaggerationType: NombrePar défaut:0.5Valeurs autorisées: 0,25 à 2
Étiquettes
- replicate
- resemble-ai
- tts
- voice-cloning
- expressive
Cas d'usage
Questions fréquemment posées
Qu'est-ce que Chatterbox ?
Chatterbox est un modèle de Resemble AI dans la catégorie Synthèse vocale.
Combien coûte Chatterbox sur Railwail ?
Sur Railwail, Chatterbox coûte 0,030 $US par 1 000 caractères. Le prix est connu avant le démarrage de l'exécution. L'utilisation est payée à partir de crédits prépayés ; 1 crédit équivaut à 0,01 $US.
Quels paramètres Chatterbox supporte-t-il ?
Selon son schéma d'entrée, Chatterbox connaît ces paramètres : prompt (Jusqu'à 4 000 caractères), seed, audio, cfg_weight (0,2 à 1), temperature (0,05 à 5) et exaggeration (0,25 à 2).
Quelle est la vitesse de Chatterbox ?
Il n'y a pas encore assez d'exécutions mesurées de Chatterbox sur Railwail pour indiquer un temps d'exécution. Cela dépend de l'entrée, des paramètres et de la charge chez le fournisseur.
Chatterbox est-il meilleur que AudioLDM 2 ?
Cela dépend de la tâche. Chatterbox (Resemble AI) et AudioLDM 2 (Haohe Liu) sont tous deux des modèles de la catégorie Synthèse vocale. La page de comparaison affiche leurs prix et spécifications côte à côte.
Comparer Chatterbox et AudioLDM 2Modèles comparables
Tous dans cette catégorie- OpenAI TTS-1OpenAI
OpenAI's text-to-speech model. Six built-in voices with natural intonation.
- OpenAI TTS-1 HDOpenAI
OpenAI's high-definition TTS model. Better quality for production use cases.
- Qwen3 TTSAlibaba (Qwen)
A unified Text-to-Speech demo featuring three powerful modes: Voice, Clone and Design
Tous les modèles via une API
Une clé API pour tous les modèles sur Railwail. L'utilisation est facturée à partir de crédits prépayés, 1 crédit = 0,01 $US.