Chatterbox

Synthèse vocaleDisponible
par Resemble AIID du modèle: chatterbox

Resemble AI's open Chatterbox TTS. Zero-shot voice cloning from a short audio prompt with an exaggeration control for emotion intensity, plus CFG weight to balance pacing and fidelity.

Prix
0,030 $US/1 000 caractères
Entrée → Sortie
Texte → Audio
Développeur
Resemble AI
Mis à jour
23 septembre 2026
01

Clone a voice

Record or upload a short sample, type a text and hear it in that voice. Chatterbox runs in your account like any other run, and you see the price first.
  1. 1

    Your voice

    Voice sample *Record up to 30 s · file up to 60 s, 10 MB

    10 to 30 seconds of clear speech, one speaker, no music or background noise.

  2. 2

    Text

    Example text, change it as you like.103 / 4 000
  3. 3

    Listen

    0,0031 $US per run

02

Playground

Essayer Chatterbox

Entrée et résultat

0,030 $US/1 000 caractères
Essayer Chatterbox

0 / 4 000

Voice sampleRecord up to 30 s · file up to 60 s, 10 MB

10 to 30 seconds of clear speech, one speaker, no music or background noise.

Paramètres avancés (4)
Résultat
La parole générée apparaît ici.

Cette exécution

0,0001 $US · 0,01 crédits

Nouveau par ici ?

10 crédits gratuits (0,10 $US) lors de l'inscription avec Google

Utilisable 24 heures après l'inscription, jusqu'à 5 exécutions par jour et au maximum 2 crédits par exécution. Les autres méthodes de connexion commencent sans crédits. Suffisant pour 1 000 exécutions de ce modèle.

03

Examples

Real outputs from the public examples of this model on Replicate, with the prompt and settings that produced them. They were not generated live on this page.
  • Prompt

    We're excited to introduce Chatterbox, our first production-grade open source TTS model. Licensed under MIT, Chatterbox has been benchmarked against leading closed-source systems like ElevenLabs, and is consistently preferred in side-by-side evaluations. Whether you're working on memes, videos, games, or AI agents, Chatterbox brings your content to life. It's also the first open source TTS model to support emotion exaggeration control, a powerful feature that makes your voices stand out. Try it now on our Hugging Face Gradio app. If you like the model but need to scale or finetune it for higher accuracy, check out our competitively priced TTS service (link). It delivers reliable performance with ultra-low latency of sub 200ms—ideal for production use in agents, applications, or interactive media.
  • Prompt

    Now let's make my mum's favourite. So three mars bars into the pan. Then we add the tuna and just stir for a bit, just let the chocolate and fish infuse. A sprinkle of olive oil and some tomato ketchup. Now smell that. Oh boy this is going to be incredible.
04

À propos de Chatterbox

RésuméAu 23 septembre 2026

Chatterbox est un modèle de Resemble AI dans la catégorie Synthèse vocale. Sur Railwail, Chatterbox coûte 0,030 $US par 1 000 caractères.

Chatterbox is Resemble AI's production-grade open TTS. It clones a voice from a brief audio_prompt and offers an exaggeration slider that scales emotional intensity, which is unusual for open models. cfg_weight and temperature tune delivery. Hosted by resemble-ai on Replicate.
05

Tarification

Prix en dollars US. L'utilisation est facturée à partir de crédits prépayés.
1 000 caractères0,030 $US par 1 000 caractères
  • 1 crédit = 0,01 $US

Calculateur de coûts

Calculateur de prix

/ exécution

Total

3,00 $US

300 crédits

Par exécution

0,03 $US · 3 crédits

Prix fixe par exécution, connu avant le démarrage.

06

API

Appelez Chatterbox avec votre clé API Railwail. Utilisez cet ID de modèle dans la requête :

Aucun exemple API vérifié

L'API publique transmet un format d'entrée différent de celui dont ce modèle a besoin. Utilisez le playground ci-dessus.

07

Spécifications

ID du modèle
chatterbox
Développeur
Resemble AI
Catégorie
Synthèse vocale
Entrée
Texte
Sortie
Audio
Facturation
Prix fixe, connu avant l'exécution
Entrée du catalogue mise à jour
23 septembre 2026

Paramètres d'entrée

Entrées et paramètres du schéma d'entrée du modèle. L'exemple dans la section API montre lesquels l'API accepte.

  • promptObligatoire

    Text to speak

    Type: Texte
    Défaut: –
    Valeurs autorisées: Jusqu'à 4 000 caractères
  • seed

    0 = random

    Type: Nombre entier
    Défaut: 0
    Valeurs autorisées: –
  • audio

    Optional reference clip (5-60 s) to clone the voice from; requires consent

    Type: –
    Défaut: –
    Valeurs autorisées: –
  • cfg_weight
    Type: Nombre
    Défaut: 0.5
    Valeurs autorisées: 0,2 à 1
  • temperature
    Type: Nombre
    Défaut: 0.8
    Valeurs autorisées: 0,05 à 5
  • exaggeration
    Type: Nombre
    Défaut: 0.5
    Valeurs autorisées: 0,25 à 2

Étiquettes

  • replicate
  • resemble-ai
  • tts
  • voice-cloning
  • expressive
08

Cas d'usage

09

Questions fréquemment posées

Qu'est-ce que Chatterbox ?

Chatterbox est un modèle de Resemble AI dans la catégorie Synthèse vocale.

Combien coûte Chatterbox sur Railwail ?

Sur Railwail, Chatterbox coûte 0,030 $US par 1 000 caractères. Le prix est connu avant le démarrage de l'exécution. L'utilisation est payée à partir de crédits prépayés ; 1 crédit équivaut à 0,01 $US.

Quels paramètres Chatterbox supporte-t-il ?

Selon son schéma d'entrée, Chatterbox connaît ces paramètres : prompt (Jusqu'à 4 000 caractères), seed, audio, cfg_weight (0,2 à 1), temperature (0,05 à 5) et exaggeration (0,25 à 2).

Quelle est la vitesse de Chatterbox ?

Il n'y a pas encore assez d'exécutions mesurées de Chatterbox sur Railwail pour indiquer un temps d'exécution. Cela dépend de l'entrée, des paramètres et de la charge chez le fournisseur.

Chatterbox est-il meilleur que AudioLDM 2 ?

Cela dépend de la tâche. Chatterbox (Resemble AI) et AudioLDM 2 (Haohe Liu) sont tous deux des modèles de la catégorie Synthèse vocale. La page de comparaison affiche leurs prix et spécifications côte à côte.

Comparer Chatterbox et AudioLDM 2
10

Modèles comparables

Tous dans cette catégorie

Tous les modèles via une seule API

Une clé API pour tous les modèles sur Railwail. L'utilisation est facturée à partir de crédits prépayés, 1 crédit = 0,01 $US.