Chatterbox

Sprogudtale (TTS)Tilgængelig
af Resemble AIModell-ID: chatterbox

Resemble AI's open Chatterbox TTS. Zero-shot voice cloning from a short audio prompt with an exaggeration control for emotion intensity, plus CFG weight to balance pacing and fidelity.

Pris
0,030 US$/1.000 tegn
Input → output
Tekst → Lyd
Udvikler
Resemble AI
Opdateret
23. september 2026
01

Clone a voice

Record or upload a short sample, type a text and hear it in that voice. Chatterbox runs in your account like any other run, and you see the price first.
  1. 1

    Your voice

    Voice sample *Record up to 30 s · file up to 60 s, 10 MB

    10 to 30 seconds of clear speech, one speaker, no music or background noise.

  2. 2

    Text

    Example text, change it as you like.103 / 4.000
  3. 3

    Listen

    0,0031 US$ per run

02

Playground

Prøv Chatterbox

Input & resultat

0,030 US$/1.000 tegn
Prøv Chatterbox

0 / 4.000

Voice sampleRecord up to 30 s · file up to 60 s, 10 MB

10 to 30 seconds of clear speech, one speaker, no music or background noise.

Avancerede indstillinger (4)
Resultat
Den genererede tale vises her.

Denne kørsel

0,0001 US$ · 0,01 credits

Ny her?

10 gratis credits (0,10 US$) når du tilmelder dig med Google

Kan bruges 24 timer efter tilmelding, op til 5 kørsler pr. dag og højst 2 credits pr. kørsel. Andre login-metoder starter uden credits. Nok til 1.000 kørsler af denne model.

03

Examples

Real outputs from the public examples of this model on Replicate, with the prompt and settings that produced them. They were not generated live on this page.
  • Prompt

    We're excited to introduce Chatterbox, our first production-grade open source TTS model. Licensed under MIT, Chatterbox has been benchmarked against leading closed-source systems like ElevenLabs, and is consistently preferred in side-by-side evaluations. Whether you're working on memes, videos, games, or AI agents, Chatterbox brings your content to life. It's also the first open source TTS model to support emotion exaggeration control, a powerful feature that makes your voices stand out. Try it now on our Hugging Face Gradio app. If you like the model but need to scale or finetune it for higher accuracy, check out our competitively priced TTS service (link). It delivers reliable performance with ultra-low latency of sub 200ms—ideal for production use in agents, applications, or interactive media.
  • Prompt

    Now let's make my mum's favourite. So three mars bars into the pan. Then we add the tuna and just stir for a bit, just let the chocolate and fish infuse. A sprinkle of olive oil and some tomato ketchup. Now smell that. Oh boy this is going to be incredible.
04

Om Chatterbox

Kort sagtFra 23. september 2026

Chatterbox er en model af Resemble AI i kategorien Sprogudtale (TTS). På Railwail koster Chatterbox 0,030 US$ pr. 1.000 tegn.

Chatterbox is Resemble AI's production-grade open TTS. It clones a voice from a brief audio_prompt and offers an exaggeration slider that scales emotional intensity, which is unusual for open models. cfg_weight and temperature tune delivery. Hosted by resemble-ai on Replicate.
05

Priser

Priser i US-dollar. Forbrug debiteres fra forudbetalte credits.
1.000 tegn0,030 US$ pr. 1.000 tegn
  • 1 kredit = 0,01 US$

Omkostningsberegner

Prisberegner

/ kørsel

I alt

3,00 US$

300 credits

Pr. kørsel

0,03 US$ · 3 credits

Fast pris pr. kørsel, kendt før kørslen starter.

06

API

Kald Chatterbox med din Railwail API-nøgle. Brug dette model-ID i anmodningen:

Intet bekræftet API-eksempel

Den offentlige API sender et andet inputformat end det, som denne model har brug for. Brug playground ovenfor.

07

Specifikationer

Model-ID
chatterbox
Udvikler
Resemble AI
Input
Tekst
Output
Lyd
Fakturering
Fastpris, kendt før kørslen
Katalogelement opdateret
23. september 2026

Inputparametre

Inputs og indstillinger fra modellens inputskema. Eksemplet i API-afsnittet viser, hvilke af dem API'en accepterer.

  • promptpÃ¥krævet

    Text to speak

    Type: Tekst
    Standard: –
    Tilladte værdier: op til 4.000 tegn
  • seed

    0 = random

    Type: Heltal
    Standard: 0
    Tilladte værdier: –
  • audio

    Optional reference clip (5-60 s) to clone the voice from; requires consent

    Type: –
    Standard: –
    Tilladte værdier: –
  • cfg_weight
    Type: Tal
    Standard: 0.5
    Tilladte værdier: 0,2 til 1
  • temperature
    Type: Tal
    Standard: 0.8
    Tilladte værdier: 0,05 til 5
  • exaggeration
    Type: Tal
    Standard: 0.5
    Tilladte værdier: 0,25 til 2

Tags

  • replicate
  • resemble-ai
  • tts
  • voice-cloning
  • expressive
08

Anvendelsestilfælde

09

Ofte stillede spørgsmål

Hvad er Chatterbox?

Chatterbox er en model fra Resemble AI i kategorien Sprogudtale (TTS).

Hvad koster Chatterbox på Railwail?

På Railwail koster Chatterbox 0,030 US$ pr. 1.000 tegn. Prisen kendes før kørslen starter. Forbrug betales fra forudbetalte credits; 1 credit svarer til 0,01 US$.

Hvilke indstillinger understøtter Chatterbox?

Ifølge dens inputskema kender Chatterbox disse parametre: prompt (op til 4.000 tegn), seed, audio, cfg_weight (0,2 til 1), temperature (0,05 til 5) og exaggeration (0,25 til 2).

Hvor hurtig er Chatterbox?

Der er endnu ikke nok målte kørsler af Chatterbox på Railwail til at angive en udførelsestid. Det afhænger af inputtet, indstillingerne og belastningen hos provideren.

Er Chatterbox bedre end AudioLDM 2?

Det afhænger af opgaven. Chatterbox (Resemble AI) og AudioLDM 2 (Haohe Liu) er begge modeller i kategorien Sprogudtale (TTS). Sammenligningssiden viser deres priser og specifikationer side om side.

Sammenlign Chatterbox og AudioLDM 2
10

Sammenlignelige modeller

Alle i denne kategori

Alle modeller via én API

En API-nøgle til alle modeller på Railwail. Forbrug debiteres fra forudbetalte credits, 1 credit = 0,01 US$.