Chatterbox

Synteza mowyDostępne
od Resemble AIID modelu: chatterbox

Resemble AI's open Chatterbox TTS. Zero-shot voice cloning from a short audio prompt with an exaggeration control for emotion intensity, plus CFG weight to balance pacing and fidelity.

Cena
0,030 USD/1000 znaków
Wejście → Wyjście
Tekst → Audio
Deweloper
Resemble AI
Zaktualizowano
23 września 2026
01

Clone a voice

Record or upload a short sample, type a text and hear it in that voice. Chatterbox runs in your account like any other run, and you see the price first.
  1. 1

    Your voice

    Voice sample *Record up to 30 s · file up to 60 s, 10 MB

    10 to 30 seconds of clear speech, one speaker, no music or background noise.

  2. 2

    Text

    Example text, change it as you like.103 / 4000
  3. 3

    Listen

    0,0031 USD per run

02

Playground

Spróbuj Chatterbox

Wejście i wyjście

0,030 USD/1000 znaków
Spróbuj Chatterbox

0 / 4000

Voice sampleRecord up to 30 s · file up to 60 s, 10 MB

10 to 30 seconds of clear speech, one speaker, no music or background noise.

Ustawienia zaawansowane (4)
Wynik
Wygenerowana mowa pojawi się tutaj.

To uruchomienie

0,0001 USD · 0,01 kredytów

Nowy tutaj?

10 darmowych kredytów (0,10 USD) po zarejestrowaniu się przez Google

Dostępne 24 godzin po rejestracji, do 5 uruchomień dziennie i maksymalnie 2 kredytów na uruchomienie. Inne metody logowania uruchamiają się bez kredytów. Wystarczy na 1000 uruchomień tego modelu.

03

Examples

Real outputs from the public examples of this model on Replicate, with the prompt and settings that produced them. They were not generated live on this page.
  • Prompt

    We're excited to introduce Chatterbox, our first production-grade open source TTS model. Licensed under MIT, Chatterbox has been benchmarked against leading closed-source systems like ElevenLabs, and is consistently preferred in side-by-side evaluations. Whether you're working on memes, videos, games, or AI agents, Chatterbox brings your content to life. It's also the first open source TTS model to support emotion exaggeration control, a powerful feature that makes your voices stand out. Try it now on our Hugging Face Gradio app. If you like the model but need to scale or finetune it for higher accuracy, check out our competitively priced TTS service (link). It delivers reliable performance with ultra-low latency of sub 200ms—ideal for production use in agents, applications, or interactive media.
  • Prompt

    Now let's make my mum's favourite. So three mars bars into the pan. Then we add the tuna and just stir for a bit, just let the chocolate and fish infuse. A sprinkle of olive oil and some tomato ketchup. Now smell that. Oh boy this is going to be incredible.
04

O Chatterbox

Krótko mówiącStan na 23 września 2026

Chatterbox to model opracowany przez Resemble AI w kategorii Synteza mowy. W serwisie Railwail Chatterbox kosztuje 0,030 USD za 1000 znaków.

Chatterbox is Resemble AI's production-grade open TTS. It clones a voice from a brief audio_prompt and offers an exaggeration slider that scales emotional intensity, which is unusual for open models. cfg_weight and temperature tune delivery. Hosted by resemble-ai on Replicate.
05

Ceny

Ceny w dolarach amerykańskich. Użycie jest rozliczane z prepłaconych kredytów.
1000 znaków0,030 USD za 1000 znaków
  • 1 kredyt = 0,01 USD

Kalkulator kosztów

Kalkulator cen

/ uruchomienie

Razem

3,00 USD

300 kredytów

Za uruchomienie

0,03 USD · 3 kredytów

Stała cena za uruchomienie, znana przed jego rozpoczęciem.

06

API

Wywołaj Chatterbox za pomocą klucza API Railwail. Użyj tego ID modelu w żądaniu:

Brak zweryfikowanego przykładu API

Publiczny API przekazuje inny format wejściowy niż wymaga ten model. Użyj placu zabaw powyżej.

07

Specyfikacje

ID modelu
chatterbox
Deweloper
Resemble AI
Kategoria
Synteza mowy
Wejście
Tekst
Wyjście
Audio
Rozliczenie
Cena stała, znana przed uruchomieniem
Wpis w katalogu zaktualizowany
23 września 2026

Parametry wejściowe

Dane wejściowe i ustawienia ze schematu wejściowego modelu. Przykład w sekcji API pokazuje, które z nich API akceptuje.

  • promptwymagane

    Text to speak

    Typ: Tekst
    Domyślnie: –
    Dozwolone wartości: do 4000 znaków
  • seed

    0 = random

    Typ: Liczba całkowita
    Domyślnie: 0
    Dozwolone wartości: –
  • audio

    Optional reference clip (5-60 s) to clone the voice from; requires consent

    Typ: –
    Domyślnie: –
    Dozwolone wartości: –
  • cfg_weight
    Typ: Liczba
    Domyślnie: 0.5
    Dozwolone wartości: 0,2 do 1
  • temperature
    Typ: Liczba
    Domyślnie: 0.8
    Dozwolone wartości: 0,05 do 5
  • exaggeration
    Typ: Liczba
    Domyślnie: 0.5
    Dozwolone wartości: 0,25 do 2

Tagi

  • replicate
  • resemble-ai
  • tts
  • voice-cloning
  • expressive
08

Przypadki użycia

09

Często zadawane pytania

Co to jest Chatterbox?

Chatterbox to model opracowany przez Resemble AI w kategorii Synteza mowy.

Ile kosztuje Chatterbox w serwisie Railwail?

W serwisie Railwail Chatterbox kosztuje 0,030 USD za 1000 znaków. Cena jest znana przed rozpoczęciem przebiegu. Użycie jest opłacane z przedpłaconych kredytów; 1 kredyt równa się 0,01 USD.

Jakie ustawienia obsługuje Chatterbox?

Zgodnie ze schematem wejściowym, Chatterbox obsługuje te parametry: prompt (do 4000 znaków), seed, audio, cfg_weight (0,2 do 1), temperature (0,05 do 5) i exaggeration (0,25 do 2).

Jak szybki jest Chatterbox?

Dla Chatterbox jest jeszcze zbyt mało zmierzonych przebiegów w serwisie Railwail, aby podać czas przebiegu. Zależy to od wejścia, ustawień i obciążenia u dostawcy.

Czy Chatterbox jest lepszy niż AudioLDM 2?

To zależy od zadania. Chatterbox (Resemble AI) i AudioLDM 2 (Haohe Liu) to oba modele z kategorii Synteza mowy. Strona porównania pokazuje ich ceny i specyfikacje obok siebie.

Porównaj Chatterbox i AudioLDM 2
10

Porównywalne modele

Wszystkie w tej kategorii

Wszystkie modele przez jedno API

Jeden klucz API dla każdego modelu na Railwail. Opłaty pobierane są z przedpłaconych kredytów, 1 kredyt = 0,01 USD.