Chatterbox

Sprachausgabe (TTS)Verfügbar
von Resemble AIModell-ID: chatterbox

Resemble AI's open Chatterbox TTS. Zero-shot voice cloning from a short audio prompt with an exaggeration control for emotion intensity, plus CFG weight to balance pacing and fidelity.

Preis
$ 0.030/1.000 Zeichen
Eingabe → Ausgabe
Text → Audio
Entwickler
Resemble AI
Aktualisiert
23. September 2026
01

Stimme klonen

Nimm eine kurze Probe auf oder lade sie hoch, tipp einen Text und hör ihn in dieser Stimme. Chatterbox läuft in deinem Konto wie jeder andere Lauf, den Preis siehst du vorher.
  1. 1

    Deine Stimme

    Stimmprobe *Aufnahme bis 30 s · Datei bis 60 s, 10 MB

    10 bis 30 Sekunden deutlich gesprochen, eine Person, ohne Musik oder Hintergrundlärm.

  2. 2

    Text

    Beispieltext, ändere ihn nach Belieben.103 / 4'000
  3. 3

    Anhören

    $ 0.0031 pro Lauf

02

Playground

Chatterbox ausprobieren

Eingabe & Ergebnis

$ 0.030/1.000 Zeichen
Chatterbox ausprobieren

0 / 4'000

StimmprobeAufnahme bis 30 s · Datei bis 60 s, 10 MB

10 bis 30 Sekunden deutlich gesprochen, eine Person, ohne Musik oder Hintergrundlärm.

Erweiterte Einstellungen (4)
Ergebnis
Die erzeugte Sprache erscheint hier.

Dieser Lauf

$ 0.0001 · 0.01 Credits

Neu hier?

10 Gratis-Credits ($ 0.10) bei Anmeldung mit Google

Nutzbar 24 Stunden nach der Anmeldung, bis zu 5 Läufe pro Tag und höchstens 2 Credits je Lauf. Andere Anmeldearten starten ohne Guthaben. Reicht für 1'000 Läufe dieses Modells.

03

Beispiele

Echte Ergebnisse aus den öffentlichen Beispielen dieses Modells auf Replicate, mit dem Prompt und den Einstellungen, die sie erzeugt haben. Sie wurden nicht live auf dieser Seite erzeugt.
  • Prompt

    We're excited to introduce Chatterbox, our first production-grade open source TTS model. Licensed under MIT, Chatterbox has been benchmarked against leading closed-source systems like ElevenLabs, and is consistently preferred in side-by-side evaluations. Whether you're working on memes, videos, games, or AI agents, Chatterbox brings your content to life. It's also the first open source TTS model to support emotion exaggeration control, a powerful feature that makes your voices stand out. Try it now on our Hugging Face Gradio app. If you like the model but need to scale or finetune it for higher accuracy, check out our competitively priced TTS service (link). It delivers reliable performance with ultra-low latency of sub 200ms—ideal for production use in agents, applications, or interactive media.
  • Prompt

    Now let's make my mum's favourite. So three mars bars into the pan. Then we add the tuna and just stir for a bit, just let the chocolate and fish infuse. A sprinkle of olive oil and some tomato ketchup. Now smell that. Oh boy this is going to be incredible.
04

Über Chatterbox

Kurz gesagtStand: 23. September 2026

Chatterbox ist ein Modell von Resemble AI aus der Kategorie Sprachausgabe (TTS). Über Railwail kostet Chatterbox $ 0.030 pro 1.000 Zeichen.

Chatterbox is Resemble AI's production-grade open TTS. It clones a voice from a brief audio_prompt and offers an exaggeration slider that scales emotional intensity, which is unusual for open models. cfg_weight and temperature tune delivery. Hosted by resemble-ai on Replicate.
05

Preise

Preise in US-Dollar. Abgerechnet wird über vorab gekaufte Credits.
1.000 Zeichen$ 0.030 pro 1.000 Zeichen
  • 1 Credit = $ 0.01

Kostenrechner

Preisrechner

/ Lauf

Gesamt

$ 3.00

300 Credits

Je Lauf

$ 0.03 · 3 Credits

Fester Preis je Lauf, schon vor dem Start bekannt.

06

API

Rufe Chatterbox mit deinem Railwail-API-Schlüssel auf. Diese Modell-ID gehört in die Anfrage:

Kein geprüftes API-Beispiel

Die öffentliche API übergibt ein anderes Eingabeformat, als dieses Modell braucht. Nutze den Playground oben.

07

Spezifikationen

Modell-ID
chatterbox
Entwickler
Resemble AI
Eingabe
Text
Ausgabe
Audio
Abrechnung
Festpreis, steht vor dem Lauf fest
Katalogeintrag aktualisiert
23. September 2026

Eingabeparameter

Eingaben und Einstellungen laut Eingabeschema des Modells. Welche davon die API annimmt, zeigt das Beispiel im Abschnitt API.

  • promptPflicht

    Text to speak

    Typ: Text
    Standard: –
    Erlaubte Werte: bis 4'000 Zeichen
  • seed

    0 = random

    Typ: Ganzzahl
    Standard: 0
    Erlaubte Werte: –
  • audio

    Optional reference clip (5-60 s) to clone the voice from; requires consent

    Typ: –
    Standard: –
    Erlaubte Werte: –
  • cfg_weight
    Typ: Zahl
    Standard: 0.5
    Erlaubte Werte: 0.2 bis 1
  • temperature
    Typ: Zahl
    Standard: 0.8
    Erlaubte Werte: 0.05 bis 5
  • exaggeration
    Typ: Zahl
    Standard: 0.5
    Erlaubte Werte: 0.25 bis 2

Schlagwörter

  • replicate
  • resemble-ai
  • tts
  • voice-cloning
  • expressive
08

Einsatzgebiete

09

Häufige Fragen

Was ist Chatterbox?

Chatterbox ist ein Modell von Resemble AI aus der Kategorie Sprachausgabe (TTS).

Was kostet Chatterbox bei Railwail?

Über Railwail kostet Chatterbox $ 0.030 pro 1.000 Zeichen. Der Preis steht vor dem Start des Laufs fest. Bezahlt wird mit vorab gekauften Credits; 1 Credit entspricht $ 0.01.

Welche Einstellungen unterstützt Chatterbox?

Laut Eingabeschema kennt Chatterbox diese Parameter: prompt (bis 4'000 Zeichen), seed, audio, cfg_weight (0.2 bis 1), temperature (0.05 bis 5) und exaggeration (0.25 bis 2).

Wie schnell ist Chatterbox?

Für Chatterbox gibt es bei Railwail noch zu wenige gemessene Läufe, um eine Laufzeit anzugeben. Sie hängt von der Eingabe, den Einstellungen und der Auslastung beim Anbieter ab.

Ist Chatterbox besser als AudioLDM 2?

Das hängt von der Aufgabe ab. Chatterbox (Resemble AI) und AudioLDM 2 (Haohe Liu) sind beide Modelle aus der Kategorie Sprachausgabe (TTS). Die Vergleichsseite zeigt Preise und Spezifikationen nebeneinander.

Chatterbox und AudioLDM 2 vergleichen
10

Vergleichbare Modelle

Alle dieser Kategorie

Alle Modelle über eine API

Ein API-Schlüssel für alle Modelle auf Railwail. Abgerechnet wird über vorab gekaufte Credits, 1 Credit = $ 0.01.