ElevenLabs v3 (alpha)

Sprachausgabe (TTS)Nicht verfügbar
von ElevenLabsModell-ID: eleven-v3

ElevenLabs' v3 alpha TTS. Most expressive voice model with audio tags and laughter, higher latency.

Status
Nicht verfügbar
Eingabe → Ausgabe
Text → Audio
Entwickler
ElevenLabs
Aktualisiert
25. Juni 2026

ElevenLabs v3 (alpha) ist derzeit nicht verfügbar

Derzeit nicht verfügbar: Dieses Modell ist deaktiviert.

Die Angaben auf dieser Seite kannst du weiter nachlesen. Mit einer der verfügbaren Alternativen unten kannst du sofort ein vergleichbares Modell nutzen.

Zu den Alternativen
01

Vergleichbare Modelle

Alle dieser Kategorie
  • AudioLDM 2AudioLDM

    Latent-diffusion model for general-purpose text-to-audio. Generates speech, music, and sound effects with a unified prior.

    ca. 0,0157 $/Lauf

  • ChatterboxReplicate

    Resemble AI's open Chatterbox TTS. Zero-shot voice cloning from a short audio prompt with an exaggeration control for emotion intensity, plus CFG weight to balance pacing and fidelity.

    0,030 $/1.000 Zeichen

  • F5-TTSReplicate

    Open-source flow-matching TTS with strong zero-shot voice cloning. Code MIT, weights CC-BY-NC.

    ca. 0,0168 $/Lauf

02

Playground

ElevenLabs v3 (alpha) ausprobieren

Eingabe & Ergebnis

Derzeit nicht verfügbar

Derzeit nicht verfügbar: Dieses Modell ist deaktiviert.

Der Playground ist deaktiviert. Vergleichbare Modelle findest du in derselben Kategorie: Alternativen ansehen

ElevenLabs v3 (alpha) ausprobieren

0 / 4.000

Ergebnis
Die erzeugte Sprache erscheint hier.

Dieser Lauf

Kein Preis – derzeit nicht verfügbar.

Neu hier?

5 Gratis-Credits (0,05 $) bei Anmeldung mit Google

Nutzbar 24 Stunden nach der Anmeldung, bis zu 5 Läufe pro Tag und höchstens 2 Credits je Lauf. Andere Anmeldearten starten ohne Guthaben.

03

Über ElevenLabs v3 (alpha)

Kurz gesagtStand: 25. Juni 2026

ElevenLabs v3 (alpha) ist ein Modell von ElevenLabs aus der Kategorie Sprachausgabe (TTS). Über Railwail ist ElevenLabs v3 (alpha) derzeit nicht verfügbar.

Hintergrund

Über ElevenLabs

Gegründet 2022 · London, UK / New York, USA

ElevenLabs was founded in 2022 by Piotr Dabkowski (CTO, ex-Google ML engineer) and Mati Staniszewski (CEO, ex-Palantir), two Polish high-school friends frustrated with the poor quality of TV-show dubbing in Polish. The company set out to build voice AI that captures intonation and emotion across languages. Headquartered in London and New York with engineering hubs in Warsaw and the Bay Area, ElevenLabs raised a $19M Series A in June 2023 led by Andreessen Horowitz, a $80M Series B in January 2024 also led by a16z at a $1.1B valuation, and a $180M Series C in January 2025 at a $3.3B valuation co-led by a16z and ICONIQ. ElevenLabs v3 (alpha) was previewed in 2025 as the next generation flagship model with expressive emotion tags, longer context and more languages, succeeding the Multilingual V2 family that became the de-facto standard for AI dubbing.

ElevenLabs besuchen

Architektur

Proprietary autoregressive Transformer TTS with neural codec and emotion/prosody conditioning

ElevenLabs v3 (alpha) is the company's 2025 flagship text-to-speech model and the first ElevenLabs system to expose explicit emotion and event tags inside text input ([whispers], [laughs], [angry], [sighs]). It is a proprietary Transformer-based autoregressive model that predicts neural-codec audio tokens conditioned on a text prompt and a speaker embedding obtained from a few seconds of reference audio (Instant Voice Clone) or a fully fine-tuned voice (Professional Voice Clone, requires ~30 minutes of clean audio). v3 expands language coverage from 29 (v2) to 70+ languages, lengthens the input window to roughly 10,000 characters per request, and adds dialogue mode for multi-speaker scenes. ElevenLabs has not published a technical paper; product blog posts describe internal improvements in speaker disentanglement, code-switching and emotional range. v3 is offered through the same hosted API and Studio UI as Multilingual V2 but at higher latency and price.

Parameter
Undisclosed
Kontext
10.000 Token

Fähigkeiten

  • Expressive emotion and event tags ([laughs], [whispers], [angry], [crying])
  • 70+ languages with high-quality code-switching
  • Multi-speaker dialogue mode for podcast and audiobook generation
  • Instant Voice Clone from ~1 minute of audio and Professional Voice Clone from ~30 minutes
  • Long-form input up to ~10,000 characters per request
  • Studio editor for multi-paragraph projects with per-line speaker control
  • Best for: audiobooks, dubbing, narrative podcasts, character voices for games

Training & Lizenz

Not disclosed. ElevenLabs licences professional voice talent, uses public-domain audiobooks and crowd-sourced opt-in voice contributions; commercial recordings are excluded per their public statements.

Lizenz: Proprietary commercial SaaS. Commercial use of generated audio is permitted on paid plans; voice clones remain customer property.

Sicherheitstests: AI Speech Classifier offered for free; mandatory consent statement and KYC for Professional Voice Clones; inaudible watermark on outputs; mis-use bans after 2024 deepfake incidents.

Bekannte Grenzen

  • Higher latency than v2 Turbo or Cartesia Sonic
  • Tag interpretation occasionally inconsistent in alpha
  • Hard refusal for likeness of named public figures without verified consent
  • Closed weights, no on-premise deployment
  • Pricing per character is among the highest in the market
04

Preise

Derzeit nicht verfügbar: Dieses Modell ist deaktiviert. Für dieses Modell gibt es derzeit keinen Preis, deshalb lässt es sich nicht ausführen.

05

API

Rufe ElevenLabs v3 (alpha) mit deinem Railwail-API-Schlüssel auf. Diese Modell-ID gehört in die Anfrage:

Kein geprüftes API-Beispiel

Die öffentliche API übergibt ein anderes Eingabeformat, als dieses Modell braucht. Nutze den Playground oben.

06

Spezifikationen

Modell-ID
eleven-v3
Entwickler
ElevenLabs
Eingabe
Text
Ausgabe
Audio
Ausgabeformate
MP3, WAV, OPUS
Modellgröße
Undisclosed
Lizenz
Proprietary commercial SaaS. Commercial use of generated audio is permitted on paid plans; voice clones remain customer property.
Katalogeintrag aktualisiert
25. Juni 2026

Eingabeparameter

Eingaben und Einstellungen laut Eingabeschema des Modells. Welche davon die API annimmt, zeigt das Beispiel im Abschnitt API.

  • inputPflicht

    Text to convert to speech

    Typ: Text
    Standard:
    Erlaubte Werte: bis 4.000 Zeichen
  • speed
    Typ: Zahl
    Standard: 1
    Erlaubte Werte: 0,5 bis 2
  • voice
    Typ: Auswahl
    Standard: Rachel
    Erlaubte Werte: Rachel, Adam, Antoni, Bella, Domi, Elli, Josh oder Sam
  • response_format
    Typ: Auswahl
    Standard: mp3
    Erlaubte Werte: mp3, wav oder opus

Schlagwörter

  • elevenlabs
  • tts
  • expressive
  • alpha
  • per-character
07

Einsatzgebiete

Wofür es genutzt wird

  • Audiobook narration with emotion
  • Multilingual film and series dubbing
  • Character voices for video games
  • Narrative podcasts and radio drama
  • Accessibility tools and screen readers
08

Häufige Fragen

Was ist ElevenLabs v3 (alpha)?

ElevenLabs v3 (alpha) ist ein Modell von ElevenLabs aus der Kategorie Sprachausgabe (TTS). Es steht im Railwail-Katalog, lässt sich derzeit aber nicht ausführen.

Was kostet ElevenLabs v3 (alpha) bei Railwail?

ElevenLabs v3 (alpha) lässt sich über Railwail derzeit nicht ausführen, deshalb gibt es keinen aktuellen Preis. Verfügbare Alternativen mit Preisen stehen weiter unten auf dieser Seite.

Welche Einstellungen unterstützt ElevenLabs v3 (alpha)?

Laut Eingabeschema kennt ElevenLabs v3 (alpha) diese Parameter: input (bis 4.000 Zeichen), speed (0,5 bis 2), voice (Rachel, Adam, Antoni, Bella, Domi, Elli, Josh oder Sam) und response_format (mp3, wav oder opus).

Wie schnell ist ElevenLabs v3 (alpha)?

Für ElevenLabs v3 (alpha) gibt es bei Railwail noch zu wenige gemessene Läufe, um eine Laufzeit anzugeben. Sie hängt von der Eingabe, den Einstellungen und der Auslastung beim Anbieter ab.

Ist ElevenLabs v3 (alpha) besser als AudioLDM 2?

Das hängt von der Aufgabe ab. ElevenLabs v3 (alpha) (ElevenLabs) und AudioLDM 2 (AudioLDM) sind beide Modelle aus der Kategorie Sprachausgabe (TTS). Die Vergleichsseite zeigt Preise und Spezifikationen nebeneinander.

ElevenLabs v3 (alpha) und AudioLDM 2 vergleichen

Kann ich ElevenLabs v3 (alpha) gerade nutzen?

Derzeit nicht verfügbar: Dieses Modell ist deaktiviert. Die Seite bleibt online; verfügbare Alternativen aus derselben Kategorie stehen weiter unten.

Alle Modelle über eine API

Ein API-Schlüssel für alle Modelle auf Railwail. Abgerechnet wird über vorab gekaufte Credits, 1 Credit = 0,01 $.