ElevenLabs v3 (alpha)

Sprachsyntes (TTS)Inte tillgÀnglig
av ElevenLabsModell-ID: eleven-v3

ElevenLabs' v3 alpha TTS. Most expressive voice model with audio tags and laughter, higher latency.

Status
Inte tillgÀnglig
Inmatning → utmatning
Text → Audio
Utvecklare
ElevenLabs
Uppdaterad
25 juni 2026

ElevenLabs v3 (alpha) Àr för nÀrvarande otillgÀnglig

Inte tillgÀnglig för nÀrvarande: denna modell Àr inaktiverad.

Du kan fortfarande lÀsa detaljerna pÄ denna sida. VÀlj ett av de tillgÀngliga alternativen nedan för att köra en jÀmförbar modell direkt.

GĂ„ till alternativ
01

JÀmförbara modeller

Alla i denna kategori
  • AudioLDM 2AudioLDM

    Latent-diffusion model for general-purpose text-to-audio. Generates speech, music, and sound effects with a unified prior.

    ≈ 0,0157 US$/körning

  • ChatterboxReplicate

    Resemble AI's open Chatterbox TTS. Zero-shot voice cloning from a short audio prompt with an exaggeration control for emotion intensity, plus CFG weight to balance pacing and fidelity.

    0,030 US$/1 000 tecken

  • F5-TTSReplicate

    Open-source flow-matching TTS with strong zero-shot voice cloning. Code MIT, weights CC-BY-NC.

    ≈ 0,0168 US$/körning

02

Playground

Prova ElevenLabs v3 (alpha)

Inmatning & resultat

Inte tillgÀnglig för nÀrvarande

Inte tillgÀnglig för nÀrvarande: denna modell Àr inaktiverad.

Lekplatsen Àr inaktiverad. Du hittar jÀmförbara modeller i samma kategori: Visa alternativ

Prova ElevenLabs v3 (alpha)

0 / 4 000

Resultat
Det genererade talet visas hÀr.

Denna körning

Inget pris – för nĂ€rvarande otillgĂ€ngligt.

Ny hÀr?

5 gratis credits (0,05 US$) nÀr du registrerar dig med Google

AnvÀndbar 24 timmar efter registrering, upp till 5 körningar per dag och högst 2 credits per körning. Andra inloggningsmetoder startar utan credits.

03

Om ElevenLabs v3 (alpha)

Kort sagtFrÄn och med 25 juni 2026

ElevenLabs v3 (alpha) Àr en modell av ElevenLabs i kategorin Sprachsyntes (TTS). ElevenLabs v3 (alpha) Àr för nÀrvarande inte tillgÀnglig pÄ Railwail.

Bakgrund

Om ElevenLabs

Grundat 2022 · London, UK / New York, USA

ElevenLabs was founded in 2022 by Piotr Dabkowski (CTO, ex-Google ML engineer) and Mati Staniszewski (CEO, ex-Palantir), two Polish high-school friends frustrated with the poor quality of TV-show dubbing in Polish. The company set out to build voice AI that captures intonation and emotion across languages. Headquartered in London and New York with engineering hubs in Warsaw and the Bay Area, ElevenLabs raised a $19M Series A in June 2023 led by Andreessen Horowitz, a $80M Series B in January 2024 also led by a16z at a $1.1B valuation, and a $180M Series C in January 2025 at a $3.3B valuation co-led by a16z and ICONIQ. ElevenLabs v3 (alpha) was previewed in 2025 as the next generation flagship model with expressive emotion tags, longer context and more languages, succeeding the Multilingual V2 family that became the de-facto standard for AI dubbing.

Besök ElevenLabs

Arkitektur

Proprietary autoregressive Transformer TTS with neural codec and emotion/prosody conditioning

ElevenLabs v3 (alpha) is the company's 2025 flagship text-to-speech model and the first ElevenLabs system to expose explicit emotion and event tags inside text input ([whispers], [laughs], [angry], [sighs]). It is a proprietary Transformer-based autoregressive model that predicts neural-codec audio tokens conditioned on a text prompt and a speaker embedding obtained from a few seconds of reference audio (Instant Voice Clone) or a fully fine-tuned voice (Professional Voice Clone, requires ~30 minutes of clean audio). v3 expands language coverage from 29 (v2) to 70+ languages, lengthens the input window to roughly 10,000 characters per request, and adds dialogue mode for multi-speaker scenes. ElevenLabs has not published a technical paper; product blog posts describe internal improvements in speaker disentanglement, code-switching and emotional range. v3 is offered through the same hosted API and Studio UI as Multilingual V2 but at higher latency and price.

Parameter
Undisclosed
Kontext
10 000 tokens

Funktioner

  • Expressive emotion and event tags ([laughs], [whispers], [angry], [crying])
  • 70+ languages with high-quality code-switching
  • Multi-speaker dialogue mode for podcast and audiobook generation
  • Instant Voice Clone from ~1 minute of audio and Professional Voice Clone from ~30 minutes
  • Long-form input up to ~10,000 characters per request
  • Studio editor for multi-paragraph projects with per-line speaker control
  • Best for: audiobooks, dubbing, narrative podcasts, character voices for games

TrÀning & licens

Not disclosed. ElevenLabs licences professional voice talent, uses public-domain audiobooks and crowd-sourced opt-in voice contributions; commercial recordings are excluded per their public statements.

Licens: Proprietary commercial SaaS. Commercial use of generated audio is permitted on paid plans; voice clones remain customer property.

SĂ€kerhetstestning: AI Speech Classifier offered for free; mandatory consent statement and KYC for Professional Voice Clones; inaudible watermark on outputs; mis-use bans after 2024 deepfake incidents.

KÀnda begrÀnsningar

  • Higher latency than v2 Turbo or Cartesia Sonic
  • Tag interpretation occasionally inconsistent in alpha
  • Hard refusal for likeness of named public figures without verified consent
  • Closed weights, no on-premise deployment
  • Pricing per character is among the highest in the market
04

Priser

Inte tillgÀnglig för nÀrvarande: denna modell Àr inaktiverad. Det finns ingen pris för denna modell för nÀrvarande, sÄ den kan inte köras.

05

API

Anropa ElevenLabs v3 (alpha) med din Railwail API-nyckel. AnvÀnd detta modell-ID i begÀran:

Inget verifierat API-exempel

Det offentliga API:et skickar ett annat inmatningsformat Àn vad denna modell behöver. AnvÀnd lekplatsen ovan.

06

Specifikationer

Modell-ID
eleven-v3
Utvecklare
ElevenLabs
Inmatning
Text
Utmatning
Audio
Utmatningsformat
MP3, WAV, OPUS
Modellstorlek
Undisclosed
Licens
Proprietary commercial SaaS. Commercial use of generated audio is permitted on paid plans; voice clones remain customer property.
KataloginlÀgg uppdaterat
25 juni 2026

Indataparametrar

Inmatningar och instÀllningar frÄn modellens indataschema. Exemplet i API-avsnittet visar vilka som API:et accepterar.

  • inputobligatorisk

    Text to convert to speech

    Typ: Text
    Standard: –
    TillÄtna vÀrden: upp till 4 000 tecken
  • speed
    Typ: Tal
    Standard: 1
    TillÄtna vÀrden: 0,5 till 2
  • voice
    Typ: Val
    Standard: Rachel
    TillÄtna vÀrden: Rachel, Adam, Antoni, Bella, Domi, Elli, Josh eller Sam
  • response_format
    Typ: Val
    Standard: mp3
    TillÄtna vÀrden: mp3, wav eller opus

Taggar

  • elevenlabs
  • tts
  • expressive
  • alpha
  • per-character
07

AnvÀndningsfall

Vad det anvÀnds till

  • Audiobook narration with emotion
  • Multilingual film and series dubbing
  • Character voices for video games
  • Narrative podcasts and radio drama
  • Accessibility tools and screen readers
08

Vanliga frÄgor

Vad Àr ElevenLabs v3 (alpha)?

ElevenLabs v3 (alpha) Àr en modell av ElevenLabs i kategorin Sprachsyntes (TTS). Den finns i Railwail-katalogen men kan inte köras för nÀrvarande.

Vad kostar ElevenLabs v3 (alpha) pÄ Railwail?

ElevenLabs v3 (alpha) kan inte köras pÄ Railwail för nÀrvarande, sÄ det finns inget aktuellt pris. TillgÀngliga alternativ med priser visas lÀngre ned pÄ denna sida.

Vilka instÀllningar stöder ElevenLabs v3 (alpha)?

Enligt sitt inmatningsschema kÀnner ElevenLabs v3 (alpha) till dessa parametrar: input (upp till 4 000 tecken), speed (0,5 till 2), voice (Rachel, Adam, Antoni, Bella, Domi, Elli, Josh eller Sam) och response_format (mp3, wav eller opus).

Hur snabb Àr ElevenLabs v3 (alpha)?

Det finns Ànnu inte tillrÀckligt mÄnga uppmÀtta körningar av ElevenLabs v3 (alpha) pÄ Railwail för att ange en körningstid. Det beror pÄ inmatningen, instÀllningarna och belastningen hos leverantören.

Är ElevenLabs v3 (alpha) bĂ€ttre Ă€n AudioLDM 2?

Det beror pÄ uppgiften. ElevenLabs v3 (alpha) (ElevenLabs) och AudioLDM 2 (AudioLDM) Àr bÄda modeller i kategorin Sprachsyntes (TTS). JÀmförelsesidan visar deras priser och specifikationer sida vid sida.

JÀmför ElevenLabs v3 (alpha) och AudioLDM 2

Kan jag anvÀnda ElevenLabs v3 (alpha) just nu?

Inte tillgÀnglig för nÀrvarande: denna modell Àr inaktiverad. Sidan förblir online; tillgÀngliga alternativ frÄn samma kategori visas lÀngre ned.

Alla modeller via ett API

En API-nyckel för alla modeller pÄ Railwail. AnvÀndningen debiteras frÄn förbetald kredit, 1 kredit = 0,01 US$.