ElevenLabs v3 (alpha)

Tekst-til-taleIkke tilgjengelig
av ElevenLabsModell-ID: eleven-v3

ElevenLabs' v3 alpha TTS. Most expressive voice model with audio tags and laughter, higher latency.

Status
Ikke tilgjengelig
Input → output
Tekst → Lyd
Utvikler
ElevenLabs
Oppdatert
25. juni 2026

ElevenLabs v3 (alpha) er for øyeblikket utilgjengelig

Ikke tilgjengelig for øyeblikket: dette modellen er deaktivert.

Du kan fortsatt lese detaljene på denne siden. Velg ett av de tilgjengelige alternativene nedenfor for å kjøre en sammenlignbar modell med en gang.

Gå til alternativer
01

Sammenlignbare modeller

Alle i denne kategorien
  • AudioLDM 2AudioLDM

    Latent-diffusion model for general-purpose text-to-audio. Generates speech, music, and sound effects with a unified prior.

    ≈ 0,0157 USD/kjøring

  • ChatterboxReplicate

    Resemble AI's open Chatterbox TTS. Zero-shot voice cloning from a short audio prompt with an exaggeration control for emotion intensity, plus CFG weight to balance pacing and fidelity.

    0,030 USD/1.000 tegn

  • F5-TTSReplicate

    Open-source flow-matching TTS with strong zero-shot voice cloning. Code MIT, weights CC-BY-NC.

    ≈ 0,0168 USD/kjøring

02

Playground

Prøv ElevenLabs v3 (alpha)

Inndata og resultat

Ikke tilgjengelig for øyeblikket

Ikke tilgjengelig for øyeblikket: dette modellen er deaktivert.

Lekeplassen er deaktivert. Du finner sammenlignbare modeller i samme kategori: Se alternativer

Prøv ElevenLabs v3 (alpha)

0 / 4 000

Resultat
Den genererte talen vises her.

Denne kjøringen

Ingen pris – ikke tilgjengelig for øyeblikket.

Ny her?

5 gratis credits (0,05 USD) når du registrerer deg med Google

Kan brukes 24 timer etter registrering, opptil 5 kjøringer per dag og maksimalt 2 credits per kjøring. Andre påloggingsmetoder starter uten credits.

03

Om ElevenLabs v3 (alpha)

Kort sagtPer 25. juni 2026

ElevenLabs v3 (alpha) er en modell fra ElevenLabs i kategorien Tekst-til-tale. ElevenLabs v3 (alpha) er for øyeblikket ikke tilgjengelig på Railwail.

Bakgrunn

Om ElevenLabs

Grunnlagt 2022 · London, UK / New York, USA

ElevenLabs was founded in 2022 by Piotr Dabkowski (CTO, ex-Google ML engineer) and Mati Staniszewski (CEO, ex-Palantir), two Polish high-school friends frustrated with the poor quality of TV-show dubbing in Polish. The company set out to build voice AI that captures intonation and emotion across languages. Headquartered in London and New York with engineering hubs in Warsaw and the Bay Area, ElevenLabs raised a $19M Series A in June 2023 led by Andreessen Horowitz, a $80M Series B in January 2024 also led by a16z at a $1.1B valuation, and a $180M Series C in January 2025 at a $3.3B valuation co-led by a16z and ICONIQ. ElevenLabs v3 (alpha) was previewed in 2025 as the next generation flagship model with expressive emotion tags, longer context and more languages, succeeding the Multilingual V2 family that became the de-facto standard for AI dubbing.

Besøk ElevenLabs

Arkitektur

Proprietary autoregressive Transformer TTS with neural codec and emotion/prosody conditioning

ElevenLabs v3 (alpha) is the company's 2025 flagship text-to-speech model and the first ElevenLabs system to expose explicit emotion and event tags inside text input ([whispers], [laughs], [angry], [sighs]). It is a proprietary Transformer-based autoregressive model that predicts neural-codec audio tokens conditioned on a text prompt and a speaker embedding obtained from a few seconds of reference audio (Instant Voice Clone) or a fully fine-tuned voice (Professional Voice Clone, requires ~30 minutes of clean audio). v3 expands language coverage from 29 (v2) to 70+ languages, lengthens the input window to roughly 10,000 characters per request, and adds dialogue mode for multi-speaker scenes. ElevenLabs has not published a technical paper; product blog posts describe internal improvements in speaker disentanglement, code-switching and emotional range. v3 is offered through the same hosted API and Studio UI as Multilingual V2 but at higher latency and price.

Parametere
Undisclosed
Kontekst
10 000 tokens

Evner

  • Expressive emotion and event tags ([laughs], [whispers], [angry], [crying])
  • 70+ languages with high-quality code-switching
  • Multi-speaker dialogue mode for podcast and audiobook generation
  • Instant Voice Clone from ~1 minute of audio and Professional Voice Clone from ~30 minutes
  • Long-form input up to ~10,000 characters per request
  • Studio editor for multi-paragraph projects with per-line speaker control
  • Best for: audiobooks, dubbing, narrative podcasts, character voices for games

Trening og lisens

Not disclosed. ElevenLabs licences professional voice talent, uses public-domain audiobooks and crowd-sourced opt-in voice contributions; commercial recordings are excluded per their public statements.

Lisens: Proprietary commercial SaaS. Commercial use of generated audio is permitted on paid plans; voice clones remain customer property.

Sikkerhetstesting: AI Speech Classifier offered for free; mandatory consent statement and KYC for Professional Voice Clones; inaudible watermark on outputs; mis-use bans after 2024 deepfake incidents.

Kjente begrensninger

  • Higher latency than v2 Turbo or Cartesia Sonic
  • Tag interpretation occasionally inconsistent in alpha
  • Hard refusal for likeness of named public figures without verified consent
  • Closed weights, no on-premise deployment
  • Pricing per character is among the highest in the market
04

Priser

Ikke tilgjengelig for øyeblikket: dette modellen er deaktivert. Det er ingen pris for denne modellen for øyeblikket, så den kan ikke kjøres.

05

API

Ring ElevenLabs v3 (alpha) med din Railwail API-nøkkel. Bruk denne modell-IDen i forespørselen:

Ingen verifisert API-eksempel

Det offentlige API-et sender et annet inngangsformat enn det denne modellen trenger. Bruk lekeplassen ovenfor.

06

Spesifikasjoner

Modell-ID
eleven-v3
Utvikler
ElevenLabs
Inndata
Tekst
Utdata
Lyd
Utdataformater
MP3, WAV, OPUS
Modellstørrelse
Undisclosed
Lisens
Proprietary commercial SaaS. Commercial use of generated audio is permitted on paid plans; voice clones remain customer property.
Katalogoppføring oppdatert
25. juni 2026

Inndataparametere

Inndataer og innstillinger fra modellens inndataskjema. Eksemplet i API-delen viser hvilke av dem APIen godtar.

  • inputobligatorisk

    Text to convert to speech

    Type: Tekst
    Standard:
    Tillatte verdier: opptil 4 000 tegn
  • speed
    Type: Tall
    Standard: 1
    Tillatte verdier: 0,5 til 2
  • voice
    Type: Valg
    Standard: Rachel
    Tillatte verdier: Rachel, Adam, Antoni, Bella, Domi, Elli, Josh eller Sam
  • response_format
    Type: Valg
    Standard: mp3
    Tillatte verdier: mp3, wav eller opus

Merkelapper

  • elevenlabs
  • tts
  • expressive
  • alpha
  • per-character
07

Brukstilfeller

Hva det brukes til

  • Audiobook narration with emotion
  • Multilingual film and series dubbing
  • Character voices for video games
  • Narrative podcasts and radio drama
  • Accessibility tools and screen readers
08

Ofte stilte spørsmål

Hva er ElevenLabs v3 (alpha)?

ElevenLabs v3 (alpha) er en modell fra ElevenLabs i kategorien Tekst-til-tale. Den er oppført på Railwail, men kan ikke kjøres for øyeblikket.

Hvor mye koster ElevenLabs v3 (alpha) på Railwail?

ElevenLabs v3 (alpha) kan ikke kjøres på Railwail for øyeblikket, så det finnes ingen gjeldende pris. Tilgjengelige alternativer med priser er oppført lenger ned på denne siden.

Hvilke innstillinger støtter ElevenLabs v3 (alpha)?

I henhold til inndataskjemaet kjenner ElevenLabs v3 (alpha) disse parametrene: input (opptil 4 000 tegn), speed (0,5 til 2), voice (Rachel, Adam, Antoni, Bella, Domi, Elli, Josh eller Sam) og response_format (mp3, wav eller opus).

Hvor rask er ElevenLabs v3 (alpha)?

Det finnes ennå ikke nok målte kjøringer av ElevenLabs v3 (alpha) på Railwail til å angi en kjøretid. Det avhenger av inndataene, innstillingene og belastningen hos leverandøren.

Er ElevenLabs v3 (alpha) bedre enn AudioLDM 2?

Det avhenger av oppgaven. ElevenLabs v3 (alpha) (ElevenLabs) og AudioLDM 2 (AudioLDM) er begge modeller i kategorien Tekst-til-tale. Sammenligningssiden viser prisene og spesifikasjonene deres side ved side.

Sammenlign ElevenLabs v3 (alpha) og AudioLDM 2

Kan jeg bruke ElevenLabs v3 (alpha) akkurat nå?

Ikke tilgjengelig for øyeblikket: dette modellen er deaktivert. Siden forblir online; tilgjengelige alternativer fra samme kategori er oppført lenger ned.

Alle modeller gjennom én API

Én API-nøkkel for alle modeller på Railwail. Bruk belastes fra forhåndsbetalt kreditt, 1 kreditt = 0,01 USD.