ElevenLabs v3 (alpha)

Sprogudtale (TTS)Ikke tilgængelig
af ElevenLabsModell-ID: eleven-v3

ElevenLabs' v3 alpha TTS. Most expressive voice model with audio tags and laughter, higher latency.

Status
Ikke tilgængelig
Input → output
Tekst → Lyd
Udvikler
ElevenLabs
Opdateret
25. juni 2026

ElevenLabs v3 (alpha) er i øjeblikket utilgængelig

Ikke tilgængelig i øjeblikket: dette model er deaktiveret.

Du kan stadig læse detaljerne på denne side. Vælg en af de tilgængelige alternativer nedenfor for at køre en sammenlignelig model med det samme.

Gå til alternativer
01

Sammenlignelige modeller

Alle i denne kategori
  • AudioLDM 2AudioLDM

    Latent-diffusion model for general-purpose text-to-audio. Generates speech, music, and sound effects with a unified prior.

    ≈ 0,0157 US$/kørsel

  • ChatterboxReplicate

    Resemble AI's open Chatterbox TTS. Zero-shot voice cloning from a short audio prompt with an exaggeration control for emotion intensity, plus CFG weight to balance pacing and fidelity.

    0,030 US$/1.000 tegn

  • F5-TTSReplicate

    Open-source flow-matching TTS with strong zero-shot voice cloning. Code MIT, weights CC-BY-NC.

    ≈ 0,0168 US$/kørsel

02

Playground

Prøv ElevenLabs v3 (alpha)

Input & resultat

Derzeit nicht verfügbar

Ikke tilgængelig i øjeblikket: dette model er deaktiveret.

Playground'en er deaktiveret. Du finder sammenlignelige modeller i samme kategori: Se alternativer

Prøv ElevenLabs v3 (alpha)

0 / 4.000

Resultat
Den genererede tale vises her.

Denne kørsel

Ingen pris – ikke tilgængelig i øjeblikket.

Ny her?

5 gratis credits (0,05 US$) når du tilmelder dig med Google

Kan bruges 24 timer efter tilmelding, op til 5 kørsler pr. dag og højst 2 credits pr. kørsel. Andre login-metoder starter uden credits.

03

Om ElevenLabs v3 (alpha)

Kort sagtFra 25. juni 2026

ElevenLabs v3 (alpha) er en model af ElevenLabs i kategorien Sprogudtale (TTS). ElevenLabs v3 (alpha) er i øjeblikket ikke tilgængelig på Railwail.

Baggrund

Om ElevenLabs

Grundlagt 2022 · London, UK / New York, USA

ElevenLabs was founded in 2022 by Piotr Dabkowski (CTO, ex-Google ML engineer) and Mati Staniszewski (CEO, ex-Palantir), two Polish high-school friends frustrated with the poor quality of TV-show dubbing in Polish. The company set out to build voice AI that captures intonation and emotion across languages. Headquartered in London and New York with engineering hubs in Warsaw and the Bay Area, ElevenLabs raised a $19M Series A in June 2023 led by Andreessen Horowitz, a $80M Series B in January 2024 also led by a16z at a $1.1B valuation, and a $180M Series C in January 2025 at a $3.3B valuation co-led by a16z and ICONIQ. ElevenLabs v3 (alpha) was previewed in 2025 as the next generation flagship model with expressive emotion tags, longer context and more languages, succeeding the Multilingual V2 family that became the de-facto standard for AI dubbing.

Besøg ElevenLabs

Arkitektur

Proprietary autoregressive Transformer TTS with neural codec and emotion/prosody conditioning

ElevenLabs v3 (alpha) is the company's 2025 flagship text-to-speech model and the first ElevenLabs system to expose explicit emotion and event tags inside text input ([whispers], [laughs], [angry], [sighs]). It is a proprietary Transformer-based autoregressive model that predicts neural-codec audio tokens conditioned on a text prompt and a speaker embedding obtained from a few seconds of reference audio (Instant Voice Clone) or a fully fine-tuned voice (Professional Voice Clone, requires ~30 minutes of clean audio). v3 expands language coverage from 29 (v2) to 70+ languages, lengthens the input window to roughly 10,000 characters per request, and adds dialogue mode for multi-speaker scenes. ElevenLabs has not published a technical paper; product blog posts describe internal improvements in speaker disentanglement, code-switching and emotional range. v3 is offered through the same hosted API and Studio UI as Multilingual V2 but at higher latency and price.

Parametre
Undisclosed
Kontekst
10,000 tokens

Funktioner

  • Expressive emotion and event tags ([laughs], [whispers], [angry], [crying])
  • 70+ languages with high-quality code-switching
  • Multi-speaker dialogue mode for podcast and audiobook generation
  • Instant Voice Clone from ~1 minute of audio and Professional Voice Clone from ~30 minutes
  • Long-form input up to ~10,000 characters per request
  • Studio editor for multi-paragraph projects with per-line speaker control
  • Best for: audiobooks, dubbing, narrative podcasts, character voices for games

Træning og licens

Not disclosed. ElevenLabs licences professional voice talent, uses public-domain audiobooks and crowd-sourced opt-in voice contributions; commercial recordings are excluded per their public statements.

Licens: Proprietary commercial SaaS. Commercial use of generated audio is permitted on paid plans; voice clones remain customer property.

Sikkerhedstests: AI Speech Classifier offered for free; mandatory consent statement and KYC for Professional Voice Clones; inaudible watermark on outputs; mis-use bans after 2024 deepfake incidents.

Kendte begrænsninger

  • Higher latency than v2 Turbo or Cartesia Sonic
  • Tag interpretation occasionally inconsistent in alpha
  • Hard refusal for likeness of named public figures without verified consent
  • Closed weights, no on-premise deployment
  • Pricing per character is among the highest in the market
04

Priser

Ikke tilgængelig i øjeblikket: dette model er deaktiveret. Der er i øjeblikket ingen pris for denne model, så den kan ikke køres.

05

API

Kald ElevenLabs v3 (alpha) med din Railwail API-nøgle. Brug dette model-ID i anmodningen:

Intet bekræftet API-eksempel

Den offentlige API sender et andet inputformat end det, som denne model har brug for. Brug playground ovenfor.

06

Specifikationer

Model-ID
eleven-v3
Udvikler
ElevenLabs
Input
Tekst
Output
Lyd
Outputformater
MP3, WAV, OPUS
Modelstørrelse
Undisclosed
Licens
Proprietary commercial SaaS. Commercial use of generated audio is permitted on paid plans; voice clones remain customer property.
Katalogelement opdateret
25. juni 2026

Inputparametre

Inputs og indstillinger fra modellens inputskema. Eksemplet i API-afsnittet viser, hvilke af dem API'en accepterer.

  • inputpåkrævet

    Text to convert to speech

    Type: Tekst
    Standard:
    Tilladte værdier: op til 4,000 tegn
  • speed
    Type: Tal
    Standard: 1
    Tilladte værdier: 0.5 til 2
  • voice
    Type: Valg
    Standard: Rachel
    Tilladte værdier: Rachel, Adam, Antoni, Bella, Domi, Elli, Josh eller Sam
  • response_format
    Type: Valg
    Standard: mp3
    Tilladte værdier: mp3, wav eller opus

Tags

  • elevenlabs
  • tts
  • expressive
  • alpha
  • per-character
07

Anvendelsestilfælde

Hvad det bruges til

  • Audiobook narration with emotion
  • Multilingual film and series dubbing
  • Character voices for video games
  • Narrative podcasts and radio drama
  • Accessibility tools and screen readers
08

Ofte stillede spørgsmål

Hvad er ElevenLabs v3 (alpha)?

ElevenLabs v3 (alpha) er en model fra ElevenLabs i kategorien Sprogudtale (TTS). Den er opført på Railwail, men kan ikke køres i øjeblikket.

Hvad koster ElevenLabs v3 (alpha) på Railwail?

ElevenLabs v3 (alpha) kan ikke køres på Railwail i øjeblikket, så der er ingen aktuel pris. Tilgængelige alternativer med priser er angivet længere nede på denne side.

Hvilke indstillinger understøtter ElevenLabs v3 (alpha)?

Ifølge dens inputskema kender ElevenLabs v3 (alpha) disse parametre: input (op til 4,000 tegn), speed (0.5 til 2), voice (Rachel, Adam, Antoni, Bella, Domi, Elli, Josh eller Sam) og response_format (mp3, wav eller opus).

Hvor hurtig er ElevenLabs v3 (alpha)?

Der er endnu ikke nok målte kørsler af ElevenLabs v3 (alpha) på Railwail til at angive en udførelsestid. Det afhænger af inputtet, indstillingerne og belastningen hos provideren.

Er ElevenLabs v3 (alpha) bedre end AudioLDM 2?

Det afhænger af opgaven. ElevenLabs v3 (alpha) (ElevenLabs) og AudioLDM 2 (AudioLDM) er begge modeller i kategorien Sprogudtale (TTS). Sammenligningssiden viser deres priser og specifikationer side om side.

Sammenlign ElevenLabs v3 (alpha) og AudioLDM 2

Kan jeg bruge ElevenLabs v3 (alpha) lige nu?

Ikke tilgængelig i øjeblikket: dette model er deaktiveret. Siden forbliver online; tilgængelige alternativer fra samme kategori er angivet længere nede.

Alle modeller via én API

En API-nøgle til alle modeller på Railwail. Forbrug debiteres fra forudbetalte credits, 1 credit = 0,01 US$.