ElevenLabs v3 (alpha)

Szövegfelolvasás (TTS)Nem elérhető
ElevenLabs általModell-azonosító: eleven-v3

ElevenLabs' v3 alpha TTS. Most expressive voice model with audio tags and laughter, higher latency.

Állapot
Nem elérhető
Bemenet → kimenet
Szöveg → Hang
Fejlesztő
ElevenLabs
Frissítve
2026. június 25.

ElevenLabs v3 (alpha) jelenleg nem elérhető

Jelenleg nem elérhető: ezt a modellt deaktiválták.

Az oldal részleteit továbbra is elolvashatja. Az alábbi elérhető alternatívák közül válasszon egy hasonló modell azonnali futtatásához.

Ugrás az alternatívákhoz
01
  • AudioLDM 2AudioLDM

    Latent-diffusion model for general-purpose text-to-audio. Generates speech, music, and sound effects with a unified prior.

    ≈ 0,0157 USD/futás

  • ChatterboxReplicate

    Resemble AI's open Chatterbox TTS. Zero-shot voice cloning from a short audio prompt with an exaggeration control for emotion intensity, plus CFG weight to balance pacing and fidelity.

    0,030 USD/1.000 kar

  • F5-TTSReplicate

    Open-source flow-matching TTS with strong zero-shot voice cloning. Code MIT, weights CC-BY-NC.

    ≈ 0,0168 USD/futás

02

Playground

Próbáld ki: ElevenLabs v3 (alpha)

Bemenet és kimenet

Jelenleg nem elérhető

Jelenleg nem elérhető: ezt a modellt deaktiválták.

A játszótér letiltva van. Hasonló modelleket találsz ugyanabban a kategóriában: Alternatívák megtekintése

Próbáld ki: ElevenLabs v3 (alpha)

0 / 4000

Eredmény
A generált beszéd itt jelenik meg.

Ez a futtatás

Nincs ár – jelenleg nem elérhető.

Új vagy itt?

5 ingyenes kredit (0,05 USD) Google-fiókkal való regisztrációkor

Használható 24 órával a regisztráció után, naponta legfeljebb 5 futtatás és futtatásonként legfeljebb 2 kredit. Más bejelentkezési módok kreditek nélkül indulnak.

03

A ElevenLabs v3 (alpha) névjegye

Röviden2026. június 25. szerint

A ElevenLabs v3 (alpha) a ElevenLabs által fejlesztett modell a Szövegfelolvasás (TTS) kategóriában. A ElevenLabs v3 (alpha) jelenleg nem érhető el a Railwail-en.

Háttér

A ElevenLabs névjegye

Alapítva: 2022 · London, UK / New York, USA

ElevenLabs was founded in 2022 by Piotr Dabkowski (CTO, ex-Google ML engineer) and Mati Staniszewski (CEO, ex-Palantir), two Polish high-school friends frustrated with the poor quality of TV-show dubbing in Polish. The company set out to build voice AI that captures intonation and emotion across languages. Headquartered in London and New York with engineering hubs in Warsaw and the Bay Area, ElevenLabs raised a $19M Series A in June 2023 led by Andreessen Horowitz, a $80M Series B in January 2024 also led by a16z at a $1.1B valuation, and a $180M Series C in January 2025 at a $3.3B valuation co-led by a16z and ICONIQ. ElevenLabs v3 (alpha) was previewed in 2025 as the next generation flagship model with expressive emotion tags, longer context and more languages, succeeding the Multilingual V2 family that became the de-facto standard for AI dubbing.

ElevenLabs meglátogatása

Architektúra

Proprietary autoregressive Transformer TTS with neural codec and emotion/prosody conditioning

ElevenLabs v3 (alpha) is the company's 2025 flagship text-to-speech model and the first ElevenLabs system to expose explicit emotion and event tags inside text input ([whispers], [laughs], [angry], [sighs]). It is a proprietary Transformer-based autoregressive model that predicts neural-codec audio tokens conditioned on a text prompt and a speaker embedding obtained from a few seconds of reference audio (Instant Voice Clone) or a fully fine-tuned voice (Professional Voice Clone, requires ~30 minutes of clean audio). v3 expands language coverage from 29 (v2) to 70+ languages, lengthens the input window to roughly 10,000 characters per request, and adds dialogue mode for multi-speaker scenes. ElevenLabs has not published a technical paper; product blog posts describe internal improvements in speaker disentanglement, code-switching and emotional range. v3 is offered through the same hosted API and Studio UI as Multilingual V2 but at higher latency and price.

Paraméterek
Undisclosed
Kontextus
10 000 token

Képességek

  • Expressive emotion and event tags ([laughs], [whispers], [angry], [crying])
  • 70+ languages with high-quality code-switching
  • Multi-speaker dialogue mode for podcast and audiobook generation
  • Instant Voice Clone from ~1 minute of audio and Professional Voice Clone from ~30 minutes
  • Long-form input up to ~10,000 characters per request
  • Studio editor for multi-paragraph projects with per-line speaker control
  • Best for: audiobooks, dubbing, narrative podcasts, character voices for games

Képzés és licenc

Not disclosed. ElevenLabs licences professional voice talent, uses public-domain audiobooks and crowd-sourced opt-in voice contributions; commercial recordings are excluded per their public statements.

Licenc: Proprietary commercial SaaS. Commercial use of generated audio is permitted on paid plans; voice clones remain customer property.

Biztonsági tesztelés: AI Speech Classifier offered for free; mandatory consent statement and KYC for Professional Voice Clones; inaudible watermark on outputs; mis-use bans after 2024 deepfake incidents.

Ismert korlátozások

  • Higher latency than v2 Turbo or Cartesia Sonic
  • Tag interpretation occasionally inconsistent in alpha
  • Hard refusal for likeness of named public figures without verified consent
  • Closed weights, no on-premise deployment
  • Pricing per character is among the highest in the market
04

Árak

Jelenleg nem elérhető: ezt a modellt deaktiválták. Jelenleg nincs ár ehhez a modellhez, ezért nem futtatható.

05

API

Hívja meg a ElevenLabs v3 (alpha) modellt a Railwail API-kulcsával. Használja ezt a modell-azonosítót a kérésben:

Nincs ellenőrzött API-példa

A nyilvános API más bemeneti formátumot továbbít, mint amit ez a modell igényel. Használja a fenti Playground-ot.

06

Specifikációk

Modell-azonosító
eleven-v3
Fejlesztő
ElevenLabs
Bemenet
Szöveg
Kimenet
Hang
Kimeneti formátumok
MP3, WAV, OPUS
Modell mérete
Undisclosed
Licenc
Proprietary commercial SaaS. Commercial use of generated audio is permitted on paid plans; voice clones remain customer property.
Katalógus bejegyzés frissítve
2026. június 25.

Bemeneti paraméterek

A modell bemeneti sémájából származó bemenetek és beállítások. Az API szakaszban szereplő példa mutatja, hogy az API melyiket fogadja el.

  • inputkötelező

    Text to convert to speech

    Típus: Szöveg
    Alapértelmezett:
    Engedélyezett értékek: legfeljebb 4000 karakter
  • speed
    Típus: Szám
    Alapértelmezett: 1
    Engedélyezett értékek: 0,5 és 2 között
  • voice
    Típus: Választás
    Alapértelmezett: Rachel
    Engedélyezett értékek: Rachel, Adam, Antoni, Bella, Domi, Elli, Josh vagy Sam
  • response_format
    Típus: Választás
    Alapértelmezett: mp3
    Engedélyezett értékek: mp3, wav vagy opus

Címkék

  • elevenlabs
  • tts
  • expressive
  • alpha
  • per-character
07

Felhasználási esetek

Mire használják

  • Audiobook narration with emotion
  • Multilingual film and series dubbing
  • Character voices for video games
  • Narrative podcasts and radio drama
  • Accessibility tools and screen readers
08

Gyakran ismételt kérdések

Mi az a ElevenLabs v3 (alpha)?

A ElevenLabs v3 (alpha) a ElevenLabs által fejlesztett modell a Szövegfelolvasás (TTS) kategóriában. A Railwail katalógusában szerepel, de jelenleg nem futtatható.

Mennyibe kerül a ElevenLabs v3 (alpha) a Railwail-on?

A ElevenLabs v3 (alpha) jelenleg nem futtatható a Railwail-on, ezért nincs aktuális ár. Az elérhető alternatívák árakkal az oldal alább találhatók.

Milyen beállításokat támogat a ElevenLabs v3 (alpha)?

A bemeneti séma szerint a ElevenLabs v3 (alpha) ezeket a paramétereket ismeri: input (legfeljebb 4000 karakter), speed (0,5 és 2 között), voice (Rachel, Adam, Antoni, Bella, Domi, Elli, Josh vagy Sam) és response_format (mp3, wav vagy opus).

Milyen gyors a ElevenLabs v3 (alpha)?

A ElevenLabs v3 (alpha)-nek még nincs elég mért futtatása a Railwail-on ahhoz, hogy futási időt adjunk meg. Ez a bemenettől, a beállításoktól és a szolgáltató terhelésétől függ.

A ElevenLabs v3 (alpha) jobb, mint a AudioLDM 2?

Ez a feladattól függ. A ElevenLabs v3 (alpha) (ElevenLabs) és a AudioLDM 2 (AudioLDM) egyaránt modellek a Szövegfelolvasás (TTS) kategóriában. Az összehasonlítás oldal az árakat és specifikációkat egymás mellett mutatja.

ElevenLabs v3 (alpha) és AudioLDM 2 összehasonlítása

Használhatom a ElevenLabs v3 (alpha)-t most?

Jelenleg nem elérhető: ezt a modellt deaktiválták. Az oldal online marad; az ugyanabból a kategóriából elérhető alternatívák az oldal alább találhatók.

Összes modell egy API-n keresztül

Egy API-kulcs a Railwail összes modelljéhez. A használat előre feltöltött kreditek alapján kerül felszámításra, 1 kredit = 0,01 USD.