ElevenLabs v3 (alpha)

Conversão de texto em falaIndisponível
por ElevenLabsID do modelo: eleven-v3

ElevenLabs' v3 alpha TTS. Most expressive voice model with audio tags and laughter, higher latency.

Status
Indisponível
Entrada → Saída
Texto → Áudio
Desenvolvedor
ElevenLabs
Atualizado
25 de junho de 2026

ElevenLabs v3 (alpha) não está disponível no momento

Atualmente indisponível: este modelo foi desativado.

Você ainda pode ler os detalhes nesta página. Escolha uma das alternativas disponíveis abaixo para executar um modelo comparável imediatamente.

Ir para alternativas
01

Modelos comparáveis

Todos nesta categoria
  • AudioLDM 2AudioLDM

    Latent-diffusion model for general-purpose text-to-audio. Generates speech, music, and sound effects with a unified prior.

    ≈ US$ 0,0157/execução

  • ChatterboxReplicate

    Resemble AI's open Chatterbox TTS. Zero-shot voice cloning from a short audio prompt with an exaggeration control for emotion intensity, plus CFG weight to balance pacing and fidelity.

    US$ 0,030/1.000 caracteres

  • F5-TTSReplicate

    Open-source flow-matching TTS with strong zero-shot voice cloning. Code MIT, weights CC-BY-NC.

    ≈ US$ 0,0168/execução

02

Playground

Experimentar ElevenLabs v3 (alpha)

Entrada & saída

Indisponível no momento

Atualmente indisponível: este modelo foi desativado.

O playground está desativado. Encontre modelos comparáveis na mesma categoria: Ver alternativas

Experimentar ElevenLabs v3 (alpha)

0 / 4.000

Resultado
A fala gerada aparece aqui.

Esta execução

Sem preço – indisponível no momento.

Novo por aqui?

5 créditos grátis (US$ 0,05) ao se inscrever com Google

Utilizável 24 horas após inscrição, até 5 execuções por dia e no máximo 2 créditos por execução. Outros métodos de login começam sem créditos.

03

Sobre ElevenLabs v3 (alpha)

ResumoA partir de 25 de junho de 2026

ElevenLabs v3 (alpha) é um modelo de ElevenLabs na categoria Conversão de texto em fala. ElevenLabs v3 (alpha) não está disponível no Railwail no momento.

Fundo

Sobre ElevenLabs

Fundado em 2022 · London, UK / New York, USA

ElevenLabs was founded in 2022 by Piotr Dabkowski (CTO, ex-Google ML engineer) and Mati Staniszewski (CEO, ex-Palantir), two Polish high-school friends frustrated with the poor quality of TV-show dubbing in Polish. The company set out to build voice AI that captures intonation and emotion across languages. Headquartered in London and New York with engineering hubs in Warsaw and the Bay Area, ElevenLabs raised a $19M Series A in June 2023 led by Andreessen Horowitz, a $80M Series B in January 2024 also led by a16z at a $1.1B valuation, and a $180M Series C in January 2025 at a $3.3B valuation co-led by a16z and ICONIQ. ElevenLabs v3 (alpha) was previewed in 2025 as the next generation flagship model with expressive emotion tags, longer context and more languages, succeeding the Multilingual V2 family that became the de-facto standard for AI dubbing.

Visite ElevenLabs

Arquitetura

Proprietary autoregressive Transformer TTS with neural codec and emotion/prosody conditioning

ElevenLabs v3 (alpha) is the company's 2025 flagship text-to-speech model and the first ElevenLabs system to expose explicit emotion and event tags inside text input ([whispers], [laughs], [angry], [sighs]). It is a proprietary Transformer-based autoregressive model that predicts neural-codec audio tokens conditioned on a text prompt and a speaker embedding obtained from a few seconds of reference audio (Instant Voice Clone) or a fully fine-tuned voice (Professional Voice Clone, requires ~30 minutes of clean audio). v3 expands language coverage from 29 (v2) to 70+ languages, lengthens the input window to roughly 10,000 characters per request, and adds dialogue mode for multi-speaker scenes. ElevenLabs has not published a technical paper; product blog posts describe internal improvements in speaker disentanglement, code-switching and emotional range. v3 is offered through the same hosted API and Studio UI as Multilingual V2 but at higher latency and price.

Parâmetros
Undisclosed
Contexto
10.000 tokens

Capacidades

  • Expressive emotion and event tags ([laughs], [whispers], [angry], [crying])
  • 70+ languages with high-quality code-switching
  • Multi-speaker dialogue mode for podcast and audiobook generation
  • Instant Voice Clone from ~1 minute of audio and Professional Voice Clone from ~30 minutes
  • Long-form input up to ~10,000 characters per request
  • Studio editor for multi-paragraph projects with per-line speaker control
  • Best for: audiobooks, dubbing, narrative podcasts, character voices for games

Treinamento & licença

Not disclosed. ElevenLabs licences professional voice talent, uses public-domain audiobooks and crowd-sourced opt-in voice contributions; commercial recordings are excluded per their public statements.

Licença: Proprietary commercial SaaS. Commercial use of generated audio is permitted on paid plans; voice clones remain customer property.

Testes de segurança: AI Speech Classifier offered for free; mandatory consent statement and KYC for Professional Voice Clones; inaudible watermark on outputs; mis-use bans after 2024 deepfake incidents.

Limitações conhecidas

  • Higher latency than v2 Turbo or Cartesia Sonic
  • Tag interpretation occasionally inconsistent in alpha
  • Hard refusal for likeness of named public figures without verified consent
  • Closed weights, no on-premise deployment
  • Pricing per character is among the highest in the market
04

Preços

Atualmente indisponível: este modelo foi desativado. Não há preço para este modelo no momento, portanto não pode ser executado.

05

API

Chame ElevenLabs v3 (alpha) com sua chave de API Railwail. Use este ID de modelo na solicitação:

Nenhum exemplo de API verificado

A API pública passa um formato de entrada diferente do que este modelo precisa. Use o playground acima.

06

Especificações

ID do modelo
eleven-v3
Desenvolvedor
ElevenLabs
Entrada
Texto
Saída
Áudio
Formatos de saída
MP3, WAV, OPUS
Tamanho do modelo
Undisclosed
Licença
Proprietary commercial SaaS. Commercial use of generated audio is permitted on paid plans; voice clones remain customer property.
Entrada do catálogo atualizada
25 de junho de 2026

Parâmetros de entrada

Entradas e configurações do esquema de entrada do modelo. O exemplo na seção API mostra quais delas a API aceita.

  • inputobrigatório

    Text to convert to speech

    Tipo: Texto
    Padrão:
    Valores permitidos: até 4.000 caracteres
  • speed
    Tipo: Número
    Padrão: 1
    Valores permitidos: 0,5 a 2
  • voice
    Tipo: Escolha
    Padrão: Rachel
    Valores permitidos: Rachel, Adam, Antoni, Bella, Domi, Elli, Josh ou Sam
  • response_format
    Tipo: Escolha
    Padrão: mp3
    Valores permitidos: mp3, wav ou opus

Etiquetas

  • elevenlabs
  • tts
  • expressive
  • alpha
  • per-character
07

Casos de uso

Para que é utilizado

  • Audiobook narration with emotion
  • Multilingual film and series dubbing
  • Character voices for video games
  • Narrative podcasts and radio drama
  • Accessibility tools and screen readers
08

Perguntas frequentes

O que é ElevenLabs v3 (alpha)?

ElevenLabs v3 (alpha) é um modelo de ElevenLabs na categoria Conversão de texto em fala. Está listado no Railwail, mas não pode ser executado no momento.

Quanto custa ElevenLabs v3 (alpha) no Railwail?

ElevenLabs v3 (alpha) não pode ser executado no Railwail no momento, portanto não há preço atual. Alternativas disponíveis com preços estão listadas mais abaixo nesta página.

Quais configurações ElevenLabs v3 (alpha) suporta?

De acordo com seu esquema de entrada, ElevenLabs v3 (alpha) conhece estes parâmetros: input (até 4.000 caracteres), speed (0,5 a 2), voice (Rachel, Adam, Antoni, Bella, Domi, Elli, Josh ou Sam) e response_format (mp3, wav ou opus).

Qual é a velocidade de ElevenLabs v3 (alpha)?

Ainda não há execuções medidas suficientes de ElevenLabs v3 (alpha) no Railwail para indicar um tempo de execução. Depende da entrada, das configurações e da carga no provedor.

ElevenLabs v3 (alpha) é melhor que AudioLDM 2?

Depende da tarefa. ElevenLabs v3 (alpha) (ElevenLabs) e AudioLDM 2 (AudioLDM) são ambos modelos na categoria Conversão de texto em fala. A página de comparação mostra seus preços e especificações lado a lado.

Comparar ElevenLabs v3 (alpha) e AudioLDM 2

Posso usar ElevenLabs v3 (alpha) agora?

Atualmente indisponível: este modelo foi desativado. A página permanece online; alternativas disponíveis da mesma categoria estão listadas mais abaixo.

Todos os modelos através de uma API

Uma chave API para todos os modelos no Railwail. O uso é cobrado a partir de créditos pré-pagos, 1 crédito = US$ 0,01.