ElevenLabs v3 (alpha)

Síntesis de vozNo disponible
de ElevenLabsID del modelo: eleven-v3

ElevenLabs' v3 alpha TTS. Most expressive voice model with audio tags and laughter, higher latency.

Estado
No disponible
Entrada → Salida
Texto → Audio
Desarrollador
ElevenLabs
Actualizado
25 de junio de 2026

ElevenLabs v3 (alpha) no está disponible actualmente

Actualmente no disponible: este modelo ha sido desactivado.

Puedes seguir leyendo los detalles en esta página. Elige una de las alternativas disponibles abajo para ejecutar un modelo comparable de inmediato.

Ir a alternativas
01

Modelos comparables

Todos en esta categoría
  • AudioLDM 2AudioLDM

    Latent-diffusion model for general-purpose text-to-audio. Generates speech, music, and sound effects with a unified prior.

    ≈ 0,0157 US$/ejecución

  • ChatterboxReplicate

    Resemble AI's open Chatterbox TTS. Zero-shot voice cloning from a short audio prompt with an exaggeration control for emotion intensity, plus CFG weight to balance pacing and fidelity.

    0,030 US$/1.000 caracteres

  • F5-TTSReplicate

    Open-source flow-matching TTS with strong zero-shot voice cloning. Code MIT, weights CC-BY-NC.

    ≈ 0,0168 US$/ejecución

02

Playground

Probar ElevenLabs v3 (alpha)

Entrada y salida

No disponible actualmente

Actualmente no disponible: este modelo ha sido desactivado.

El área de pruebas está desactivada. Puedes encontrar modelos comparables en la misma categoría: Explorar alternativas

Probar ElevenLabs v3 (alpha)

0 / 4000

Resultado
La voz generada aparece aquí.

Esta ejecución

Sin precio – actualmente no disponible.

¿Eres nuevo aquí?

5 créditos gratis (0,05 US$) cuando te registres con Google

Disponible 24 horas después del registro, hasta 5 ejecuciones por día y como máximo 2 créditos por ejecución. Otros métodos de inicio de sesión comienzan sin créditos.

03

Acerca de ElevenLabs v3 (alpha)

ResumenA fecha de 25 de junio de 2026

ElevenLabs v3 (alpha) es un modelo de ElevenLabs en la categoría Síntesis de voz. ElevenLabs v3 (alpha) no está disponible en Railwail en este momento.

Fondo

Acerca de ElevenLabs

Fundado en 2022 · London, UK / New York, USA

ElevenLabs was founded in 2022 by Piotr Dabkowski (CTO, ex-Google ML engineer) and Mati Staniszewski (CEO, ex-Palantir), two Polish high-school friends frustrated with the poor quality of TV-show dubbing in Polish. The company set out to build voice AI that captures intonation and emotion across languages. Headquartered in London and New York with engineering hubs in Warsaw and the Bay Area, ElevenLabs raised a $19M Series A in June 2023 led by Andreessen Horowitz, a $80M Series B in January 2024 also led by a16z at a $1.1B valuation, and a $180M Series C in January 2025 at a $3.3B valuation co-led by a16z and ICONIQ. ElevenLabs v3 (alpha) was previewed in 2025 as the next generation flagship model with expressive emotion tags, longer context and more languages, succeeding the Multilingual V2 family that became the de-facto standard for AI dubbing.

Visitar ElevenLabs

Arquitectura

Proprietary autoregressive Transformer TTS with neural codec and emotion/prosody conditioning

ElevenLabs v3 (alpha) is the company's 2025 flagship text-to-speech model and the first ElevenLabs system to expose explicit emotion and event tags inside text input ([whispers], [laughs], [angry], [sighs]). It is a proprietary Transformer-based autoregressive model that predicts neural-codec audio tokens conditioned on a text prompt and a speaker embedding obtained from a few seconds of reference audio (Instant Voice Clone) or a fully fine-tuned voice (Professional Voice Clone, requires ~30 minutes of clean audio). v3 expands language coverage from 29 (v2) to 70+ languages, lengthens the input window to roughly 10,000 characters per request, and adds dialogue mode for multi-speaker scenes. ElevenLabs has not published a technical paper; product blog posts describe internal improvements in speaker disentanglement, code-switching and emotional range. v3 is offered through the same hosted API and Studio UI as Multilingual V2 but at higher latency and price.

Parámetros
Undisclosed
Contexto
10.000 tokens

Capacidades

  • Expressive emotion and event tags ([laughs], [whispers], [angry], [crying])
  • 70+ languages with high-quality code-switching
  • Multi-speaker dialogue mode for podcast and audiobook generation
  • Instant Voice Clone from ~1 minute of audio and Professional Voice Clone from ~30 minutes
  • Long-form input up to ~10,000 characters per request
  • Studio editor for multi-paragraph projects with per-line speaker control
  • Best for: audiobooks, dubbing, narrative podcasts, character voices for games

Entrenamiento y licencia

Not disclosed. ElevenLabs licences professional voice talent, uses public-domain audiobooks and crowd-sourced opt-in voice contributions; commercial recordings are excluded per their public statements.

Licencia: Proprietary commercial SaaS. Commercial use of generated audio is permitted on paid plans; voice clones remain customer property.

Pruebas de seguridad: AI Speech Classifier offered for free; mandatory consent statement and KYC for Professional Voice Clones; inaudible watermark on outputs; mis-use bans after 2024 deepfake incidents.

Limitaciones conocidas

  • Higher latency than v2 Turbo or Cartesia Sonic
  • Tag interpretation occasionally inconsistent in alpha
  • Hard refusal for likeness of named public figures without verified consent
  • Closed weights, no on-premise deployment
  • Pricing per character is among the highest in the market
04

Precios

Actualmente no disponible: este modelo ha sido desactivado. No hay precio para este modelo en este momento, por lo que no se puede ejecutar.

05

API

Llama a ElevenLabs v3 (alpha) con tu clave API de Railwail. Usa este ID de modelo en la solicitud:

Sin ejemplo de API verificado

La API pública pasa un formato de entrada diferente al que necesita este modelo. Usa el playground anterior.

06

Especificaciones

ID del modelo
eleven-v3
Desarrollador
ElevenLabs
Entrada
Texto
Salida
Audio
Formatos de salida
MP3, WAV, OPUS
Tamaño del modelo
Undisclosed
Licencia
Proprietary commercial SaaS. Commercial use of generated audio is permitted on paid plans; voice clones remain customer property.
Entrada del catálogo actualizada
25 de junio de 2026

Parámetros de entrada

Entradas y configuración del esquema de entrada del modelo. El ejemplo en la sección API muestra cuáles de ellas acepta la API.

  • inputObligatorio

    Text to convert to speech

    Tipo: Texto
    Predeterminado:
    Valores permitidos: Hasta 4000 caracteres
  • speed
    Tipo: Número
    Predeterminado: 1
    Valores permitidos: 0,5 a 2
  • voice
    Tipo: Opción
    Predeterminado: Rachel
    Valores permitidos: Rachel, Adam, Antoni, Bella, Domi, Elli, Josh o Sam
  • response_format
    Tipo: Opción
    Predeterminado: mp3
    Valores permitidos: mp3, wav u opus

Etiquetas

  • elevenlabs
  • tts
  • expressive
  • alpha
  • per-character
07

Casos de uso

Para qué se utiliza

  • Audiobook narration with emotion
  • Multilingual film and series dubbing
  • Character voices for video games
  • Narrative podcasts and radio drama
  • Accessibility tools and screen readers
08

Preguntas frecuentes

¿Qué es ElevenLabs v3 (alpha)?

ElevenLabs v3 (alpha) es un modelo de ElevenLabs en la categoría Síntesis de voz. Aparece en el catálogo de Railwail pero no se puede ejecutar en este momento.

¿Cuánto cuesta ElevenLabs v3 (alpha) en Railwail?

ElevenLabs v3 (alpha) no se puede ejecutar en Railwail en este momento, por lo que no hay precio actual. Las alternativas disponibles con precios se enumeran más abajo en esta página.

¿Qué configuraciones admite ElevenLabs v3 (alpha)?

Según su esquema de entrada, ElevenLabs v3 (alpha) conoce estos parámetros: input (Hasta 4000 caracteres), speed (0,5 a 2), voice (Rachel, Adam, Antoni, Bella, Domi, Elli, Josh o Sam) y response_format (mp3, wav u opus).

¿Qué velocidad tiene ElevenLabs v3 (alpha)?

Aún no hay suficientes ejecuciones medidas de ElevenLabs v3 (alpha) en Railwail para indicar un tiempo de ejecución. Depende de la entrada, la configuración y la carga en el proveedor.

¿Es ElevenLabs v3 (alpha) mejor que AudioLDM 2?

Depende de la tarea. ElevenLabs v3 (alpha) (ElevenLabs) y AudioLDM 2 (AudioLDM) son ambos modelos en la categoría Síntesis de voz. La página de comparación muestra sus precios y especificaciones lado a lado.

Comparar ElevenLabs v3 (alpha) y AudioLDM 2

¿Puedo usar ElevenLabs v3 (alpha) ahora mismo?

Actualmente no disponible: este modelo ha sido desactivado. La página se mantiene en línea; las alternativas disponibles de la misma categoría se enumeran más abajo.

Todos los modelos a través de una API

Una clave API para todos los modelos en Railwail. El uso se cobra desde créditos prepagados, 1 crédito = 0,01 US$.