ElevenLabs v3 (alpha)

Synthèse vocaleNon disponible
par ElevenLabsID du modèle: eleven-v3

ElevenLabs' v3 alpha TTS. Most expressive voice model with audio tags and laughter, higher latency.

Statut
Non disponible
Entrée → Sortie
Texte → Audio
Développeur
ElevenLabs
Mis à jour
25 juin 2026

ElevenLabs v3 (alpha) n'est actuellement pas disponible

Actuellement indisponible : ce modèle a été désactivé.

Vous pouvez toujours consulter les détails sur cette page. Choisissez l'une des alternatives disponibles ci-dessous pour exécuter immédiatement un modèle comparable.

Voir les alternatives
01

Modèles comparables

Tous dans cette catégorie
  • AudioLDM 2AudioLDM

    Latent-diffusion model for general-purpose text-to-audio. Generates speech, music, and sound effects with a unified prior.

    ≈ 0,0157 $US/exécution

  • ChatterboxReplicate

    Resemble AI's open Chatterbox TTS. Zero-shot voice cloning from a short audio prompt with an exaggeration control for emotion intensity, plus CFG weight to balance pacing and fidelity.

    0,030 $US/1 000 caractères

  • F5-TTSReplicate

    Open-source flow-matching TTS with strong zero-shot voice cloning. Code MIT, weights CC-BY-NC.

    ≈ 0,0168 $US/exécution

02

Playground

Essayer ElevenLabs v3 (alpha)

Entrée et résultat

Actuellement indisponible

Actuellement indisponible : ce modèle a été désactivé.

Le terrain de jeu est désactivé. Vous pouvez trouver des modèles comparables dans la même catégorie : Parcourir les alternatives

Essayer ElevenLabs v3 (alpha)

0 / 4 000

Résultat
La parole générée apparaît ici.

Cette exécution

Pas de prix – actuellement indisponible.

Nouveau par ici ?

5 crédits gratuits (0,05 $US) à l'inscription avec Google

Utilisable 24 heures après l'inscription, jusqu'à 5 exécutions par jour et au maximum 2 crédits par exécution. Les autres méthodes de connexion commencent sans crédits.

03

À propos de ElevenLabs v3 (alpha)

RésuméAu 25 juin 2026

ElevenLabs v3 (alpha) est un modèle de ElevenLabs dans la catégorie Synthèse vocale. ElevenLabs v3 (alpha) n'est actuellement pas disponible sur Railwail.

Arrière-plan

À propos de ElevenLabs

Fondée 2022 · London, UK / New York, USA

ElevenLabs was founded in 2022 by Piotr Dabkowski (CTO, ex-Google ML engineer) and Mati Staniszewski (CEO, ex-Palantir), two Polish high-school friends frustrated with the poor quality of TV-show dubbing in Polish. The company set out to build voice AI that captures intonation and emotion across languages. Headquartered in London and New York with engineering hubs in Warsaw and the Bay Area, ElevenLabs raised a $19M Series A in June 2023 led by Andreessen Horowitz, a $80M Series B in January 2024 also led by a16z at a $1.1B valuation, and a $180M Series C in January 2025 at a $3.3B valuation co-led by a16z and ICONIQ. ElevenLabs v3 (alpha) was previewed in 2025 as the next generation flagship model with expressive emotion tags, longer context and more languages, succeeding the Multilingual V2 family that became the de-facto standard for AI dubbing.

Visiter ElevenLabs

Architecture

Proprietary autoregressive Transformer TTS with neural codec and emotion/prosody conditioning

ElevenLabs v3 (alpha) is the company's 2025 flagship text-to-speech model and the first ElevenLabs system to expose explicit emotion and event tags inside text input ([whispers], [laughs], [angry], [sighs]). It is a proprietary Transformer-based autoregressive model that predicts neural-codec audio tokens conditioned on a text prompt and a speaker embedding obtained from a few seconds of reference audio (Instant Voice Clone) or a fully fine-tuned voice (Professional Voice Clone, requires ~30 minutes of clean audio). v3 expands language coverage from 29 (v2) to 70+ languages, lengthens the input window to roughly 10,000 characters per request, and adds dialogue mode for multi-speaker scenes. ElevenLabs has not published a technical paper; product blog posts describe internal improvements in speaker disentanglement, code-switching and emotional range. v3 is offered through the same hosted API and Studio UI as Multilingual V2 but at higher latency and price.

Paramètres
Undisclosed
Contexte
10 000 tokens

Capacités

  • Expressive emotion and event tags ([laughs], [whispers], [angry], [crying])
  • 70+ languages with high-quality code-switching
  • Multi-speaker dialogue mode for podcast and audiobook generation
  • Instant Voice Clone from ~1 minute of audio and Professional Voice Clone from ~30 minutes
  • Long-form input up to ~10,000 characters per request
  • Studio editor for multi-paragraph projects with per-line speaker control
  • Best for: audiobooks, dubbing, narrative podcasts, character voices for games

Entraînement et licence

Not disclosed. ElevenLabs licences professional voice talent, uses public-domain audiobooks and crowd-sourced opt-in voice contributions; commercial recordings are excluded per their public statements.

Licence: Proprietary commercial SaaS. Commercial use of generated audio is permitted on paid plans; voice clones remain customer property.

Tests de sécurité: AI Speech Classifier offered for free; mandatory consent statement and KYC for Professional Voice Clones; inaudible watermark on outputs; mis-use bans after 2024 deepfake incidents.

Limitations connues

  • Higher latency than v2 Turbo or Cartesia Sonic
  • Tag interpretation occasionally inconsistent in alpha
  • Hard refusal for likeness of named public figures without verified consent
  • Closed weights, no on-premise deployment
  • Pricing per character is among the highest in the market
04

Tarification

Actuellement indisponible : ce modèle a été désactivé. Il n'y a pas de prix pour ce modèle pour le moment, il ne peut donc pas être exécuté.

05

API

Appelez ElevenLabs v3 (alpha) avec votre clé API Railwail. Utilisez cet ID de modèle dans la requête :

Aucun exemple API vérifié

L'API publique transmet un format d'entrée différent de celui dont ce modèle a besoin. Utilisez le playground ci-dessus.

06

Spécifications

ID du modèle
eleven-v3
Développeur
ElevenLabs
Entrée
Texte
Sortie
Audio
Formats de sortie
MP3, WAV, OPUS
Taille du modèle
Undisclosed
Licence
Proprietary commercial SaaS. Commercial use of generated audio is permitted on paid plans; voice clones remain customer property.
Entrée du catalogue mise à jour
25 juin 2026

Paramètres d'entrée

Entrées et paramètres du schéma d'entrée du modèle. L'exemple dans la section API montre lesquels l'API accepte.

  • inputObligatoire

    Text to convert to speech

    Type: Texte
    Par défaut:
    Valeurs autorisées: Jusqu'à 4000 caractères
  • speed
    Type: Nombre
    Par défaut: 1
    Valeurs autorisées: 0,5 à 2
  • voice
    Type: Choix
    Par défaut: Rachel
    Valeurs autorisées: Rachel, Adam, Antoni, Bella, Domi, Elli, Josh ou Sam
  • response_format
    Type: Choix
    Par défaut: mp3
    Valeurs autorisées: mp3, wav ou opus

Étiquettes

  • elevenlabs
  • tts
  • expressive
  • alpha
  • per-character
07

Cas d'usage

À quoi ça sert

  • Audiobook narration with emotion
  • Multilingual film and series dubbing
  • Character voices for video games
  • Narrative podcasts and radio drama
  • Accessibility tools and screen readers
08

Questions fréquemment posées

Qu'est-ce que ElevenLabs v3 (alpha) ?

ElevenLabs v3 (alpha) est un modèle de ElevenLabs dans la catégorie Synthèse vocale. Il est listé sur Railwail mais ne peut pas être exécuté pour le moment.

Combien coûte ElevenLabs v3 (alpha) sur Railwail ?

ElevenLabs v3 (alpha) ne peut pas être exécuté sur Railwail pour le moment, il n'y a donc pas de prix actuel. Les alternatives disponibles avec leurs prix sont listées plus bas sur cette page.

Quels paramètres ElevenLabs v3 (alpha) supporte-t-il ?

Selon son schéma d'entrée, ElevenLabs v3 (alpha) connaît ces paramètres : input (Jusqu'à 4000 caractères), speed (0,5 à 2), voice (Rachel, Adam, Antoni, Bella, Domi, Elli, Josh ou Sam) et response_format (mp3, wav ou opus).

Quelle est la vitesse de ElevenLabs v3 (alpha) ?

Il n'y a pas encore assez d'exécutions mesurées de ElevenLabs v3 (alpha) sur Railwail pour indiquer un temps d'exécution. Cela dépend de l'entrée, des paramètres et de la charge chez le fournisseur.

ElevenLabs v3 (alpha) est-il meilleur que AudioLDM 2 ?

Cela dépend de la tâche. ElevenLabs v3 (alpha) (ElevenLabs) et AudioLDM 2 (AudioLDM) sont tous deux des modèles de la catégorie Synthèse vocale. La page de comparaison affiche leurs prix et spécifications côte à côte.

Comparer ElevenLabs v3 (alpha) et AudioLDM 2

Puis-je utiliser ElevenLabs v3 (alpha) maintenant ?

Actuellement indisponible : ce modèle a été désactivé. La page reste en ligne ; les alternatives disponibles de la même catégorie sont listées plus bas.

Tous les modèles via une API

Une clé API pour tous les modèles sur Railwail. L'utilisation est facturée à partir de crédits prépayés, 1 crédit = 0,01 $US.