ElevenLabs v3 (alpha)

Синтез речи (TTS)Недоступно
от ElevenLabsID модели: eleven-v3

ElevenLabs' v3 alpha TTS. Most expressive voice model with audio tags and laughter, higher latency.

Статус
Недоступно
Вход → выход
Текст → Аудио
Разработчик
ElevenLabs
Обновлено
25 июня 2026 г.

ElevenLabs v3 (alpha) сейчас недоступна

Недоступно: эта модель деактивирована.

Вы можете прочитать подробности на этой странице. Выберите одну из доступных альтернатив ниже, чтобы сразу запустить сравнимую модель.

К альтернативам
01

Сравнимые модели

Все в этой категории
  • AudioLDM 2AudioLDM

    Latent-diffusion model for general-purpose text-to-audio. Generates speech, music, and sound effects with a unified prior.

    ≈ 0,0157 $/запуск

  • ChatterboxReplicate

    Resemble AI's open Chatterbox TTS. Zero-shot voice cloning from a short audio prompt with an exaggeration control for emotion intensity, plus CFG weight to balance pacing and fidelity.

    0,030 $/1000 символов

  • F5-TTSReplicate

    Open-source flow-matching TTS with strong zero-shot voice cloning. Code MIT, weights CC-BY-NC.

    ≈ 0,0168 $/запуск

02

Playground

Попробовать ElevenLabs v3 (alpha)

Входные данные и результат

Сейчас недоступна

Недоступно: эта модель деактивирована.

Playground отключен. Сравнимые модели найдёте в той же категории: Посмотреть альтернативы

Попробовать ElevenLabs v3 (alpha)

0 / 4 000

Результат
Сгенерированная речь появится здесь.

Этот запуск

Нет цены – сейчас недоступно.

Впервые здесь?

5 бесплатных кредитов (0,05 $) при регистрации через Google

Доступно 24 часов после регистрации, до 5 запусков в день и максимум 2 кредитов за запуск. Другие способы входа начинают без кредитов.

03

О ElevenLabs v3 (alpha)

КороткоПо состоянию на 25 июня 2026 г.

ElevenLabs v3 (alpha) — это модель от ElevenLabs в категории Синтез речи (TTS). ElevenLabs v3 (alpha) сейчас недоступна на Railwail.

Фон

О ElevenLabs

Основана в 2022 · London, UK / New York, USA

ElevenLabs was founded in 2022 by Piotr Dabkowski (CTO, ex-Google ML engineer) and Mati Staniszewski (CEO, ex-Palantir), two Polish high-school friends frustrated with the poor quality of TV-show dubbing in Polish. The company set out to build voice AI that captures intonation and emotion across languages. Headquartered in London and New York with engineering hubs in Warsaw and the Bay Area, ElevenLabs raised a $19M Series A in June 2023 led by Andreessen Horowitz, a $80M Series B in January 2024 also led by a16z at a $1.1B valuation, and a $180M Series C in January 2025 at a $3.3B valuation co-led by a16z and ICONIQ. ElevenLabs v3 (alpha) was previewed in 2025 as the next generation flagship model with expressive emotion tags, longer context and more languages, succeeding the Multilingual V2 family that became the de-facto standard for AI dubbing.

Посетить ElevenLabs

Архитектура

Proprietary autoregressive Transformer TTS with neural codec and emotion/prosody conditioning

ElevenLabs v3 (alpha) is the company's 2025 flagship text-to-speech model and the first ElevenLabs system to expose explicit emotion and event tags inside text input ([whispers], [laughs], [angry], [sighs]). It is a proprietary Transformer-based autoregressive model that predicts neural-codec audio tokens conditioned on a text prompt and a speaker embedding obtained from a few seconds of reference audio (Instant Voice Clone) or a fully fine-tuned voice (Professional Voice Clone, requires ~30 minutes of clean audio). v3 expands language coverage from 29 (v2) to 70+ languages, lengthens the input window to roughly 10,000 characters per request, and adds dialogue mode for multi-speaker scenes. ElevenLabs has not published a technical paper; product blog posts describe internal improvements in speaker disentanglement, code-switching and emotional range. v3 is offered through the same hosted API and Studio UI as Multilingual V2 but at higher latency and price.

Параметры
Undisclosed
Контекст
10 000 токенов

Возможности

  • Expressive emotion and event tags ([laughs], [whispers], [angry], [crying])
  • 70+ languages with high-quality code-switching
  • Multi-speaker dialogue mode for podcast and audiobook generation
  • Instant Voice Clone from ~1 minute of audio and Professional Voice Clone from ~30 minutes
  • Long-form input up to ~10,000 characters per request
  • Studio editor for multi-paragraph projects with per-line speaker control
  • Best for: audiobooks, dubbing, narrative podcasts, character voices for games

Обучение и лицензия

Not disclosed. ElevenLabs licences professional voice talent, uses public-domain audiobooks and crowd-sourced opt-in voice contributions; commercial recordings are excluded per their public statements.

Лицензия: Proprietary commercial SaaS. Commercial use of generated audio is permitted on paid plans; voice clones remain customer property.

Тестирование безопасности: AI Speech Classifier offered for free; mandatory consent statement and KYC for Professional Voice Clones; inaudible watermark on outputs; mis-use bans after 2024 deepfake incidents.

Известные ограничения

  • Higher latency than v2 Turbo or Cartesia Sonic
  • Tag interpretation occasionally inconsistent in alpha
  • Hard refusal for likeness of named public figures without verified consent
  • Closed weights, no on-premise deployment
  • Pricing per character is among the highest in the market
04

Цены

Недоступно: эта модель деактивирована. На данный момент для этой модели нет цены, поэтому её нельзя запустить.

05

API

Вызовите ElevenLabs v3 (alpha) с помощью вашего API-ключа Railwail. Используйте этот ID модели в запросе:

Нет проверенного примера API

Публичный API передает другой формат входных данных, чем требует эта модель. Используйте playground выше.

06

Спецификации

ID модели
eleven-v3
Разработчик
ElevenLabs
Категория
Синтез речи (TTS)
Входные данные
Текст
Выходные данные
Аудио
Форматы выходных данных
MP3, WAV, OPUS
Размер модели
Undisclosed
Лицензия
Proprietary commercial SaaS. Commercial use of generated audio is permitted on paid plans; voice clones remain customer property.
Запись в каталоге обновлена
25 июня 2026 г.

Входные параметры

Входные данные и параметры из схемы входных данных модели. Пример в разделе API показывает, какие из них принимает API.

  • inputобязательно

    Text to convert to speech

    Тип: Текст
    По умолчанию:
    Допустимые значения: до 4 000 символов
  • speed
    Тип: Число
    По умолчанию: 1
    Допустимые значения: от 0,5 до 2
  • voice
    Тип: Выбор
    По умолчанию: Rachel
    Допустимые значения: Rachel, Adam, Antoni, Bella, Domi, Elli, Josh или Sam
  • response_format
    Тип: Выбор
    По умолчанию: mp3
    Допустимые значения: mp3, wav или opus

Теги

  • elevenlabs
  • tts
  • expressive
  • alpha
  • per-character
07

Применение

Для чего это используется

  • Audiobook narration with emotion
  • Multilingual film and series dubbing
  • Character voices for video games
  • Narrative podcasts and radio drama
  • Accessibility tools and screen readers
08

Часто задаваемые вопросы

Что такое ElevenLabs v3 (alpha)?

ElevenLabs v3 (alpha) — модель от ElevenLabs в категории Синтез речи (TTS). Модель указана в каталоге Railwail, но сейчас её нельзя запустить.

Сколько стоит ElevenLabs v3 (alpha) на Railwail?

ElevenLabs v3 (alpha) сейчас нельзя запустить на Railwail, поэтому текущей цены нет. Доступные альтернативы с ценами указаны ниже на этой странице.

Какие параметры поддерживает ElevenLabs v3 (alpha)?

Согласно схеме входных данных, ElevenLabs v3 (alpha) поддерживает эти параметры: input (до 4 000 символов), speed (от 0,5 до 2), voice (Rachel, Adam, Antoni, Bella, Domi, Elli, Josh или Sam) и response_format (mp3, wav или opus).

Насколько быстра ElevenLabs v3 (alpha)?

На Railwail пока недостаточно измеренных запусков ElevenLabs v3 (alpha), чтобы указать время выполнения. Оно зависит от входных данных, параметров и нагрузки на провайдера.

ElevenLabs v3 (alpha) лучше, чем AudioLDM 2?

Это зависит от задачи. ElevenLabs v3 (alpha) (ElevenLabs) и AudioLDM 2 (AudioLDM) — обе модели в категории Синтез речи (TTS). На странице сравнения показаны их цены и характеристики рядом.

Сравнить ElevenLabs v3 (alpha) и AudioLDM 2

Могу ли я использовать ElevenLabs v3 (alpha) прямо сейчас?

Недоступно: эта модель деактивирована. Страница остаётся в сети; доступные альтернативы из той же категории указаны ниже.

Все модели через один API

Один API-ключ для всех моделей на Railwail. Использование оплачивается из предоплаченных кредитов, 1 кредит = 0,01 $.