OpenVoice v2
openvoice-v2MyShell OpenVoice v2. Multilingual zero-shot voice cloning with accurate tone-color reproduction and style/emotion control.
- Precio
- ≈ USD 0.0673/ejecución
- Entrada → Salida
- Texto → Audio
- Desarrollador
- Community
- Actualizado
- 23 de septiembre de 2026
Clone a voice
- 1
Your voice
Voice sample *Record up to 30 s · file up to 60 s, 10 MB10 to 30 seconds of clear speech, one speaker, no music or background noise.
Only your own voice or a voice you have verifiable permission for. Imitating other people without their consent is not allowed, see our Terms of Service.
- 2
Text
Language: EN_NEWEST103 / 4,000 - 3
Listen
about USD 0.0673 per run, billed by the actual GPU time
Playground
Probar OpenVoice v2
Entrada y salida
Esta ejecución
aprox. USD 0.0673 · 6.73 créditos
Se reservan USD 0.2017 (20.17 créditos) al inicio; se factura el tiempo real de GPU.
Para cuentas sin compra previa: las ejecuciones superiores a 2 créditos requieren una recarga.
¿Nuevo aquí?
10 créditos gratis (USD 0.10) cuando te registras con Google
Utilizable 24 horas después del registro, hasta 5 ejecuciones por día y como máximo 2 créditos por ejecución. Otros métodos de inicio de sesión comienzan sin créditos.
Examples
- Duración: 0:03
Prompt
Did you ever hear a folk tale about a giant turtle?
Settings
- language
- EN_NEWEST
- speed
- 1
- Duración: 0:05
Prompt
这次旅行我们计划去巴黎欣赏埃菲尔铁塔和卢浮宫的美景
Settings
- language
- ZH
- speed
- 1
- Duración: 0:06
Prompt
El resplandor del sol acaricia las olas, pintando el cielo con una paleta deslumbrante.
Settings
- language
- ES
- speed
- 1
Acerca de OpenVoice v2
OpenVoice v2 es un modelo de Community en la categoría Síntesis de voz. En Railwail, OpenVoice v2 cuesta ≈ USD 0.0673 por ejecución.
Precios
| Ejecución típica (≈ 49 s en A100 (40GB)) | USD 0.0673 por ejecución |
|---|---|
| Tiempo de GPU (A100 (40GB)) | USD 0.00138 por segundo de GPU |
- Se factura por el tiempo de GPU que realmente toma la ejecución. Cuando comienza la ejecución, se reserva 3× el precio típico de tu saldo y se liquida después.
- 1 crédito = USD 0.01
Calculadora de costos
Calculadora de precios
Típico según el proveedor: aprox. 48.7 s
Total
USD 6.73
673 créditos
Por ejecución
USD 0.0673 · 6.73 créditos
Se factura el tiempo real de GPU; este es un estimado.
API
Sin ejemplo de API verificado
La API pública pasa un formato de entrada diferente al que necesita este modelo. Usa el playground anterior.
Especificaciones
- ID del modelo
openvoice-v2- Desarrollador
- Community
- Categoría
- Síntesis de voz
- Entrada
- Texto
- Salida
- Audio
- Facturación
- Por uso (tokens o tiempo de GPU)
- Entrada del catálogo actualizada
- 23 de septiembre de 2026
Parámetros de entrada
Entradas y configuraciones del esquema de entrada del modelo. El ejemplo en la sección API muestra cuáles de ellas acepta la API.
textrequeridoText to synthesize
Tipo: TextoPredeterminado: –Valores permitidos: hasta 4,000 caracteresaudiorequeridoReference clip to clone; requires consent
Tipo: –Predeterminado: –Valores permitidos: –speedTipo: NúmeroPredeterminado:1Valores permitidos: –languageTipo: OpciónPredeterminado:EN_NEWESTValores permitidos: EN_NEWEST, EN, ES, FR, ZH, JP o KR
Etiquetas
- myshell
- tts
- voice-cloning
- multilingual
- open-source
Casos de uso
Preguntas frecuentes
¿Qué es OpenVoice v2?
OpenVoice v2 es un modelo de Community en la categoría Síntesis de voz.
¿Cuánto cuesta OpenVoice v2 en Railwail?
En Railwail, OpenVoice v2 cuesta ≈ USD 0.0673 por ejecución. Se te cobra por lo que cada solicitud realmente usa. El uso se paga con créditos prepagados; 1 crédito equivale a USD 0.01.
¿Qué configuraciones admite OpenVoice v2?
Según su esquema de entrada, OpenVoice v2 conoce estos parámetros: text (hasta 4,000 caracteres), audio, speed y language (EN_NEWEST, EN, ES, FR, ZH, JP o KR).
¿Qué tan rápido es OpenVoice v2?
Aún no hay suficientes ejecuciones medidas de OpenVoice v2 en Railwail para indicar un tiempo de ejecución. Depende de la entrada, la configuración y la carga en el proveedor.
¿Es OpenVoice v2 mejor que AudioLDM 2?
Eso depende de la tarea. OpenVoice v2 (Community) y AudioLDM 2 (Haohe Liu) son ambos modelos en la categoría Síntesis de voz. La página de comparación muestra sus precios y especificaciones lado a lado.
Comparar OpenVoice v2 y AudioLDM 2Modelos comparables
Todos en esta categoría- AudioLDM 2Haohe Liu
Latent-diffusion model for general-purpose text-to-audio. Generates speech, music, and sound effects with a unified prior.
- Kokoro TTS 82MCommunity
Open-weights 82M-parameter TTS. Punches above its size class on naturalness benchmarks at a fraction of the inference cost of larger models.
- Parler-TTSCommunity
Hugging Face Parler-TTS Mini. Lightweight TTS conditioned on a natural-language style description for fine-grained control over voice characteristics.
Todos los modelos a través de una API
Una clave API para todos los modelos en Railwail. El uso se cobra con créditos prepagados, 1 crédito = USD 0.01.