OpenVoice v2

Síntesis de vozDisponible
de CommunityID del modelo: openvoice-v2

MyShell OpenVoice v2. Multilingual zero-shot voice cloning with accurate tone-color reproduction and style/emotion control.

Precio
≈ USD 0.0673/ejecución
Entrada → Salida
Texto → Audio
Desarrollador
Community
Actualizado
23 de septiembre de 2026
01

Clone a voice

Record or upload a short sample, type a text and hear it in that voice. OpenVoice v2 runs in your account like any other run, and you see the price first.
  1. 1

    Your voice

    Voice sample *Record up to 30 s · file up to 60 s, 10 MB

    10 to 30 seconds of clear speech, one speaker, no music or background noise.

  2. 2

    Text

    Language: EN_NEWEST103 / 4,000
  3. 3

    Listen

    about USD 0.0673 per run, billed by the actual GPU time

02

Playground

Probar OpenVoice v2

Entrada y salida

≈ USD 0.0673/ejecución
Probar OpenVoice v2

0 / 4,000

Voice sample *Record up to 30 s · file up to 60 s, 10 MB

10 to 30 seconds of clear speech, one speaker, no music or background noise.

Configuración avanzada (1)
Resultado
La voz generada aparece aquí.

Esta ejecución

aprox. USD 0.0673 · 6.73 créditos

Se reservan USD 0.2017 (20.17 créditos) al inicio; se factura el tiempo real de GPU.

Para cuentas sin compra previa: las ejecuciones superiores a 2 créditos requieren una recarga.

¿Nuevo aquí?

10 créditos gratis (USD 0.10) cuando te registras con Google

Utilizable 24 horas después del registro, hasta 5 ejecuciones por día y como máximo 2 créditos por ejecución. Otros métodos de inicio de sesión comienzan sin créditos.

03

Examples

Real outputs from the public examples of this model on Replicate, with the prompt and settings that produced them. They were not generated live on this page.
04

Acerca de OpenVoice v2

ResumenA partir de 23 de septiembre de 2026

OpenVoice v2 es un modelo de Community en la categoría Síntesis de voz. En Railwail, OpenVoice v2 cuesta ≈ USD 0.0673 por ejecución.

05

Precios

Precios en dólares estadounidenses. El uso se cobra con créditos prepagados.
Ejecución típica (≈ 49 s en A100 (40GB))USD 0.0673 por ejecución
Tiempo de GPU (A100 (40GB))USD 0.00138 por segundo de GPU
  • Se factura por el tiempo de GPU que realmente toma la ejecución. Cuando comienza la ejecución, se reserva 3× el precio típico de tu saldo y se liquida después.
  • 1 crédito = USD 0.01

Calculadora de costos

Calculadora de precios

s

Típico según el proveedor: aprox. 48.7 s

Total

USD 6.73

673 créditos

Por ejecución

USD 0.0673 · 6.73 créditos

Se factura el tiempo real de GPU; este es un estimado.

06

API

Llama a OpenVoice v2 con tu clave de API de Railwail. Usa este ID de modelo en la solicitud:

Sin ejemplo de API verificado

La API pública pasa un formato de entrada diferente al que necesita este modelo. Usa el playground anterior.

07

Especificaciones

ID del modelo
openvoice-v2
Desarrollador
Community
Entrada
Texto
Salida
Audio
Facturación
Por uso (tokens o tiempo de GPU)
Entrada del catálogo actualizada
23 de septiembre de 2026

Parámetros de entrada

Entradas y configuraciones del esquema de entrada del modelo. El ejemplo en la sección API muestra cuáles de ellas acepta la API.

  • textrequerido

    Text to synthesize

    Tipo: Texto
    Predeterminado: –
    Valores permitidos: hasta 4,000 caracteres
  • audiorequerido

    Reference clip to clone; requires consent

    Tipo: –
    Predeterminado: –
    Valores permitidos: –
  • speed
    Tipo: Número
    Predeterminado: 1
    Valores permitidos: –
  • language
    Tipo: Opción
    Predeterminado: EN_NEWEST
    Valores permitidos: EN_NEWEST, EN, ES, FR, ZH, JP o KR

Etiquetas

  • myshell
  • tts
  • voice-cloning
  • multilingual
  • open-source
08

Casos de uso

09

Preguntas frecuentes

¿Qué es OpenVoice v2?

OpenVoice v2 es un modelo de Community en la categoría Síntesis de voz.

¿Cuánto cuesta OpenVoice v2 en Railwail?

En Railwail, OpenVoice v2 cuesta ≈ USD 0.0673 por ejecución. Se te cobra por lo que cada solicitud realmente usa. El uso se paga con créditos prepagados; 1 crédito equivale a USD 0.01.

¿Qué configuraciones admite OpenVoice v2?

Según su esquema de entrada, OpenVoice v2 conoce estos parámetros: text (hasta 4,000 caracteres), audio, speed y language (EN_NEWEST, EN, ES, FR, ZH, JP o KR).

¿Qué tan rápido es OpenVoice v2?

Aún no hay suficientes ejecuciones medidas de OpenVoice v2 en Railwail para indicar un tiempo de ejecución. Depende de la entrada, la configuración y la carga en el proveedor.

¿Es OpenVoice v2 mejor que AudioLDM 2?

Eso depende de la tarea. OpenVoice v2 (Community) y AudioLDM 2 (Haohe Liu) son ambos modelos en la categoría Síntesis de voz. La página de comparación muestra sus precios y especificaciones lado a lado.

Comparar OpenVoice v2 y AudioLDM 2
10

Modelos comparables

Todos en esta categoría
  • AudioLDM 2Haohe Liu

    Latent-diffusion model for general-purpose text-to-audio. Generates speech, music, and sound effects with a unified prior.

    ≈ USD 0.0157/ejecución

    77 % más barato por unidad

    Comparar OpenVoice v2 vs. AudioLDM 2
  • Kokoro TTS 82MCommunity

    Open-weights 82M-parameter TTS. Punches above its size class on naturalness benchmarks at a fraction of the inference cost of larger models.

    ≈ USD 0.00030/ejecución

    100 % más barato por unidad

    Comparar OpenVoice v2 vs. Kokoro TTS 82M
  • Parler-TTSCommunity

    Hugging Face Parler-TTS Mini. Lightweight TTS conditioned on a natural-language style description for fine-grained control over voice characteristics.

    ≈ USD 0.0024/ejecución

    96 % más barato por unidad

    Comparar OpenVoice v2 vs. Parler-TTS

Todos los modelos a través de una API

Una clave API para todos los modelos en Railwail. El uso se cobra con créditos prepagados, 1 crédito = USD 0.01.