AudioLDM 2

Síntesis de vozDisponible
de Haohe LiuID del modelo: audioldm-2

Latent-diffusion model for general-purpose text-to-audio. Generates speech, music, and sound effects with a unified prior.

Precio
≈ USD 0.0157/ejecución
Entrada → Salida
Texto → Audio
Desarrollador
Haohe Liu
Actualizado
23 de septiembre de 2026
01

Playground

Probar AudioLDM 2

Sin formulario de entrada

≈ USD 0.0157/ejecución

Aún no hay formulario de entrada para este modelo

Sus entradas aún no están documentadas. Para evitar errores por entradas incorrectas, no ofrecemos un formulario aquí. Elige un modelo comparable en su lugar.

02

Examples

Real outputs from the public examples of this model on Replicate, with the prompt and settings that produced them. They were not generated live on this page.
03

Acerca de AudioLDM 2

ResumenA partir de 23 de septiembre de 2026

AudioLDM 2 es un modelo de Haohe Liu en la categoría Síntesis de voz. En Railwail, AudioLDM 2 cuesta ≈ USD 0.0157 por ejecución.

04

Precios

Precios en dólares estadounidenses. El uso se cobra con créditos prepagados.
Ejecución típica (≈ 58 s en T4)USD 0.0157 por ejecución
Tiempo de GPU (T4)USD 0.00027 por segundo de GPU
  • Se factura por el tiempo de GPU que realmente toma la ejecución. Cuando comienza la ejecución, se reserva 3× el precio típico de tu saldo y se liquida después.
  • 1 crédito = USD 0.01

Calculadora de costos

Calculadora de precios

s

Típico según el proveedor: aprox. 57.8 s

Total

USD 1.57

157 créditos

Por ejecución

USD 0.0157 · 1.57 créditos

Se factura el tiempo real de GPU; este es un estimado.

05

API

Llama a AudioLDM 2 con tu clave de API de Railwail. Usa este ID de modelo en la solicitud:

Sin ejemplo de API verificado

Las entradas de este modelo aún no están documentadas.

06

Especificaciones

ID del modelo
audioldm-2
Desarrollador
Haohe Liu
Entrada
Texto
Salida
Audio
Facturación
Por uso (tokens o tiempo de GPU)
Entrada del catálogo actualizada
23 de septiembre de 2026

Etiquetas

  • audioldm
  • music-generation
  • diffusion
  • open-weights
07

Casos de uso

08

Preguntas frecuentes

¿Qué es AudioLDM 2?

AudioLDM 2 es un modelo de Haohe Liu en la categoría Síntesis de voz.

¿Cuánto cuesta AudioLDM 2 en Railwail?

En Railwail, AudioLDM 2 cuesta ≈ USD 0.0157 por ejecución. Se te cobra por lo que cada solicitud realmente usa. El uso se paga con créditos prepagados; 1 crédito equivale a USD 0.01.

¿Qué tan rápido es AudioLDM 2?

Aún no hay suficientes ejecuciones medidas de AudioLDM 2 en Railwail para indicar un tiempo de ejecución. Depende de la entrada, la configuración y la carga en el proveedor.

¿Es AudioLDM 2 mejor que Chatterbox?

Eso depende de la tarea. AudioLDM 2 (Haohe Liu) y Chatterbox (Resemble AI) son ambos modelos en la categoría Síntesis de voz. La página de comparación muestra sus precios y especificaciones lado a lado.

Comparar AudioLDM 2 y Chatterbox
09

Modelos comparables

Todos en esta categoría
  • Kokoro TTS 82MCommunity

    Open-weights 82M-parameter TTS. Punches above its size class on naturalness benchmarks at a fraction of the inference cost of larger models.

    ≈ USD 0.00030/ejecución

    98 % más barato por unidad

    Comparar AudioLDM 2 vs. Kokoro TTS 82M
  • OpenVoice v2Community

    MyShell OpenVoice v2. Multilingual zero-shot voice cloning with accurate tone-color reproduction and style/emotion control.

    ≈ USD 0.0673/ejecución

    329 % más caro por unidad

    Comparar AudioLDM 2 vs. OpenVoice v2
  • Parler-TTSCommunity

    Hugging Face Parler-TTS Mini. Lightweight TTS conditioned on a natural-language style description for fine-grained control over voice characteristics.

    ≈ USD 0.0024/ejecución

    85 % más barato por unidad

    Comparar AudioLDM 2 vs. Parler-TTS

Todos los modelos a través de una API

Una clave API para todos los modelos en Railwail. El uso se cobra con créditos prepagados, 1 crédito = USD 0.01.