AudioLDM 2
audioldm-2Latent-diffusion model for general-purpose text-to-audio. Generates speech, music, and sound effects with a unified prior.
- Precio
- ≈ USD 0.0157/ejecución
- Entrada → Salida
- Texto → Audio
- Desarrollador
- Haohe Liu
- Actualizado
- 23 de septiembre de 2026
Playground
Probar AudioLDM 2
Sin formulario de entrada
Aún no hay formulario de entrada para este modelo
Sus entradas aún no están documentadas. Para evitar errores por entradas incorrectas, no ofrecemos un formulario aquí. Elige un modelo comparable en su lugar.
Examples
- Duración: 0:05
Prompt
two starships are fighting in space with laser cannons
Settings
- duration
- 5.0
- Duración: 0:05
Prompt
a hammer hits a wooden surface
Settings
- duration
- 5.0
- Duración: 0:05
Prompt
catchy upbeat pop music, kick drum, bouncy
Settings
- duration
- 5.0
Acerca de AudioLDM 2
AudioLDM 2 es un modelo de Haohe Liu en la categoría Síntesis de voz. En Railwail, AudioLDM 2 cuesta ≈ USD 0.0157 por ejecución.
Precios
| Ejecución típica (≈ 58 s en T4) | USD 0.0157 por ejecución |
|---|---|
| Tiempo de GPU (T4) | USD 0.00027 por segundo de GPU |
- Se factura por el tiempo de GPU que realmente toma la ejecución. Cuando comienza la ejecución, se reserva 3× el precio típico de tu saldo y se liquida después.
- 1 crédito = USD 0.01
Calculadora de costos
Calculadora de precios
Típico según el proveedor: aprox. 57.8 s
Total
USD 1.57
157 créditos
Por ejecución
USD 0.0157 · 1.57 créditos
Se factura el tiempo real de GPU; este es un estimado.
API
Sin ejemplo de API verificado
Las entradas de este modelo aún no están documentadas.
Especificaciones
- ID del modelo
audioldm-2- Desarrollador
- Haohe Liu
- Categoría
- Síntesis de voz
- Entrada
- Texto
- Salida
- Audio
- Facturación
- Por uso (tokens o tiempo de GPU)
- Entrada del catálogo actualizada
- 23 de septiembre de 2026
Etiquetas
- audioldm
- music-generation
- diffusion
- open-weights
Casos de uso
Preguntas frecuentes
¿Qué es AudioLDM 2?
AudioLDM 2 es un modelo de Haohe Liu en la categoría Síntesis de voz.
¿Cuánto cuesta AudioLDM 2 en Railwail?
En Railwail, AudioLDM 2 cuesta ≈ USD 0.0157 por ejecución. Se te cobra por lo que cada solicitud realmente usa. El uso se paga con créditos prepagados; 1 crédito equivale a USD 0.01.
¿Qué tan rápido es AudioLDM 2?
Aún no hay suficientes ejecuciones medidas de AudioLDM 2 en Railwail para indicar un tiempo de ejecución. Depende de la entrada, la configuración y la carga en el proveedor.
¿Es AudioLDM 2 mejor que Chatterbox?
Eso depende de la tarea. AudioLDM 2 (Haohe Liu) y Chatterbox (Resemble AI) son ambos modelos en la categoría Síntesis de voz. La página de comparación muestra sus precios y especificaciones lado a lado.
Comparar AudioLDM 2 y ChatterboxModelos comparables
Todos en esta categoría- Kokoro TTS 82MCommunity
Open-weights 82M-parameter TTS. Punches above its size class on naturalness benchmarks at a fraction of the inference cost of larger models.
- OpenVoice v2Community
MyShell OpenVoice v2. Multilingual zero-shot voice cloning with accurate tone-color reproduction and style/emotion control.
- Parler-TTSCommunity
Hugging Face Parler-TTS Mini. Lightweight TTS conditioned on a natural-language style description for fine-grained control over voice characteristics.
Todos los modelos a través de una API
Una clave API para todos los modelos en Railwail. El uso se cobra con créditos prepagados, 1 crédito = USD 0.01.