AudioLDM 2

Conversão de texto em falaDisponível
por Haohe LiuID do modelo: audioldm-2

Latent-diffusion model for general-purpose text-to-audio. Generates speech, music, and sound effects with a unified prior.

Preço
≈ US$ 0,0157/execução
Entrada → Saída
Texto → Áudio
Desenvolvedor
Haohe Liu
Atualizado
23 de setembro de 2026
01

Playground

Experimentar AudioLDM 2

Sem formulário de entrada

≈ US$ 0,0157/execução

Ainda não há formulário de entrada para este modelo

Suas entradas ainda não foram documentadas. Para que nenhuma execução falhe com uma entrada incorreta, não oferecemos um formulário aqui. Escolha um modelo comparável em vez disso.

02

Examples

Real outputs from the public examples of this model on Replicate, with the prompt and settings that produced them. They were not generated live on this page.
03

Sobre AudioLDM 2

ResumoA partir de 23 de setembro de 2026

AudioLDM 2 é um modelo de Haohe Liu na categoria Conversão de texto em fala. No Railwail, AudioLDM 2 custa ≈ US$ 0,0157 por execução.

04

Preços

Preços em dólares americanos. O uso é cobrado a partir de créditos pré-pagos.
Execução típica (≈ 58 s em T4)US$ 0,0157 por execução
Tempo de GPU (T4)US$ 0,00027 por segundo de GPU
  • Faturado pelo tempo de GPU que a execução realmente leva. Quando a execução começa, 3× o preço típico é reservado do seu saldo e liquidado depois.
  • 1 crédito = US$ 0,01

Calculadora de custos

Calculadora de preços

s

Típico conforme o provedor: cerca de 57,8 s

Total

US$ 1,57

157 créditos

Por execução

US$ 0,0157 · 1,57 créditos

Faturado pelo tempo real de GPU; este é uma estimativa.

05

API

Chame AudioLDM 2 com sua chave de API Railwail. Use este ID de modelo na solicitação:

Nenhum exemplo de API verificado

As entradas deste modelo ainda não foram documentadas.

06

Especificações

ID do modelo
audioldm-2
Desenvolvedor
Haohe Liu
Entrada
Texto
Saída
Áudio
Faturamento
Por uso (tokens ou tempo de GPU)
Entrada do catálogo atualizada
23 de setembro de 2026

Etiquetas

  • audioldm
  • music-generation
  • diffusion
  • open-weights
07

Casos de uso

08

Perguntas frequentes

O que é AudioLDM 2?

AudioLDM 2 é um modelo de Haohe Liu na categoria Conversão de texto em fala.

Quanto custa AudioLDM 2 no Railwail?

No Railwail, AudioLDM 2 custa ≈ US$ 0,0157 por execução. Você é cobrado pelo que cada solicitação realmente usa. O uso é pago com créditos pré-pagos; 1 crédito equivale a US$ 0,01.

Qual é a velocidade de AudioLDM 2?

Ainda não há execuções medidas suficientes de AudioLDM 2 no Railwail para indicar um tempo de execução. Depende da entrada, das configurações e da carga no provedor.

AudioLDM 2 é melhor que Chatterbox?

Depende da tarefa. AudioLDM 2 (Haohe Liu) e Chatterbox (Resemble AI) são ambos modelos na categoria Conversão de texto em fala. A página de comparação mostra seus preços e especificações lado a lado.

Comparar AudioLDM 2 e Chatterbox
09

Modelos comparáveis

Todos nesta categoria
  • Kokoro TTS 82MCommunity

    Open-weights 82M-parameter TTS. Punches above its size class on naturalness benchmarks at a fraction of the inference cost of larger models.

    ≈ US$ 0,00030/execução

    98 % mais barato por unidade

    Comparar AudioLDM 2 vs. Kokoro TTS 82M
  • OpenVoice v2Community

    MyShell OpenVoice v2. Multilingual zero-shot voice cloning with accurate tone-color reproduction and style/emotion control.

    ≈ US$ 0,0673/execução

    329 % mais caro por unidade

    Comparar AudioLDM 2 vs. OpenVoice v2
  • Parler-TTSCommunity

    Hugging Face Parler-TTS Mini. Lightweight TTS conditioned on a natural-language style description for fine-grained control over voice characteristics.

    ≈ US$ 0,0024/execução

    85 % mais barato por unidade

    Comparar AudioLDM 2 vs. Parler-TTS

Todos os modelos através de uma API

Uma chave API para todos os modelos no Railwail. O uso é cobrado a partir de créditos pré-pagos, 1 crédito = US$ 0,01.