AudioLDM 2
audioldm-2Latent-diffusion model for general-purpose text-to-audio. Generates speech, music, and sound effects with a unified prior.
- Pris
- ≈ 0,0157 US$/kørsel
- Input → output
- Tekst → Lyd
- Udvikler
- Haohe Liu
- Opdateret
- 23. september 2026
Playground
Prøv AudioLDM 2
Ingen inputmaske
Ingen inputmaske til denne model endnu
Dens inputs er endnu ikke dokumenteret. For at ingen kørsel mislykkes på grund af forkert input tilbyder vi ikke en formular her. Vælg i stedet en sammenlignelig model.
Examples
- Længde: 0:05
Prompt
two starships are fighting in space with laser cannons
Settings
- duration
- 5.0
- Længde: 0:05
Prompt
a hammer hits a wooden surface
Settings
- duration
- 5.0
- Længde: 0:05
Prompt
catchy upbeat pop music, kick drum, bouncy
Settings
- duration
- 5.0
Om AudioLDM 2
AudioLDM 2 er en model af Haohe Liu i kategorien Sprogudtale (TTS). På Railwail koster AudioLDM 2 ≈ 0,0157 US$ pr. kørsel.
Priser
| Typisk kørsel (≈ 58 s på T4) | 0,0157 US$ pr. kørsel |
|---|---|
| GPU-tid (T4) | 0,00027Â US$ pr. GPU-sekund |
- Faktureres efter den GPU-tid, som kørslen faktisk tager. Når kørslen starter, reserveres 3× den typiske pris fra din saldo og afregnes efterfølgende.
- 1 kredit = 0,01Â US$
Omkostningsberegner
Prisberegner
Typisk ifølge udbyderen: ca. 57,8 s
I alt
1,57Â US$
157 credits
Pr. kørsel
0,0157 US$ · 1,57 credits
Fakturering efter faktisk GPU-tid; dette er et estimat.
API
Intet bekræftet API-eksempel
Inputene til denne model er ikke dokumenteret endnu.
Specifikationer
- Model-ID
audioldm-2- Udvikler
- Haohe Liu
- Kategori
- Sprogudtale (TTS)
- Input
- Tekst
- Output
- Lyd
- Fakturering
- Efter forbrug (tokens eller GPU-tid)
- Katalogelement opdateret
- 23. september 2026
Tags
- audioldm
- music-generation
- diffusion
- open-weights
Anvendelsestilfælde
Ofte stillede spørgsmål
Hvad er AudioLDM 2?
AudioLDM 2 er en model fra Haohe Liu i kategorien Sprogudtale (TTS).
Hvad koster AudioLDM 2 på Railwail?
På Railwail koster AudioLDM 2 ≈ 0,0157 US$ pr. kørsel. Du betaler for det, som hver anmodning faktisk bruger. Forbrug betales fra forudbetalte credits; 1 credit svarer til 0,01 US$.
Hvor hurtig er AudioLDM 2?
Der er endnu ikke nok målte kørsler af AudioLDM 2 på Railwail til at angive en udførelsestid. Det afhænger af inputtet, indstillingerne og belastningen hos provideren.
Er AudioLDM 2 bedre end Chatterbox?
Det afhænger af opgaven. AudioLDM 2 (Haohe Liu) og Chatterbox (Resemble AI) er begge modeller i kategorien Sprogudtale (TTS). Sammenligningssiden viser deres priser og specifikationer side om side.
Sammenlign AudioLDM 2 og ChatterboxSammenlignelige modeller
Alle i denne kategori- Kokoro TTS 82MCommunity
Open-weights 82M-parameter TTS. Punches above its size class on naturalness benchmarks at a fraction of the inference cost of larger models.
- OpenVoice v2Community
MyShell OpenVoice v2. Multilingual zero-shot voice cloning with accurate tone-color reproduction and style/emotion control.
- Parler-TTSCommunity
Hugging Face Parler-TTS Mini. Lightweight TTS conditioned on a natural-language style description for fine-grained control over voice characteristics.
Alle modeller via én API
En API-nøgle til alle modeller på Railwail. Forbrug debiteres fra forudbetalte credits, 1 credit = 0,01 US$.