AudioLDM 2

Synthèse vocaleDisponible
par Haohe LiuID du modèle: audioldm-2

Latent-diffusion model for general-purpose text-to-audio. Generates speech, music, and sound effects with a unified prior.

Prix
≈ 0,0157 $US/exécution
Entrée → Sortie
Texte → Audio
Développeur
Haohe Liu
Mis à jour
23 septembre 2026
01

Playground

Essayer AudioLDM 2

Pas de formulaire d'entrée

≈ 0,0157 $US/exécution

Aucun formulaire d'entrée pour ce modèle pour le moment

Ses entrées ne sont pas encore documentées. Pour éviter qu'une exécution échoue avec une mauvaise entrée, nous ne proposons pas de formulaire ici. Choisissez plutôt un modèle comparable.

02

Examples

Real outputs from the public examples of this model on Replicate, with the prompt and settings that produced them. They were not generated live on this page.
03

À propos de AudioLDM 2

RésuméAu 23 septembre 2026

AudioLDM 2 est un modèle de Haohe Liu dans la catégorie Synthèse vocale. Sur Railwail, AudioLDM 2 coûte ≈ 0,0157 $US par exécution.

04

Tarification

Prix en dollars américains. L'utilisation est facturée à partir de crédits prépayés.
Exécution typique (≈ 58 s sur T4)0,0157 $US par exécution
Temps GPU (T4)0,00027 $US par seconde GPU
  • Facturée selon le temps GPU que l'exécution prend réellement. Au démarrage, 3× le prix typique est réservé de votre solde et régularisé ensuite.
  • 1 crédit = 0,01 $US

Calculatrice de coûts

Calculatrice de prix

s

Typique selon le fournisseur : environ 57,8 s

Total

1,57 $US

157 crédits

Par exécution

0,0157 $US · 1,57 crédits

Facturé selon le temps GPU réel ; ceci est une estimation.

05

API

Appelez AudioLDM 2 avec votre clé API Railwail. Utilisez cet ID de modèle dans la requête :

Aucun exemple API vérifié

Les entrées de ce modèle ne sont pas encore documentées.

06

Spécifications

ID du modèle
audioldm-2
Développeur
Haohe Liu
Entrée
Texte
Sortie
Audio
Facturation
À l'usage (tokens ou temps GPU)
Entrée du catalogue mise à jour
23 septembre 2026

Étiquettes

  • audioldm
  • music-generation
  • diffusion
  • open-weights
07

Cas d'usage

08

Questions fréquemment posées

Qu'est-ce que AudioLDM 2 ?

AudioLDM 2 est un modèle de Haohe Liu dans la catégorie Synthèse vocale.

Combien coûte AudioLDM 2 sur Railwail ?

Sur Railwail, AudioLDM 2 coûte ≈ 0,0157 $US par exécution. Vous êtes facturé pour ce que chaque requête utilise réellement. L'utilisation est payée à partir de crédits prépayés ; 1 crédit équivaut à 0,01 $US.

Quelle est la vitesse de AudioLDM 2 ?

Il n'y a pas encore assez d'exécutions mesurées de AudioLDM 2 sur Railwail pour indiquer un temps d'exécution. Cela dépend de l'entrée, des paramètres et de la charge chez le fournisseur.

AudioLDM 2 est-il meilleur que Chatterbox ?

Cela dépend de la tâche. AudioLDM 2 (Haohe Liu) et Chatterbox (Resemble AI) sont tous deux des modèles de la catégorie Synthèse vocale. La page de comparaison affiche leurs prix et spécifications côte à côte.

Comparer AudioLDM 2 et Chatterbox
09

Modèles comparables

Tous dans cette catégorie
  • Kokoro TTS 82MCommunity

    Open-weights 82M-parameter TTS. Punches above its size class on naturalness benchmarks at a fraction of the inference cost of larger models.

    ≈ 0,00030 $US/exécution

    98 % moins cher par unité

    Comparer AudioLDM 2 et Kokoro TTS 82M
  • OpenVoice v2Community

    MyShell OpenVoice v2. Multilingual zero-shot voice cloning with accurate tone-color reproduction and style/emotion control.

    ≈ 0,0673 $US/exécution

    329 % plus cher par unité

    Comparer AudioLDM 2 et OpenVoice v2
  • Parler-TTSCommunity

    Hugging Face Parler-TTS Mini. Lightweight TTS conditioned on a natural-language style description for fine-grained control over voice characteristics.

    ≈ 0,0024 $US/exécution

    85 % moins cher par unité

    Comparer AudioLDM 2 et Parler-TTS

Tous les modèles via une API

Une clé API pour tous les modèles sur Railwail. L'utilisation est facturée à partir de crédits prépayés, 1 crédit = 0,01 $US.