SeamlessM4T

Reconnaissance vocaleDisponible
par CommunityID du modĂšle: seamless-communication

Meta's SeamlessM4T multimodal translation model. Takes speech or text input and produces transcription or translation across about 100 languages, including speech-to-text and speech-to-speech. One model covers ASR plus cross-lingual translation without chaining separate systems.

Prix
≈ 0,156 $US/exĂ©cution
EntrĂ©e → Sortie
Audio → Texte
Développeur
Community
Mis Ă  jour
23 septembre 2026
01

Playground

Essayer SeamlessM4T

Entrée et résultat

≈ 0,156 $US/exĂ©cution
Essayer SeamlessM4T

URL or upload of the source audio

ParamÚtres avancés (3)

Language of input text when using a text-input task

Target language for text output (e.g. English, German)

Résultat
La transcription apparaĂźt ici.

Cette exécution

environ 0,156 $US · 15,6 crédits

0,468 $US (46,8 crédits) sont réservés au démarrage ; le temps GPU réel est facturé.

Pour les comptes sans achat antérieur : les exécutions au-delà de 2 crédits nécessitent un rechargement.

Nouveau par ici ?

10 crédits gratuits (0,10 $US) à l'inscription avec Google

Utilisable 24 heures aprÚs l'inscription, jusqu'à 5 exécutions par jour et au maximum 2 crédits par exécution. Les autres méthodes de connexion commencent sans crédits.

02

Examples

Real outputs from the public examples of this model on Replicate, with the prompt and settings that produced them. They were not generated live on this page.
  • Output (JSON, shortened)

    {
      "text_output": "MetaAI's seamless M4T model is democratizing spoken communication across language barriers.",
      "audio_output": null
    }
  • Output (JSON, shortened)

    {
      "text_output": "Eg kaller Chen Xi, pĂ„ kinesisk desse to ordene betyr morgon og hĂ„p ⁇",
      "audio_output": null
    }
03

À propos de SeamlessM4T

RésuméAu 23 septembre 2026

SeamlessM4T est un modĂšle de Community dans la catĂ©gorie Reconnaissance vocale. Sur Railwail, SeamlessM4T coĂ»te ≈ 0,156 $US par exĂ©cution.

04

Tarification

Prix en dollars américains. L'utilisation est facturée à partir de crédits prépayés.
ExĂ©cution typique (≈ 133 s sur L40S)0,156 $US par exĂ©cution
Temps GPU (L40S)0,00117 $US par seconde GPU
  • FacturĂ©e selon le temps GPU que l'exĂ©cution prend rĂ©ellement. Au dĂ©marrage, 3× le prix typique est rĂ©servĂ© de votre solde et rĂ©gularisĂ© ensuite.
  • 1 crĂ©dit = 0,01 $US

Calculatrice de coûts

Calculatrice de prix

s

Typique selon le fournisseur : environ 133,3 s

Total

15,60 $US

1 560 crĂ©dits

Par exécution

0,156 $US · 15,6 crédits

Facturé selon le temps GPU réel ; ceci est une estimation.

05

API

Appelez SeamlessM4T avec votre clĂ© API Railwail. Utilisez cet ID de modĂšle dans la requĂȘte :

Aucun exemple API vérifié

L'API publique transmet un format d'entrée différent de celui dont ce modÚle a besoin. Utilisez le playground ci-dessus.

06

Spécifications

ID du modĂšle
seamless-communication
Développeur
Community
Entrée
Audio
Sortie
Texte
Facturation
À l'usage (tokens ou temps GPU)
Entrée du catalogue mise à jour
23 septembre 2026

ParamÚtres d'entrée

Entrées et paramÚtres du schéma d'entrée du modÚle. L'exemple dans la section API montre lesquels l'API accepte.

  • input_audioObligatoire

    URL or upload of the source audio

    Type: Texte
    Par dĂ©faut: –
    Valeurs autorisĂ©es: –
  • task_name
    Type: Choix
    Par défaut: ASR (Automatic Speech Recognition)
    Valeurs autorisées: S2ST (Speech to Speech translation), S2TT (Speech to Text translation), T2ST (Text to Speech translation), T2TT (Text to Text translation) ou ASR (Automatic Speech Recognition)
  • input_text_language

    Language of input text when using a text-input task

    Type: Texte
    Par dĂ©faut: –
    Valeurs autorisĂ©es: –
  • target_language_text_only

    Target language for text output (e.g. English, German)

    Type: Texte
    Par dĂ©faut: –
    Valeurs autorisĂ©es: –

Étiquettes

  • replicate
  • meta
  • seamless
  • stt
  • transcription
  • translation
  • multilingual
  • open-weights
07

Cas d'usage

08

Questions fréquemment posées

Qu'est-ce que SeamlessM4T ?

SeamlessM4T est un modÚle de Community dans la catégorie Reconnaissance vocale.

Combien coûte SeamlessM4T sur Railwail ?

Sur Railwail, SeamlessM4T coĂ»te ≈ 0,156 $US par exĂ©cution. Vous ĂȘtes facturĂ© pour ce que chaque requĂȘte utilise rĂ©ellement. L'utilisation est payĂ©e Ă  partir de crĂ©dits prĂ©payĂ©s ; 1 crĂ©dit Ă©quivaut Ă  0,01 $US.

Quels paramĂštres SeamlessM4T supporte-t-il ?

Selon son schéma d'entrée, SeamlessM4T connaßt ces paramÚtres : input_audio, task_name (S2ST (Speech to Speech translation), S2TT (Speech to Text translation), T2ST (Text to Speech translation), T2TT (Text to Text translation) ou ASR (Automatic Speech Recognition)), input_text_language et target_language_text_only.

Quelle est la vitesse de SeamlessM4T ?

Il n'y a pas encore assez d'exécutions mesurées de SeamlessM4T sur Railwail pour indiquer un temps d'exécution. Cela dépend de l'entrée, des paramÚtres et de la charge chez le fournisseur.

SeamlessM4T est-il meilleur que Incredibly Fast Whisper ?

Cela dépend de la tùche. SeamlessM4T (Community) et Incredibly Fast Whisper (Community) sont tous deux des modÚles de la catégorie Reconnaissance vocale. La page de comparaison affiche leurs prix et spécifications cÎte à cÎte.

Comparer SeamlessM4T et Incredibly Fast Whisper
09

ModĂšles comparables

Tous dans cette catégorie
  • Whisper Large v3 wrapped with Hugging Face Transformers optimizations (batched inference, flash attention) for very high throughput. Transcribes hours of audio in minutes on a single GPU. Maintained by Vaibhav Srivastav. Good when you need bulk transcription fast.

    ≈ 0,0056 $US/exĂ©cution

    96 % moins cher par unité

    Comparer SeamlessM4T et Incredibly Fast Whisper
  • WhisperOpenAI

    OpenAI's Whisper running on Replicate. General-purpose speech recognition trained on 680k hours of multilingual audio. Transcribes and translates 99 languages, robust to accents and background noise, and outputs plain text, segments, or word-level timestamps.

    ≈ 0,0034 $US/exĂ©cution

    98 % moins cher par unité

    Comparer SeamlessM4T et Whisper
  • Meta SeamlessM4T v2 Large speech mode. Speech-to-speech, speech-to-text, and text-to-speech translation across 100+ languages in a single unified model.

    ≈ 0,0012 $US/exĂ©cution

    99 % moins cher par unité

    Comparer SeamlessM4T et SeamlessM4T v2 Large (Speech)

Tous les modĂšles via une API

Une clé API pour tous les modÚles sur Railwail. L'utilisation est facturée à partir de crédits prépayés, 1 crédit = 0,01 $US.