SeamlessM4T
seamless-communicationMeta's SeamlessM4T multimodal translation model. Takes speech or text input and produces transcription or translation across about 100 languages, including speech-to-text and speech-to-speech. One model covers ASR plus cross-lingual translation without chaining separate systems.
- Prix
- â 0,156 $US/exĂ©cution
- EntrĂ©e â Sortie
- Audio â Texte
- Développeur
- Community
- Mis Ă jour
- 23 septembre 2026
Playground
Essayer SeamlessM4T
Entrée & résultat
Cette exécution
environ 0,156 $US · 15,6 crédits
0,468 $US (46,8 crédits) sont réservés au démarrage ; le temps GPU réel est facturé.
Pour les comptes sans achat antérieur : les exécutions au-delà de 2 crédits nécessitent un rechargement.
Nouveau par ici ?
10 crédits gratuits (0,10 $US) lors de l'inscription avec Google
Utilisable 24 heures aprÚs l'inscription, jusqu'à 5 exécutions par jour et au maximum 2 crédits par exécution. Les autres méthodes de connexion commencent sans crédits.
Examples
- Durée : 0:08
Output (JSON, shortened)
{ "text_output": "MetaAI's seamless M4T model is democratizing spoken communication across language barriers.", "audio_output": null }Output (JSON, shortened)
{ "text_output": "Eg kaller Chen Xi, pĂ„ kinesisk desse to ordene betyr morgon og hĂ„p â", "audio_output": null }
Ă propos de SeamlessM4T
SeamlessM4T est un modĂšle de Community dans la catĂ©gorie Reconnaissance vocale. Sur Railwail, SeamlessM4T coĂ»te â 0,156 $US par exĂ©cution.
Tarification
| ExĂ©cution typique (â 133 s sur L40S) | 0,156 $US par exĂ©cution |
|---|---|
| Temps GPU (L40S) | 0,00117Â $US par seconde GPU |
- Facturée selon le temps GPU que l'exécution prend réellement. Au démarrage, 3à le prix typique est réservé de votre solde et régularisé ensuite.
- 1 crédit = 0,01 $US
Calculateur de coûts
Calculatrice de prix
Typique selon le fournisseur : environ 133,3 s
Total
15,60Â $US
1.560 crédits
Par exécution
0,156 $US · 15,6 crédits
Facturé selon le temps GPU réel ; il s'agit d'une estimation.
API
Aucun exemple API vérifié
L'API publique transmet un format d'entrée différent de celui dont ce modÚle a besoin. Utilisez le playground ci-dessus.
Spécifications
- ID du modĂšle
seamless-communication- Développeur
- Community
- Catégorie
- Reconnaissance vocale
- Entrée
- Audio
- Sortie
- Texte
- Facturation
- Ă l'usage (tokens ou temps GPU)
- Entrée du catalogue mise à jour
- 23 septembre 2026
ParamÚtres d'entrée
Entrées et paramÚtres du schéma d'entrée du modÚle. L'exemple dans la section API montre lesquels l'API accepte.
input_audioObligatoireURL or upload of the source audio
Type: TexteDĂ©faut: âValeurs autorisĂ©es: âtask_nameType: ChoixDĂ©faut:ASR (Automatic Speech Recognition)Valeurs autorisĂ©es: S2ST (Speech to Speech translation), S2TT (Speech to Text translation), T2ST (Text to Speech translation), T2TT (Text to Text translation) ou ASR (Automatic Speech Recognition)input_text_languageLanguage of input text when using a text-input task
Type: TexteDĂ©faut: âValeurs autorisĂ©es: âtarget_language_text_onlyTarget language for text output (e.g. English, German)
Type: TexteDĂ©faut: âValeurs autorisĂ©es: â
Ătiquettes
- replicate
- meta
- seamless
- stt
- transcription
- translation
- multilingual
- open-weights
Cas d'usage
Questions fréquemment posées
Qu'est-ce que SeamlessM4T ?
SeamlessM4T est un modÚle de Community dans la catégorie Reconnaissance vocale.
Combien coûte SeamlessM4T sur Railwail ?
Sur Railwail, SeamlessM4T coĂ»te â 0,156 $US par exĂ©cution. Vous ĂȘtes facturĂ© pour ce que chaque requĂȘte utilise rĂ©ellement. L'utilisation est payĂ©e Ă partir de crĂ©dits prĂ©payĂ©s ; 1 crĂ©dit Ă©quivaut Ă 0,01 $US.
Quels paramĂštres SeamlessM4T supporte-t-il ?
Selon son schéma d'entrée, SeamlessM4T connaßt ces paramÚtres : input_audio, task_name (S2ST (Speech to Speech translation), S2TT (Speech to Text translation), T2ST (Text to Speech translation), T2TT (Text to Text translation) ou ASR (Automatic Speech Recognition)), input_text_language et target_language_text_only.
Quelle est la vitesse de SeamlessM4T ?
Il n'y a pas encore assez d'exécutions mesurées de SeamlessM4T sur Railwail pour indiquer un temps d'exécution. Cela dépend de l'entrée, des paramÚtres et de la charge chez le fournisseur.
SeamlessM4T est-il meilleur que Incredibly Fast Whisper ?
Cela dépend de la tùche. SeamlessM4T (Community) et Incredibly Fast Whisper (Community) sont tous deux des modÚles de la catégorie Reconnaissance vocale. La page de comparaison affiche leurs prix et spécifications cÎte à cÎte.
Comparer SeamlessM4T et Incredibly Fast WhisperModĂšles comparables
Tous dans cette catégorie- Incredibly Fast WhisperCommunity
Whisper Large v3 wrapped with Hugging Face Transformers optimizations (batched inference, flash attention) for very high throughput. Transcribes hours of audio in minutes on a single GPU. Maintained by Vaibhav Srivastav. Good when you need bulk transcription fast.
- WhisperOpenAI
OpenAI's Whisper running on Replicate. General-purpose speech recognition trained on 680k hours of multilingual audio. Transcribes and translates 99 languages, robust to accents and background noise, and outputs plain text, segments, or word-level timestamps.
- SeamlessM4T v2 Large (Speech)Community
Meta SeamlessM4T v2 Large speech mode. Speech-to-speech, speech-to-text, and text-to-speech translation across 100+ languages in a single unified model.
â 0,0012 $US/exĂ©cution
99 % moins cher par unité
Comparer SeamlessM4T et SeamlessM4T v2 Large (Speech)
Tous les modĂšles via une API
Une clé API pour tous les modÚles sur Railwail. L'utilisation est facturée à partir de crédits prépayés, 1 crédit = 0,01 $US.