SeamlessM4T
seamless-communicationMeta's SeamlessM4T multimodal translation model. Takes speech or text input and produces transcription or translation across about 100 languages, including speech-to-text and speech-to-speech. One model covers ASR plus cross-lingual translation without chaining separate systems.
- Cena
- ≈ 0,156 USD/uruchomienie
- Wejście → Wyjście
- Audio → Tekst
- Deweloper
- Community
- Zaktualizowano
- 23 września 2026
Playground
Spróbuj SeamlessM4T
Wejście i wyjście
To uruchomienie
ok. 0,156 USD · 15,6 kredytów
Na początek rezerwowane jest 0,468 USD (46,8 kredytów); rozliczana jest rzeczywista czas GPU.
Dla kont bez wcześniejszego zakupu: uruchomienia powyżej 2 kredytów wymagają doładowania.
Nowy tutaj?
10 darmowych kredytów (0,10 USD) po zarejestrowaniu się przez Google
Dostępne 24 godzin po rejestracji, do 5 uruchomień dziennie i maksymalnie 2 kredytów na uruchomienie. Inne metody logowania uruchamiają się bez kredytów.
Examples
- Długość: 0:08
Output (JSON, shortened)
{ "text_output": "MetaAI's seamless M4T model is democratizing spoken communication across language barriers.", "audio_output": null }Output (JSON, shortened)
{ "text_output": "Eg kaller Chen Xi, på kinesisk desse to ordene betyr morgon og håp ⁇", "audio_output": null }
O SeamlessM4T
SeamlessM4T to model opracowany przez Community w kategorii Rozpoznawanie mowy. W serwisie Railwail SeamlessM4T kosztuje ≈ 0,156 USD za uruchomienie.
Ceny
| Typowe uruchomienie (≈ 133 s na L40S) | 0,156 USD za uruchomienie |
|---|---|
| Czas GPU (L40S) | 0,00117 USD za sekundę GPU |
- Rozliczane są czasy GPU, które przebieg faktycznie zajmuje. Po uruchomieniu przebiegu 3× typowej ceny jest rezerwowane z Twojego salda i rozliczane później.
- 1 kredyt = 0,01 USD
Kalkulator kosztów
Kalkulator cen
Typowo według dostawcy: ok. 133,3 s
Razem
15,60 USD
1560 kredytów
Za uruchomienie
0,156 USD · 15,6 kredytów
Rozliczane są rzeczywiste sekundy GPU; wartość jest szacunkiem.
API
Brak zweryfikowanego przykładu API
Publiczny API przekazuje inny format wejściowy niż wymaga ten model. Użyj placu zabaw powyżej.
Specyfikacje
- ID modelu
seamless-communication- Deweloper
- Community
- Kategoria
- Rozpoznawanie mowy
- Wejście
- Audio
- Wyjście
- Tekst
- Rozliczenie
- Według użycia (tokeny lub czas GPU)
- Wpis w katalogu zaktualizowany
- 23 września 2026
Parametry wejściowe
Dane wejściowe i ustawienia ze schematu wejściowego modelu. Przykład w sekcji API pokazuje, które z nich API akceptuje.
input_audiowymaganeURL or upload of the source audio
Typ: TekstDomyślnie: –Dozwolone wartości: –task_nameTyp: WybórDomyślnie:ASR (Automatic Speech Recognition)Dozwolone wartości: S2ST (Speech to Speech translation), S2TT (Speech to Text translation), T2ST (Text to Speech translation), T2TT (Text to Text translation) lub ASR (Automatic Speech Recognition)input_text_languageLanguage of input text when using a text-input task
Typ: TekstDomyślnie: –Dozwolone wartości: –target_language_text_onlyTarget language for text output (e.g. English, German)
Typ: TekstDomyślnie: –Dozwolone wartości: –
Tagi
- replicate
- meta
- seamless
- stt
- transcription
- translation
- multilingual
- open-weights
Przypadki użycia
Często zadawane pytania
Co to jest SeamlessM4T?
SeamlessM4T to model opracowany przez Community w kategorii Rozpoznawanie mowy.
Ile kosztuje SeamlessM4T w serwisie Railwail?
W serwisie Railwail SeamlessM4T kosztuje ≈ 0,156 USD za uruchomienie. Opłata jest pobierana za to, co faktycznie zużywa każde żądanie. Użycie jest opłacane z przedpłaconych kredytów; 1 kredyt równa się 0,01 USD.
Jakie ustawienia obsługuje SeamlessM4T?
Zgodnie ze schematem wejściowym, SeamlessM4T obsługuje te parametry: input_audio, task_name (S2ST (Speech to Speech translation), S2TT (Speech to Text translation), T2ST (Text to Speech translation), T2TT (Text to Text translation) lub ASR (Automatic Speech Recognition)), input_text_language i target_language_text_only.
Jak szybki jest SeamlessM4T?
Dla SeamlessM4T jest jeszcze zbyt mało zmierzonych przebiegów w serwisie Railwail, aby podać czas przebiegu. Zależy to od wejścia, ustawień i obciążenia u dostawcy.
Czy SeamlessM4T jest lepszy niż Incredibly Fast Whisper?
To zależy od zadania. SeamlessM4T (Community) i Incredibly Fast Whisper (Community) to oba modele z kategorii Rozpoznawanie mowy. Strona porównania pokazuje ich ceny i specyfikacje obok siebie.
Porównaj SeamlessM4T i Incredibly Fast WhisperPorównywalne modele
Wszystkie w tej kategorii- Incredibly Fast WhisperCommunity
Whisper Large v3 wrapped with Hugging Face Transformers optimizations (batched inference, flash attention) for very high throughput. Transcribes hours of audio in minutes on a single GPU. Maintained by Vaibhav Srivastav. Good when you need bulk transcription fast.
- WhisperOpenAI
OpenAI's Whisper running on Replicate. General-purpose speech recognition trained on 680k hours of multilingual audio. Transcribes and translates 99 languages, robust to accents and background noise, and outputs plain text, segments, or word-level timestamps.
- SeamlessM4T v2 Large (Speech)Community
Meta SeamlessM4T v2 Large speech mode. Speech-to-speech, speech-to-text, and text-to-speech translation across 100+ languages in a single unified model.
≈ 0,0012 USD/uruchomienie
99 % taniej za jednostkę
Porównaj SeamlessM4T i SeamlessM4T v2 Large (Speech)
Wszystkie modele przez jedno API
Jeden klucz API dla każdego modelu na Railwail. Opłaty pobierane są z przedpłaconych kredytów, 1 kredyt = 0,01 USD.