Whisper Large v3 Turbo

Αναγνώριση ομιλίαςΜη διαθέσιμο
από OpenAIΑναγνωριστικό μοντέλου: whisper-large-v3-turbo

OpenAI's distilled Whisper Large v3. ~216x realtime, 99+ languages, MIT-licensed weights.

Κατάσταση
Μη διαθέσιμο
Είσοδος → Έξοδος
Ήχος → Κείμενο
Προγραμματιστής
OpenAI
Ενημερώθηκε
23 Σεπτεμβρίου 2026

Το Whisper Large v3 Turbo δεν είναι διαθέσιμο αυτή τη στιγμή

Προς το παρόν μη διαθέσιμο: αυτό το μοντέλο έχει απενεργοποιηθεί.

Μπορείτε να διαβάσετε τις λεπτομέρειες σε αυτήν τη σελίδα. Επιλέξτε μία από τις διαθέσιμες εναλλακτικές λύσεις παρακάτω για να εκτελέσετε αμέσως ένα συγκρίσιμο μοντέλο.

Μετάβαση στις εναλλακτικές λύσεις
01

Συγκρίσιμα μοντέλα

Όλα σε αυτήν την κατηγορία
  • Whisper Large v3 wrapped with Hugging Face Transformers optimizations (batched inference, flash attention) for very high throughput. Transcribes hours of audio in minutes on a single GPU. Maintained by Vaibhav Srivastav. Good when you need bulk transcription fast.

    ≈ 0,0056 $/εκτέλεση

  • WhisperOpenAI

    OpenAI's Whisper running on Replicate. General-purpose speech recognition trained on 680k hours of multilingual audio. Transcribes and translates 99 languages, robust to accents and background noise, and outputs plain text, segments, or word-level timestamps.

    ≈ 0,0034 $/εκτέλεση

  • SeamlessM4TCommunity

    Meta's SeamlessM4T multimodal translation model. Takes speech or text input and produces transcription or translation across about 100 languages, including speech-to-text and speech-to-speech. One model covers ASR plus cross-lingual translation without chaining separate systems.

    ≈ 0,156 $/εκτέλεση

02

Playground

Δοκιμάστε Whisper Large v3 Turbo

Χωρίς φόρμα εισόδου

Προς το παρόν μη διαθέσιμο

Προς το παρόν μη διαθέσιμο: αυτό το μοντέλο έχει απενεργοποιηθεί.

Το playground είναι απενεργοποιημένο. Μπορείτε να βρείτε συγκρίσιμα μοντέλα στην ίδια κατηγορία: Περιήγηση εναλλακτικών λύσεων

03

Σχετικά με το Whisper Large v3 Turbo

ΣύντομαΗμερομηνία: 23 Σεπτεμβρίου 2026

Το Whisper Large v3 Turbo είναι ένα μοντέλο του OpenAI στην κατηγορία Αναγνώριση ομιλίας. Το Whisper Large v3 Turbo δεν είναι διαθέσιμο στο Railwail αυτή τη στιγμή.

Φόντο

Σχετικά με OpenAI

Ιδρύθηκε 2015 · San Francisco, California, USA

OpenAI was founded in December 2015 by Sam Altman, Elon Musk, Greg Brockman, Ilya Sutskever, Wojciech Zaremba and John Schulman, restructured to capped-profit OpenAI LP in 2019. Whisper Large v3 Turbo was released in October 2024 as a distilled fast variant of Whisper Large v3, designed to deliver approximately 8x faster inference at near-identical accuracy by reducing the decoder depth from 32 to 4 layers. The release was led by the original Whisper authors (Alec Radford, Jong Wook Kim, Tao Xu) and remained under the MIT licence. Turbo was distributed via GitHub, the Hugging Face Hub and the OpenAI Whisper API as the new default model where supported, replacing many in-production deployments of Whisper Large v3 within weeks of launch.

Επισκεφθείτε OpenAI

Αρχιτεκτονική

Distilled encoder-decoder Transformer (4-layer decoder) for speech recognition

Whisper Large v3 Turbo is a distilled variant of Whisper Large v3 that keeps the same 32-layer audio encoder and 128-mel front-end but shrinks the decoder from 32 to just 4 Transformer layers, taking the total parameter count from 1.55B to 809M. The smaller decoder gives roughly 8x faster inference on long-form audio (and 4-5x faster on short clips) at a WER cost of approximately 0.5-1 percentage points on most benchmarks. The model was distilled on the same multilingual corpus as Large v3 (5 million hours total, of which 4 million are pseudo-labelled) with knowledge-distillation losses from the Large v3 teacher. Translation-to-English capability was deliberately removed to focus capacity on transcription quality. The 30-second sliding window, 99-language coverage and special task tokens are unchanged. Turbo runs in real-time on consumer GPUs (RTX 3060) and at 3-4x real-time on Apple Silicon CPUs via whisper.cpp.

Παράμετροι
809M
Περιεχόμενο
30 tokens

Δυνατότητες

  • 8x faster long-form transcription than Whisper Large v3
  • 99-language transcription with automatic language detection
  • Word-level timestamps preserved
  • Runs in real-time on a single consumer GPU (RTX 3060 / M2 Pro)
  • Half the memory footprint of Large v3 (809M vs 1.55B)
  • Open weights under MIT licence
  • Drop-in replacement for Large v3 in most pipelines
  • Best for: production ASR on commodity hardware, on-premise transcription, batch processing

Εκπαίδευση & άδεια

Distilled from Whisper Large v3 on the same 5-million-hour multilingual audio corpus with knowledge-distillation losses. Translation-to-English data was excluded.

Άδεια: MIT licence for code and weights; commercial use permitted.

Δοκιμές ασφάλειας: Inherits all hallucination and bias caveats from Whisper Large v3; no separate red-team report.

Γνωστοί περιορισμοί

  • No translation-to-English mode (transcription only)
  • WER 0.5-1 pp worse than Large v3 on average
  • Same 30-second hard window requires chunking
  • Same hallucination behaviour on silent / music-only audio
  • No native diarisation
04

Τιμολόγηση

Προς το παρόν μη διαθέσιμο: αυτό το μοντέλο έχει απενεργοποιηθεί. Δεν υπάρχει τιμή για αυτό το μοντέλο αυτή τη στιγμή, επομένως δεν μπορεί να εκτελεστεί.

05

API

Καλέστε το Whisper Large v3 Turbo με το κλειδί Railwail API. Χρησιμοποιήστε αυτό το ID μοντέλου στο αίτημα:

Προς το παρόν μη διαθέσιμο

Το μοντέλο δεν έχει επαληθευμένη τιμή ή είναι απενεργοποιημένο· οι κλήσεις API απορρίπτονται.

06

Προδιαγραφές

ID μοντέλου
whisper-large-v3-turbo
Ανάπτυξη
OpenAI
Είσοδος
Ήχος
Έξοδος
Κείμενο
Μορφές εξόδου
JSON, SRT, VTT
Κύκλος ζωής
Μη διαθέσιμο
Μέγεθος μοντέλου
809M
Άδεια
MIT licence for code and weights; commercial use permitted.
Καταχώρηση καταλόγου ενημερώθηκε
23 Σεπτεμβρίου 2026

Παράμετροι εισόδου

Εισόδους και ρυθμίσεις από το σχήμα εισόδου του μοντέλου. Το παράδειγμα στην ενότητα API δείχνει ποιες από αυτές δέχεται το API.

  • fileΥποχρεωτικό

    URL or upload path to audio file

    Τύπος: Κείμενο
    Προεπιλογή: –
    Επιτρεπόμενες τιμές: –
  • prompt

    Optional context to guide transcription

    Τύπος: Κείμενο
    Προεπιλογή: –
    Επιτρεπόμενες τιμές: Έως 1.000 χαρακτήρες
  • language

    Optional ISO-639-1 language code (e.g. en, de, fr)

    Τύπος: Κείμενο
    Προεπιλογή: –
    Επιτρεπόμενες τιμές: –
  • temperature
    Τύπος: Αριθμός
    Προεπιλογή: 0
    Επιτρεπόμενες τιμές: 0 έως 1
  • response_format
    Τύπος: Επιλογή
    Προεπιλογή: json
    Επιτρεπόμενες τιμές: json, text, srt ή vtt

Ετικέτες

  • openai
  • whisper
  • stt
  • transcription
  • open-weights
  • multilingual
  • per-minute
07

Περιπτώσεις χρήσης

Για τι χρησιμοποιείται

  • Real-time transcription on consumer GPUs
  • Batch transcription of large podcast / lecture archives
  • On-device transcription via whisper.cpp
  • Cost-sensitive production ASR pipelines
  • Edge deployments where bandwidth is limited
08

Συχνές ερωτήσεις

Τι είναι Whisper Large v3 Turbo;

Το Whisper Large v3 Turbo είναι ένα μοντέλο του OpenAI στην κατηγορία Αναγνώριση ομιλίας. Είναι καταχωρημένο στο Railwail αλλά δεν μπορεί να εκτελεστεί αυτή τη στιγμή.

Πόσο κοστίζει το Whisper Large v3 Turbo στο Railwail;

Το Whisper Large v3 Turbo δεν μπορεί να εκτελεστεί στο Railwail αυτή τη στιγμή, επομένως δεν υπάρχει τρέχουσα τιμή. Διαθέσιμες εναλλακτικές λύσεις με τιμές παρατίθενται παρακάτω σε αυτήν τη σελίδα.

Ποιες ρυθμίσεις υποστηρίζει το Whisper Large v3 Turbo;

Σύμφωνα με το σχήμα εισόδου του, το Whisper Large v3 Turbo γνωρίζει αυτές τις παραμέτρους: file, prompt (Έως 1.000 χαρακτήρες), language, temperature (0 έως 1) και response_format (json, text, srt ή vtt).

Πόσο γρήγορο είναι το Whisper Large v3 Turbo;

Δεν υπάρχουν αρκετές μετρημένες εκτελέσεις του Whisper Large v3 Turbo στο Railwail ακόμα για να δηλωθεί ένας χρόνος εκτέλεσης. Εξαρτάται από την είσοδο, τις ρυθμίσεις και το φορτίο στον πάροχο.

Είναι το Whisper Large v3 Turbo καλύτερο από το Incredibly Fast Whisper;

Αυτό εξαρτάται από την εργασία. Το Whisper Large v3 Turbo (OpenAI) και το Incredibly Fast Whisper (Community) είναι και τα δύο μοντέλα στην κατηγορία Αναγνώριση ομιλίας. Η σελίδα σύγκρισης δείχνει τις τιμές και τις προδιαγραφές τους παράλληλα.

Σύγκριση Whisper Large v3 Turbo και Incredibly Fast Whisper

Μπορώ να χρησιμοποιήσω το Whisper Large v3 Turbo τώρα;

Προς το παρόν μη διαθέσιμο: αυτό το μοντέλο έχει απενεργοποιηθεί. Η σελίδα παραμένει ενεργή· διαθέσιμες εναλλακτικές λύσεις από την ίδια κατηγορία παρατίθενται παρακάτω.

Όλα τα μοντέλα μέσω ενός API

Ένα κλειδί API για κάθε μοντέλο στο Railwail. Η χρήση χρεώνεται από προπληρωμένα πιστωτικά, 1 πιστωτικό = 0,01 $.