Whisper Large v3 Turbo

Beszédfelismerés (STT)Nem elérhető
OpenAI általModell-azonosító: whisper-large-v3-turbo

OpenAI's distilled Whisper Large v3. ~216x realtime, 99+ languages, MIT-licensed weights.

Állapot
Nem elérhető
Bemenet → kimenet
Hang → Szöveg
Fejlesztő
OpenAI
Frissítve
2026. szeptember 23.

Whisper Large v3 Turbo jelenleg nem elérhető

Jelenleg nem elérhető: ezt a modellt deaktiválták.

Az oldal részleteit továbbra is elolvashatja. Az alábbi elérhető alternatívák közül válasszon egy hasonló modell azonnali futtatásához.

Ugrás az alternatívákhoz
01
  • Whisper Large v3 wrapped with Hugging Face Transformers optimizations (batched inference, flash attention) for very high throughput. Transcribes hours of audio in minutes on a single GPU. Maintained by Vaibhav Srivastav. Good when you need bulk transcription fast.

    ≈ 0,0056 USD/futás

  • WhisperOpenAI

    OpenAI's Whisper running on Replicate. General-purpose speech recognition trained on 680k hours of multilingual audio. Transcribes and translates 99 languages, robust to accents and background noise, and outputs plain text, segments, or word-level timestamps.

    ≈ 0,0034 USD/futás

  • SeamlessM4TCommunity

    Meta's SeamlessM4T multimodal translation model. Takes speech or text input and produces transcription or translation across about 100 languages, including speech-to-text and speech-to-speech. One model covers ASR plus cross-lingual translation without chaining separate systems.

    ≈ 0,156 USD/futás

02

Playground

Próbáld ki: Whisper Large v3 Turbo

Nincs beviteli forma

Jelenleg nem elérhető

Jelenleg nem elérhető: ezt a modellt deaktiválták.

A játszótér letiltva van. Hasonló modelleket találsz ugyanabban a kategóriában: Alternatívák megtekintése

03

A Whisper Large v3 Turbo névjegye

Röviden2026. szeptember 23. szerint

A Whisper Large v3 Turbo a OpenAI által fejlesztett modell a Beszédfelismerés (STT) kategóriában. A Whisper Large v3 Turbo jelenleg nem érhető el a Railwail-en.

Háttér

A OpenAI névjegye

Alapítva: 2015 · San Francisco, California, USA

OpenAI was founded in December 2015 by Sam Altman, Elon Musk, Greg Brockman, Ilya Sutskever, Wojciech Zaremba and John Schulman, restructured to capped-profit OpenAI LP in 2019. Whisper Large v3 Turbo was released in October 2024 as a distilled fast variant of Whisper Large v3, designed to deliver approximately 8x faster inference at near-identical accuracy by reducing the decoder depth from 32 to 4 layers. The release was led by the original Whisper authors (Alec Radford, Jong Wook Kim, Tao Xu) and remained under the MIT licence. Turbo was distributed via GitHub, the Hugging Face Hub and the OpenAI Whisper API as the new default model where supported, replacing many in-production deployments of Whisper Large v3 within weeks of launch.

OpenAI meglátogatása

Architektúra

Distilled encoder-decoder Transformer (4-layer decoder) for speech recognition

Whisper Large v3 Turbo is a distilled variant of Whisper Large v3 that keeps the same 32-layer audio encoder and 128-mel front-end but shrinks the decoder from 32 to just 4 Transformer layers, taking the total parameter count from 1.55B to 809M. The smaller decoder gives roughly 8x faster inference on long-form audio (and 4-5x faster on short clips) at a WER cost of approximately 0.5-1 percentage points on most benchmarks. The model was distilled on the same multilingual corpus as Large v3 (5 million hours total, of which 4 million are pseudo-labelled) with knowledge-distillation losses from the Large v3 teacher. Translation-to-English capability was deliberately removed to focus capacity on transcription quality. The 30-second sliding window, 99-language coverage and special task tokens are unchanged. Turbo runs in real-time on consumer GPUs (RTX 3060) and at 3-4x real-time on Apple Silicon CPUs via whisper.cpp.

Paraméterek
809M
Kontextus
30 token

Képességek

  • 8x faster long-form transcription than Whisper Large v3
  • 99-language transcription with automatic language detection
  • Word-level timestamps preserved
  • Runs in real-time on a single consumer GPU (RTX 3060 / M2 Pro)
  • Half the memory footprint of Large v3 (809M vs 1.55B)
  • Open weights under MIT licence
  • Drop-in replacement for Large v3 in most pipelines
  • Best for: production ASR on commodity hardware, on-premise transcription, batch processing

Képzés és licenc

Distilled from Whisper Large v3 on the same 5-million-hour multilingual audio corpus with knowledge-distillation losses. Translation-to-English data was excluded.

Licenc: MIT licence for code and weights; commercial use permitted.

Biztonsági tesztelés: Inherits all hallucination and bias caveats from Whisper Large v3; no separate red-team report.

Ismert korlátozások

  • No translation-to-English mode (transcription only)
  • WER 0.5-1 pp worse than Large v3 on average
  • Same 30-second hard window requires chunking
  • Same hallucination behaviour on silent / music-only audio
  • No native diarisation
04

Árak

Jelenleg nem elérhető: ezt a modellt deaktiválták. Jelenleg nincs ár ehhez a modellhez, ezért nem futtatható.

05

API

Hívja meg a Whisper Large v3 Turbo modellt a Railwail API-kulcsával. Használja ezt a modell-azonosítót a kérésben:

Jelenleg nem elérhető

A modellnek nincs ellenőrzött ára vagy deaktiválva van; az API-hívások visszautasítottak.

06

Specifikációk

Modell-azonosító
whisper-large-v3-turbo
Fejlesztő
OpenAI
Bemenet
Hang
Kimenet
Szöveg
Kimeneti formátumok
JSON, SRT, VTT
Életciklus
Nem elérhető
Modell mérete
809M
Licenc
MIT licence for code and weights; commercial use permitted.
Katalógus bejegyzés frissítve
2026. szeptember 23.

Bemeneti paraméterek

A modell bemeneti sémájából származó bemenetek és beállítások. Az API szakaszban szereplő példa mutatja, hogy az API melyiket fogadja el.

  • filekötelező

    URL or upload path to audio file

    Típus: Szöveg
    Alapértelmezett: –
    Engedélyezett értékek: –
  • prompt

    Optional context to guide transcription

    Típus: Szöveg
    Alapértelmezett: –
    Engedélyezett értékek: legfeljebb 1000 karakter
  • language

    Optional ISO-639-1 language code (e.g. en, de, fr)

    Típus: Szöveg
    Alapértelmezett: –
    Engedélyezett értékek: –
  • temperature
    Típus: Szám
    Alapértelmezett: 0
    Engedélyezett értékek: 0 és 1 között
  • response_format
    Típus: Választás
    Alapértelmezett: json
    Engedélyezett értékek: json, text, srt vagy vtt

Címkék

  • openai
  • whisper
  • stt
  • transcription
  • open-weights
  • multilingual
  • per-minute
07

Felhasználási esetek

Mire használják

  • Real-time transcription on consumer GPUs
  • Batch transcription of large podcast / lecture archives
  • On-device transcription via whisper.cpp
  • Cost-sensitive production ASR pipelines
  • Edge deployments where bandwidth is limited
08

Gyakran ismételt kérdések

Mi az a Whisper Large v3 Turbo?

A Whisper Large v3 Turbo a OpenAI által fejlesztett modell a Beszédfelismerés (STT) kategóriában. A Railwail katalógusában szerepel, de jelenleg nem futtatható.

Mennyibe kerül a Whisper Large v3 Turbo a Railwail-on?

A Whisper Large v3 Turbo jelenleg nem futtatható a Railwail-on, ezért nincs aktuális ár. Az elérhető alternatívák árakkal az oldal alább találhatók.

Milyen beállításokat támogat a Whisper Large v3 Turbo?

A bemeneti séma szerint a Whisper Large v3 Turbo ezeket a paramétereket ismeri: file, prompt (legfeljebb 1000 karakter), language, temperature (0 és 1 között) és response_format (json, text, srt vagy vtt).

Milyen gyors a Whisper Large v3 Turbo?

A Whisper Large v3 Turbo-nek még nincs elég mért futtatása a Railwail-on ahhoz, hogy futási időt adjunk meg. Ez a bemenettől, a beállításoktól és a szolgáltató terhelésétől függ.

A Whisper Large v3 Turbo jobb, mint a Incredibly Fast Whisper?

Ez a feladattól függ. A Whisper Large v3 Turbo (OpenAI) és a Incredibly Fast Whisper (Community) egyaránt modellek a Beszédfelismerés (STT) kategóriában. Az összehasonlítás oldal az árakat és specifikációkat egymás mellett mutatja.

Whisper Large v3 Turbo és Incredibly Fast Whisper összehasonlítása

Használhatom a Whisper Large v3 Turbo-t most?

Jelenleg nem elérhető: ezt a modellt deaktiválták. Az oldal online marad; az ugyanabból a kategóriából elérhető alternatívák az oldal alább találhatók.

Összes modell egy API-n keresztül

Egy API-kulcs a Railwail összes modelljéhez. A használat előre feltöltött kreditek alapján kerül felszámításra, 1 kredit = 0,01 USD.