Whisper Large v3 Turbo

Spracherkennung (STT)Nicht verfügbar
von OpenAIModell-ID: whisper-large-v3-turbo

OpenAI's distilled Whisper Large v3. ~216x realtime, 99+ languages, MIT-licensed weights.

Status
Nicht verfügbar
Eingabe → Ausgabe
Audio → Text
Entwickler
OpenAI
Aktualisiert
23. September 2026

Whisper Large v3 Turbo ist derzeit nicht verfügbar

Derzeit nicht verfügbar: Dieses Modell ist deaktiviert.

Die Angaben auf dieser Seite kannst du weiter nachlesen. Mit einer der verfügbaren Alternativen unten kannst du sofort ein vergleichbares Modell nutzen.

Zu den Alternativen
01

Vergleichbare Modelle

Alle dieser Kategorie
  • Whisper Large v3 wrapped with Hugging Face Transformers optimizations (batched inference, flash attention) for very high throughput. Transcribes hours of audio in minutes on a single GPU. Maintained by Vaibhav Srivastav. Good when you need bulk transcription fast.

    ca. $ 0,0056/Lauf

  • WhisperOpenAI

    OpenAI's Whisper running on Replicate. General-purpose speech recognition trained on 680k hours of multilingual audio. Transcribes and translates 99 languages, robust to accents and background noise, and outputs plain text, segments, or word-level timestamps.

    ca. $ 0,0034/Lauf

  • SeamlessM4TCommunity

    Meta's SeamlessM4T multimodal translation model. Takes speech or text input and produces transcription or translation across about 100 languages, including speech-to-text and speech-to-speech. One model covers ASR plus cross-lingual translation without chaining separate systems.

    ca. $ 0,156/Lauf

02

Playground

Whisper Large v3 Turbo ausprobieren

Keine Eingabemaske

Derzeit nicht verfügbar

Derzeit nicht verfügbar: Dieses Modell ist deaktiviert.

Der Playground ist deaktiviert. Vergleichbare Modelle findest du in derselben Kategorie: Alternativen ansehen

03

Über Whisper Large v3 Turbo

Kurz gesagtStand: 23. September 2026

Whisper Large v3 Turbo ist ein Modell von OpenAI aus der Kategorie Spracherkennung (STT). Über Railwail ist Whisper Large v3 Turbo derzeit nicht verfügbar.

Hintergrund

Über OpenAI

Gegründet 2015 · San Francisco, California, USA

OpenAI was founded in December 2015 by Sam Altman, Elon Musk, Greg Brockman, Ilya Sutskever, Wojciech Zaremba and John Schulman, restructured to capped-profit OpenAI LP in 2019. Whisper Large v3 Turbo was released in October 2024 as a distilled fast variant of Whisper Large v3, designed to deliver approximately 8x faster inference at near-identical accuracy by reducing the decoder depth from 32 to 4 layers. The release was led by the original Whisper authors (Alec Radford, Jong Wook Kim, Tao Xu) and remained under the MIT licence. Turbo was distributed via GitHub, the Hugging Face Hub and the OpenAI Whisper API as the new default model where supported, replacing many in-production deployments of Whisper Large v3 within weeks of launch.

OpenAI besuchen

Architektur

Distilled encoder-decoder Transformer (4-layer decoder) for speech recognition

Whisper Large v3 Turbo is a distilled variant of Whisper Large v3 that keeps the same 32-layer audio encoder and 128-mel front-end but shrinks the decoder from 32 to just 4 Transformer layers, taking the total parameter count from 1.55B to 809M. The smaller decoder gives roughly 8x faster inference on long-form audio (and 4-5x faster on short clips) at a WER cost of approximately 0.5-1 percentage points on most benchmarks. The model was distilled on the same multilingual corpus as Large v3 (5 million hours total, of which 4 million are pseudo-labelled) with knowledge-distillation losses from the Large v3 teacher. Translation-to-English capability was deliberately removed to focus capacity on transcription quality. The 30-second sliding window, 99-language coverage and special task tokens are unchanged. Turbo runs in real-time on consumer GPUs (RTX 3060) and at 3-4x real-time on Apple Silicon CPUs via whisper.cpp.

Parameter
809M
Kontext
30 Token

Funktionen

  • 8x faster long-form transcription than Whisper Large v3
  • 99-language transcription with automatic language detection
  • Word-level timestamps preserved
  • Runs in real-time on a single consumer GPU (RTX 3060 / M2 Pro)
  • Half the memory footprint of Large v3 (809M vs 1.55B)
  • Open weights under MIT licence
  • Drop-in replacement for Large v3 in most pipelines
  • Best for: production ASR on commodity hardware, on-premise transcription, batch processing

Training & Lizenz

Distilled from Whisper Large v3 on the same 5-million-hour multilingual audio corpus with knowledge-distillation losses. Translation-to-English data was excluded.

Lizenz: MIT licence for code and weights; commercial use permitted.

Sicherheitstests: Inherits all hallucination and bias caveats from Whisper Large v3; no separate red-team report.

Bekannte Einschränkungen

  • No translation-to-English mode (transcription only)
  • WER 0.5-1 pp worse than Large v3 on average
  • Same 30-second hard window requires chunking
  • Same hallucination behaviour on silent / music-only audio
  • No native diarisation
04

Preise

Derzeit nicht verfügbar: Dieses Modell ist deaktiviert. Für dieses Modell gibt es derzeit keinen Preis, deshalb lässt es sich nicht ausführen.

05

API

Rufe Whisper Large v3 Turbo mit deinem Railwail-API-Schlüssel auf. Diese Modell-ID gehört in die Anfrage:

Derzeit nicht verfügbar

Das Modell hat keinen geprüften Preis oder ist deaktiviert; API-Aufrufe werden abgelehnt.

06

Spezifikationen

Modell-ID
whisper-large-v3-turbo
Entwickler
OpenAI
Eingabe
Audio
Ausgabe
Text
Ausgabeformate
JSON, SRT, VTT
Lebenszyklus
Nicht verfügbar
Modellgröße
809M
Lizenz
MIT licence for code and weights; commercial use permitted.
Katalogeintrag aktualisiert
23. September 2026

Eingabeparameter

Eingaben und Einstellungen laut Eingabeschema des Modells. Welche davon die API annimmt, zeigt das Beispiel im Abschnitt API.

  • filePflicht

    URL or upload path to audio file

    Typ: Text
    Standard: –
    Erlaubte Werte: –
  • prompt

    Optional context to guide transcription

    Typ: Text
    Standard: –
    Erlaubte Werte: bis 1 000 Zeichen
  • language

    Optional ISO-639-1 language code (e.g. en, de, fr)

    Typ: Text
    Standard: –
    Erlaubte Werte: –
  • temperature
    Typ: Zahl
    Standard: 0
    Erlaubte Werte: 0 bis 1
  • response_format
    Typ: Auswahl
    Standard: json
    Erlaubte Werte: json, text, srt oder vtt

Schlagwörter

  • openai
  • whisper
  • stt
  • transcription
  • open-weights
  • multilingual
  • per-minute
07

Einsatzgebiete

Wofür es genutzt wird

  • Real-time transcription on consumer GPUs
  • Batch transcription of large podcast / lecture archives
  • On-device transcription via whisper.cpp
  • Cost-sensitive production ASR pipelines
  • Edge deployments where bandwidth is limited
08

Häufige Fragen

Was ist Whisper Large v3 Turbo?

Whisper Large v3 Turbo ist ein Modell von OpenAI aus der Kategorie Spracherkennung (STT). Es steht im Railwail-Katalog, lässt sich derzeit aber nicht ausführen.

Was kostet Whisper Large v3 Turbo bei Railwail?

Whisper Large v3 Turbo lässt sich über Railwail derzeit nicht ausführen, deshalb gibt es keinen aktuellen Preis. Verfügbare Alternativen mit Preisen stehen weiter unten auf dieser Seite.

Welche Einstellungen unterstützt Whisper Large v3 Turbo?

Laut Eingabeschema kennt Whisper Large v3 Turbo diese Parameter: file, prompt (bis 1 000 Zeichen), language, temperature (0 bis 1) und response_format (json, text, srt oder vtt).

Wie schnell ist Whisper Large v3 Turbo?

Für Whisper Large v3 Turbo gibt es bei Railwail noch zu wenige gemessene Läufe, um eine Laufzeit anzugeben. Sie hängt von der Eingabe, den Einstellungen und der Auslastung beim Anbieter ab.

Ist Whisper Large v3 Turbo besser als Incredibly Fast Whisper?

Das hängt von der Aufgabe ab. Whisper Large v3 Turbo (OpenAI) und Incredibly Fast Whisper (Community) sind beide Modelle aus der Kategorie Spracherkennung (STT). Die Vergleichsseite zeigt Preise und Spezifikationen nebeneinander.

Whisper Large v3 Turbo und Incredibly Fast Whisper vergleichen

Kann ich Whisper Large v3 Turbo gerade nutzen?

Derzeit nicht verfügbar: Dieses Modell ist deaktiviert. Die Seite bleibt online; verfügbare Alternativen aus derselben Kategorie stehen weiter unten.

Alle Modelle über eine API

Ein API-Schlüssel für alle Modelle auf Railwail. Abgerechnet wird über vorab gekaufte Credits, 1 Credit = $ 0,01.