Whisper Large v3 Turbo

Reconnaissance vocaleNon disponible
par OpenAIID du modèle: whisper-large-v3-turbo

OpenAI's distilled Whisper Large v3. ~216x realtime, 99+ languages, MIT-licensed weights.

Statut
Non disponible
Entrée → Sortie
Audio → Texte
Développeur
OpenAI
Mis à jour
23 septembre 2026

Whisper Large v3 Turbo n'est actuellement pas disponible

Actuellement indisponible : ce modèle a été désactivé.

Vous pouvez toujours consulter les détails sur cette page. Choisissez l'une des alternatives disponibles ci-dessous pour exécuter immédiatement un modèle comparable.

Voir les alternatives
01

Modèles comparables

Tous dans cette catégorie
  • Whisper Large v3 wrapped with Hugging Face Transformers optimizations (batched inference, flash attention) for very high throughput. Transcribes hours of audio in minutes on a single GPU. Maintained by Vaibhav Srivastav. Good when you need bulk transcription fast.

    ≈ 0,0056 $US/exécution

  • WhisperOpenAI

    OpenAI's Whisper running on Replicate. General-purpose speech recognition trained on 680k hours of multilingual audio. Transcribes and translates 99 languages, robust to accents and background noise, and outputs plain text, segments, or word-level timestamps.

    ≈ 0,0034 $US/exécution

  • SeamlessM4TCommunity

    Meta's SeamlessM4T multimodal translation model. Takes speech or text input and produces transcription or translation across about 100 languages, including speech-to-text and speech-to-speech. One model covers ASR plus cross-lingual translation without chaining separate systems.

    ≈ 0,156 $US/exécution

02

Playground

Essayer Whisper Large v3 Turbo

Pas de formulaire d'entrée

Actuellement indisponible

Actuellement indisponible : ce modèle a été désactivé.

Le terrain de jeu est désactivé. Vous pouvez trouver des modèles comparables dans la même catégorie : Parcourir les alternatives

03

À propos de Whisper Large v3 Turbo

RésuméAu 23 septembre 2026

Whisper Large v3 Turbo est un modèle de OpenAI dans la catégorie Reconnaissance vocale. Whisper Large v3 Turbo n'est actuellement pas disponible sur Railwail.

Arrière-plan

À propos de OpenAI

Fondée 2015 · San Francisco, California, USA

OpenAI was founded in December 2015 by Sam Altman, Elon Musk, Greg Brockman, Ilya Sutskever, Wojciech Zaremba and John Schulman, restructured to capped-profit OpenAI LP in 2019. Whisper Large v3 Turbo was released in October 2024 as a distilled fast variant of Whisper Large v3, designed to deliver approximately 8x faster inference at near-identical accuracy by reducing the decoder depth from 32 to 4 layers. The release was led by the original Whisper authors (Alec Radford, Jong Wook Kim, Tao Xu) and remained under the MIT licence. Turbo was distributed via GitHub, the Hugging Face Hub and the OpenAI Whisper API as the new default model where supported, replacing many in-production deployments of Whisper Large v3 within weeks of launch.

Visiter OpenAI

Architecture

Distilled encoder-decoder Transformer (4-layer decoder) for speech recognition

Whisper Large v3 Turbo is a distilled variant of Whisper Large v3 that keeps the same 32-layer audio encoder and 128-mel front-end but shrinks the decoder from 32 to just 4 Transformer layers, taking the total parameter count from 1.55B to 809M. The smaller decoder gives roughly 8x faster inference on long-form audio (and 4-5x faster on short clips) at a WER cost of approximately 0.5-1 percentage points on most benchmarks. The model was distilled on the same multilingual corpus as Large v3 (5 million hours total, of which 4 million are pseudo-labelled) with knowledge-distillation losses from the Large v3 teacher. Translation-to-English capability was deliberately removed to focus capacity on transcription quality. The 30-second sliding window, 99-language coverage and special task tokens are unchanged. Turbo runs in real-time on consumer GPUs (RTX 3060) and at 3-4x real-time on Apple Silicon CPUs via whisper.cpp.

Paramètres
809M
Contexte
30 tokens

Capacités

  • 8x faster long-form transcription than Whisper Large v3
  • 99-language transcription with automatic language detection
  • Word-level timestamps preserved
  • Runs in real-time on a single consumer GPU (RTX 3060 / M2 Pro)
  • Half the memory footprint of Large v3 (809M vs 1.55B)
  • Open weights under MIT licence
  • Drop-in replacement for Large v3 in most pipelines
  • Best for: production ASR on commodity hardware, on-premise transcription, batch processing

Entraînement et licence

Distilled from Whisper Large v3 on the same 5-million-hour multilingual audio corpus with knowledge-distillation losses. Translation-to-English data was excluded.

Licence: MIT licence for code and weights; commercial use permitted.

Tests de sécurité: Inherits all hallucination and bias caveats from Whisper Large v3; no separate red-team report.

Limitations connues

  • No translation-to-English mode (transcription only)
  • WER 0.5-1 pp worse than Large v3 on average
  • Same 30-second hard window requires chunking
  • Same hallucination behaviour on silent / music-only audio
  • No native diarisation
04

Tarification

Actuellement indisponible : ce modèle a été désactivé. Il n'y a pas de prix pour ce modèle pour le moment, il ne peut donc pas être exécuté.

05

API

Appelez Whisper Large v3 Turbo avec votre clé API Railwail. Utilisez cet ID de modèle dans la requête :

Actuellement indisponible

Le modèle n'a pas de prix vérifié ou est désactivé ; les appels API sont refusés.

06

Spécifications

ID du modèle
whisper-large-v3-turbo
Développeur
OpenAI
Entrée
Audio
Sortie
Texte
Formats de sortie
JSON, SRT, VTT
Cycle de vie
Non disponible
Taille du modèle
809M
Licence
MIT licence for code and weights; commercial use permitted.
Entrée du catalogue mise à jour
23 septembre 2026

Paramètres d'entrée

Entrées et paramètres du schéma d'entrée du modèle. L'exemple dans la section API montre lesquels l'API accepte.

  • fileObligatoire

    URL or upload path to audio file

    Type: Texte
    Par défaut: –
    Valeurs autorisées: –
  • prompt

    Optional context to guide transcription

    Type: Texte
    Par défaut: –
    Valeurs autorisées: Jusqu'à 1 000 caractères
  • language

    Optional ISO-639-1 language code (e.g. en, de, fr)

    Type: Texte
    Par défaut: –
    Valeurs autorisées: –
  • temperature
    Type: Nombre
    Par défaut: 0
    Valeurs autorisées: 0 à 1
  • response_format
    Type: Choix
    Par défaut: json
    Valeurs autorisées: json, text, srt ou vtt

Étiquettes

  • openai
  • whisper
  • stt
  • transcription
  • open-weights
  • multilingual
  • per-minute
07

Cas d'usage

À quoi ça sert

  • Real-time transcription on consumer GPUs
  • Batch transcription of large podcast / lecture archives
  • On-device transcription via whisper.cpp
  • Cost-sensitive production ASR pipelines
  • Edge deployments where bandwidth is limited
08

Questions fréquemment posées

Qu'est-ce que Whisper Large v3 Turbo ?

Whisper Large v3 Turbo est un modèle de OpenAI dans la catégorie Reconnaissance vocale. Il est listé sur Railwail mais ne peut pas être exécuté pour le moment.

Combien coûte Whisper Large v3 Turbo sur Railwail ?

Whisper Large v3 Turbo ne peut pas être exécuté sur Railwail pour le moment, il n'y a donc pas de prix actuel. Les alternatives disponibles avec leurs prix sont listées plus bas sur cette page.

Quels paramètres Whisper Large v3 Turbo supporte-t-il ?

Selon son schéma d'entrée, Whisper Large v3 Turbo connaît ces paramètres : file, prompt (Jusqu'à 1 000 caractères), language, temperature (0 à 1) et response_format (json, text, srt ou vtt).

Quelle est la vitesse de Whisper Large v3 Turbo ?

Il n'y a pas encore assez d'exécutions mesurées de Whisper Large v3 Turbo sur Railwail pour indiquer un temps d'exécution. Cela dépend de l'entrée, des paramètres et de la charge chez le fournisseur.

Whisper Large v3 Turbo est-il meilleur que Incredibly Fast Whisper ?

Cela dépend de la tâche. Whisper Large v3 Turbo (OpenAI) et Incredibly Fast Whisper (Community) sont tous deux des modèles de la catégorie Reconnaissance vocale. La page de comparaison affiche leurs prix et spécifications côte à côte.

Comparer Whisper Large v3 Turbo et Incredibly Fast Whisper

Puis-je utiliser Whisper Large v3 Turbo maintenant ?

Actuellement indisponible : ce modèle a été désactivé. La page reste en ligne ; les alternatives disponibles de la même catégorie sont listées plus bas.

Tous les modèles via une API

Une clé API pour tous les modèles sur Railwail. L'utilisation est facturée à partir de crédits prépayés, 1 crédit = 0,01 $US.