Whisper Large v3 Turbo

Reconocimiento de vozNo disponible
de OpenAIID del modelo: whisper-large-v3-turbo

OpenAI's distilled Whisper Large v3. ~216x realtime, 99+ languages, MIT-licensed weights.

Estado
No disponible
Entrada → Salida
Audio → Texto
Desarrollador
OpenAI
Actualizado
23 de septiembre de 2026

Whisper Large v3 Turbo no está disponible en este momento

Actualmente no disponible: este modelo ha sido desactivado.

Puedes seguir leyendo los detalles en esta página. Elige una de las alternativas disponibles abajo para ejecutar un modelo comparable de inmediato.

Ir a alternativas
01

Modelos comparables

Todos en esta categoría
  • Whisper Large v3 wrapped with Hugging Face Transformers optimizations (batched inference, flash attention) for very high throughput. Transcribes hours of audio in minutes on a single GPU. Maintained by Vaibhav Srivastav. Good when you need bulk transcription fast.

    ≈ USD 0.0056/ejecución

  • WhisperOpenAI

    OpenAI's Whisper running on Replicate. General-purpose speech recognition trained on 680k hours of multilingual audio. Transcribes and translates 99 languages, robust to accents and background noise, and outputs plain text, segments, or word-level timestamps.

    ≈ USD 0.0034/ejecución

  • SeamlessM4TCommunity

    Meta's SeamlessM4T multimodal translation model. Takes speech or text input and produces transcription or translation across about 100 languages, including speech-to-text and speech-to-speech. One model covers ASR plus cross-lingual translation without chaining separate systems.

    ≈ USD 0.156/ejecución

02

Playground

Probar Whisper Large v3 Turbo

Sin formulario de entrada

No disponible actualmente

Actualmente no disponible: este modelo ha sido desactivado.

El área de pruebas está desactivada. Encuentra modelos comparables en la misma categoría: Explorar alternativas

03

Acerca de Whisper Large v3 Turbo

ResumenA partir de 23 de septiembre de 2026

Whisper Large v3 Turbo es un modelo de OpenAI en la categoría Reconocimiento de voz. Whisper Large v3 Turbo no está disponible en Railwail en este momento.

Fondo

Acerca de OpenAI

Fundado en 2015 · San Francisco, California, USA

OpenAI was founded in December 2015 by Sam Altman, Elon Musk, Greg Brockman, Ilya Sutskever, Wojciech Zaremba and John Schulman, restructured to capped-profit OpenAI LP in 2019. Whisper Large v3 Turbo was released in October 2024 as a distilled fast variant of Whisper Large v3, designed to deliver approximately 8x faster inference at near-identical accuracy by reducing the decoder depth from 32 to 4 layers. The release was led by the original Whisper authors (Alec Radford, Jong Wook Kim, Tao Xu) and remained under the MIT licence. Turbo was distributed via GitHub, the Hugging Face Hub and the OpenAI Whisper API as the new default model where supported, replacing many in-production deployments of Whisper Large v3 within weeks of launch.

Visitar OpenAI

Arquitectura

Distilled encoder-decoder Transformer (4-layer decoder) for speech recognition

Whisper Large v3 Turbo is a distilled variant of Whisper Large v3 that keeps the same 32-layer audio encoder and 128-mel front-end but shrinks the decoder from 32 to just 4 Transformer layers, taking the total parameter count from 1.55B to 809M. The smaller decoder gives roughly 8x faster inference on long-form audio (and 4-5x faster on short clips) at a WER cost of approximately 0.5-1 percentage points on most benchmarks. The model was distilled on the same multilingual corpus as Large v3 (5 million hours total, of which 4 million are pseudo-labelled) with knowledge-distillation losses from the Large v3 teacher. Translation-to-English capability was deliberately removed to focus capacity on transcription quality. The 30-second sliding window, 99-language coverage and special task tokens are unchanged. Turbo runs in real-time on consumer GPUs (RTX 3060) and at 3-4x real-time on Apple Silicon CPUs via whisper.cpp.

Parámetros
809M
Contexto
30 tokens

Capacidades

  • 8x faster long-form transcription than Whisper Large v3
  • 99-language transcription with automatic language detection
  • Word-level timestamps preserved
  • Runs in real-time on a single consumer GPU (RTX 3060 / M2 Pro)
  • Half the memory footprint of Large v3 (809M vs 1.55B)
  • Open weights under MIT licence
  • Drop-in replacement for Large v3 in most pipelines
  • Best for: production ASR on commodity hardware, on-premise transcription, batch processing

Entrenamiento y licencia

Distilled from Whisper Large v3 on the same 5-million-hour multilingual audio corpus with knowledge-distillation losses. Translation-to-English data was excluded.

Licencia: MIT licence for code and weights; commercial use permitted.

Pruebas de seguridad: Inherits all hallucination and bias caveats from Whisper Large v3; no separate red-team report.

Limitaciones conocidas

  • No translation-to-English mode (transcription only)
  • WER 0.5-1 pp worse than Large v3 on average
  • Same 30-second hard window requires chunking
  • Same hallucination behaviour on silent / music-only audio
  • No native diarisation
04

Precios

Actualmente no disponible: este modelo ha sido desactivado. No hay precio para este modelo en este momento, por lo que no se puede ejecutar.

05

API

Llama a Whisper Large v3 Turbo con tu clave de API de Railwail. Usa este ID de modelo en la solicitud:

Actualmente no disponible

El modelo no tiene un precio verificado o está desactivado; las llamadas a la API se rechazan.

06

Especificaciones

ID del modelo
whisper-large-v3-turbo
Desarrollador
OpenAI
Entrada
Audio
Salida
Texto
Formatos de salida
JSON, SRT, VTT
Ciclo de vida
No disponible
Tamaño del modelo
809M
Licencia
MIT licence for code and weights; commercial use permitted.
Entrada del catálogo actualizada
23 de septiembre de 2026

Parámetros de entrada

Entradas y configuraciones del esquema de entrada del modelo. El ejemplo en la sección API muestra cuáles de ellas acepta la API.

  • filerequerido

    URL or upload path to audio file

    Tipo: Texto
    Predeterminado: –
    Valores permitidos: –
  • prompt

    Optional context to guide transcription

    Tipo: Texto
    Predeterminado: –
    Valores permitidos: hasta 1,000 caracteres
  • language

    Optional ISO-639-1 language code (e.g. en, de, fr)

    Tipo: Texto
    Predeterminado: –
    Valores permitidos: –
  • temperature
    Tipo: Número
    Predeterminado: 0
    Valores permitidos: 0 a 1
  • response_format
    Tipo: Opción
    Predeterminado: json
    Valores permitidos: json, text, srt o vtt

Etiquetas

  • openai
  • whisper
  • stt
  • transcription
  • open-weights
  • multilingual
  • per-minute
07

Casos de uso

Para qué se utiliza

  • Real-time transcription on consumer GPUs
  • Batch transcription of large podcast / lecture archives
  • On-device transcription via whisper.cpp
  • Cost-sensitive production ASR pipelines
  • Edge deployments where bandwidth is limited
08

Preguntas frecuentes

¿Qué es Whisper Large v3 Turbo?

Whisper Large v3 Turbo es un modelo de OpenAI en la categoría Reconocimiento de voz. Está listado en Railwail pero no se puede ejecutar en este momento.

¿Cuánto cuesta Whisper Large v3 Turbo en Railwail?

Whisper Large v3 Turbo no se puede ejecutar en Railwail en este momento, por lo que no hay precio actual. Las alternativas disponibles con precios se enumeran más abajo en esta página.

¿Qué configuraciones admite Whisper Large v3 Turbo?

Según su esquema de entrada, Whisper Large v3 Turbo conoce estos parámetros: file, prompt (hasta 1,000 caracteres), language, temperature (0 a 1) y response_format (json, text, srt o vtt).

¿Qué tan rápido es Whisper Large v3 Turbo?

Aún no hay suficientes ejecuciones medidas de Whisper Large v3 Turbo en Railwail para indicar un tiempo de ejecución. Depende de la entrada, la configuración y la carga en el proveedor.

¿Es Whisper Large v3 Turbo mejor que Incredibly Fast Whisper?

Eso depende de la tarea. Whisper Large v3 Turbo (OpenAI) y Incredibly Fast Whisper (Community) son ambos modelos en la categoría Reconocimiento de voz. La página de comparación muestra sus precios y especificaciones lado a lado.

Comparar Whisper Large v3 Turbo y Incredibly Fast Whisper

¿Puedo usar Whisper Large v3 Turbo ahora mismo?

Actualmente no disponible: este modelo ha sido desactivado. La página permanece en línea; las alternativas disponibles de la misma categoría se enumeran más abajo.

Todos los modelos a través de una API

Una clave API para todos los modelos en Railwail. El uso se cobra con créditos prepagados, 1 crédito = USD 0.01.