SeamlessM4T v2 Large (Speech)

Reconocimiento de vozDisponible
de CommunityID del modelo: seamlessm4t-v2-large-speech

Meta SeamlessM4T v2 Large speech mode. Speech-to-speech, speech-to-text, and text-to-speech translation across 100+ languages in a single unified model.

Precio
≈ USD 0.0012/ejecución
Entrada → Salida
Audio → Texto
Desarrollador
Community
Actualizado
23 de septiembre de 2026
01

Playground

Probar SeamlessM4T v2 Large (Speech)

Sin formulario de entrada

≈ USD 0.0012/ejecución

Aún no hay formulario de entrada para este modelo

Sus entradas aún no están documentadas. Para evitar errores por entradas incorrectas, no ofrecemos un formulario aquí. Elige un modelo comparable en su lugar.

02

Examples

Real outputs from the public examples of this model on Replicate, with the prompt and settings that produced them. They were not generated live on this page.
03

Acerca de SeamlessM4T v2 Large (Speech)

ResumenA partir de 23 de septiembre de 2026

SeamlessM4T v2 Large (Speech) es un modelo de Community en la categoría Reconocimiento de voz. En Railwail, SeamlessM4T v2 Large (Speech) cuesta ≈ USD 0.0012 por ejecución.

04

Precios

Precios en dólares estadounidenses. El uso se cobra con créditos prepagados.
Ejecución típica (≈ 1 s en L40S)USD 0.0012 por ejecución
Tiempo de GPU (L40S)USD 0.00117 por segundo de GPU
  • Se factura por el tiempo de GPU que realmente toma la ejecución. Cuando comienza la ejecución, se reserva 3× el precio típico de tu saldo y se liquida después.
  • 1 crédito = USD 0.01

Calculadora de costos

Calculadora de precios

s

Típico según el proveedor: aprox. 1 s

Total

USD 0.12

12 créditos

Por ejecución

USD 0.0012 · 0.12 créditos

Se factura el tiempo real de GPU; este es un estimado.

05

API

Llama a SeamlessM4T v2 Large (Speech) con tu clave de API de Railwail. Usa este ID de modelo en la solicitud:

Sin ejemplo de API verificado

Las entradas de este modelo aún no están documentadas.

06

Especificaciones

ID del modelo
seamlessm4t-v2-large-speech
Desarrollador
Community
Entrada
Audio
Salida
Texto
Facturación
Por uso (tokens o tiempo de GPU)
Entrada del catálogo actualizada
23 de septiembre de 2026

Etiquetas

  • replicate
  • translation
  • meta
  • open-weights
  • speech-to-speech
  • transcription
  • seamless
07

Casos de uso

08

Preguntas frecuentes

¿Qué es SeamlessM4T v2 Large (Speech)?

SeamlessM4T v2 Large (Speech) es un modelo de Community en la categoría Reconocimiento de voz.

¿Cuánto cuesta SeamlessM4T v2 Large (Speech) en Railwail?

En Railwail, SeamlessM4T v2 Large (Speech) cuesta ≈ USD 0.0012 por ejecución. Se te cobra por lo que cada solicitud realmente usa. El uso se paga con créditos prepagados; 1 crédito equivale a USD 0.01.

¿Qué tan rápido es SeamlessM4T v2 Large (Speech)?

Aún no hay suficientes ejecuciones medidas de SeamlessM4T v2 Large (Speech) en Railwail para indicar un tiempo de ejecución. Depende de la entrada, la configuración y la carga en el proveedor.

¿Es SeamlessM4T v2 Large (Speech) mejor que Incredibly Fast Whisper?

Eso depende de la tarea. SeamlessM4T v2 Large (Speech) (Community) y Incredibly Fast Whisper (Community) son ambos modelos en la categoría Reconocimiento de voz. La página de comparación muestra sus precios y especificaciones lado a lado.

Comparar SeamlessM4T v2 Large (Speech) y Incredibly Fast Whisper
09

Modelos comparables

Todos en esta categoría
  • Whisper Large v3 wrapped with Hugging Face Transformers optimizations (batched inference, flash attention) for very high throughput. Transcribes hours of audio in minutes on a single GPU. Maintained by Vaibhav Srivastav. Good when you need bulk transcription fast.

    ≈ USD 0.0056/ejecución

    367 % más caro por unidad

    Comparar SeamlessM4T v2 Large (Speech) vs. Incredibly Fast Whisper
  • WhisperOpenAI

    OpenAI's Whisper running on Replicate. General-purpose speech recognition trained on 680k hours of multilingual audio. Transcribes and translates 99 languages, robust to accents and background noise, and outputs plain text, segments, or word-level timestamps.

    ≈ USD 0.0034/ejecución

    183 % más caro por unidad

    Comparar SeamlessM4T v2 Large (Speech) vs. Whisper
  • SeamlessM4TCommunity

    Meta's SeamlessM4T multimodal translation model. Takes speech or text input and produces transcription or translation across about 100 languages, including speech-to-text and speech-to-speech. One model covers ASR plus cross-lingual translation without chaining separate systems.

    ≈ USD 0.156/ejecución

    12,900 % más caro por unidad

    Comparar SeamlessM4T v2 Large (Speech) vs. SeamlessM4T

Todos los modelos a través de una API

Una clave API para todos los modelos en Railwail. El uso se cobra con créditos prepagados, 1 crédito = USD 0.01.