LLaVA-OneVision 72B

MultimodalNo disponible
de ReplicateID del modelo: llava-onevision-72b

LMMs-Lab LLaVA-OneVision 72B. Unified single-image, multi-image and video instruction-tuned VLM with task-transfer across modalities.

Estado
No disponible
Contexto
32,768 tokens
Salida máxima
4,096 tokens
Entrada → Salida
Texto + Imagen + Video → Texto
Desarrollador
Replicate
Actualizado
25 de junio de 2026

LLaVA-OneVision 72B no está disponible en este momento

Actualmente no disponible: este modelo ha sido desactivado.

Puedes seguir leyendo los detalles en esta página. Elige una de las alternativas disponibles abajo para ejecutar un modelo comparable de inmediato.

Ir a alternativas
01

Modelos comparables

Todos en esta categoría
  • BLIPSalesforce

    Salesforce BLIP. Vision-language model for image captioning and visual question answering. Given an image it writes a short natural-language caption, or answers a question about the image when one is supplied. A widely used baseline for automatic captioning.

    ≈ USD 0.00030/ejecución

  • Anthropic's April 2026 flagship. 87.6% on SWE-bench Verified, 3x higher image resolution, output self-verification, vision + reasoning.

    USD 6.00/1M entrada

  • Anthropic's balanced mid-tier model from February 2026. Best price/performance for production workloads: 5x cheaper than Opus, near-flagship quality.

    USD 3.60/1M entrada

02

Playground

Probar LLaVA-OneVision 72B

Entrada y salida

No disponible actualmente

Actualmente no disponible: este modelo ha sido desactivado.

El área de pruebas está desactivada. Encuentra modelos comparables en la misma categoría: Explorar alternativas

Probar LLaVA-OneVision 72B

0 / 16,000

Configuración avanzada (4)

0 / 8,000

Resultado
La respuesta aparece aquí.

Esta ejecución

Sin precio – actualmente no disponible.

¿Nuevo aquí?

5 créditos gratis (USD 0.05) cuando te registras con Google

Utilizable 24 horas después del registro, hasta 5 ejecuciones por día y como máximo 2 créditos por ejecución. Otros métodos de inicio de sesión comienzan sin créditos.

03

Acerca de LLaVA-OneVision 72B

ResumenA partir de 25 de junio de 2026

LLaVA-OneVision 72B es un modelo de Replicate en la categoría Multimodal. LLaVA-OneVision 72B no está disponible en Railwail en este momento. La ventana de contexto contiene 32,768 tokens, y una respuesta puede tener hasta 4,096 tokens.

04

Precios

Actualmente no disponible: este modelo ha sido desactivado. No hay precio para este modelo en este momento, por lo que no se puede ejecutar.

05

API

Llama a LLaVA-OneVision 72B con tu clave de API de Railwail. Usa este ID de modelo en la solicitud:

Sin ejemplo de API verificado

La API pública pasa un formato de entrada diferente al que necesita este modelo. Usa el playground anterior.

06

Especificaciones

ID del modelo
llava-onevision-72b
Desarrollador
Replicate
Categoría
Multimodal
Entrada
Texto, Imagen, Video
Salida
Texto
Ventana de contexto
32,768 tokens
Salida máxima
4,096 tokens
Entrada del catálogo actualizada
25 de junio de 2026

Parámetros de entrada

Entradas y configuraciones del esquema de entrada del modelo. El ejemplo en la sección API muestra cuáles de ellas acepta la API.

  • promptrequerido

    User message or question about the image

    Tipo: Texto
    Predeterminado:
    Valores permitidos: hasta 16,000 caracteres
  • top_p
    Tipo: Número
    Predeterminado: 1
    Valores permitidos: 0 a 1
  • stream
    Tipo: Sí/No
    Predeterminado: false
    Valores permitidos:
  • image_url

    Optional image URL to analyze

    Tipo: Texto
    Predeterminado:
    Valores permitidos:
  • max_tokens
    Tipo: Número entero
    Predeterminado: 1024
    Valores permitidos: 1 a 4,096
  • temperature
    Tipo: Número
    Predeterminado: 0.7
    Valores permitidos: 0 a 2
  • system_prompt

    Optional system instruction

    Tipo: Texto
    Predeterminado:
    Valores permitidos: hasta 8,000 caracteres

Etiquetas

  • replicate
  • multimodal
  • vision-understanding
  • llava
  • open-weights
07

Preguntas frecuentes

¿Qué es LLaVA-OneVision 72B?

LLaVA-OneVision 72B es un modelo de Replicate en la categoría Multimodal. Está listado en Railwail pero no se puede ejecutar en este momento.

¿Cuánto cuesta LLaVA-OneVision 72B en Railwail?

LLaVA-OneVision 72B no se puede ejecutar en Railwail en este momento, por lo que no hay precio actual. Las alternativas disponibles con precios se enumeran más abajo en esta página.

¿Cuál es la ventana de contexto de LLaVA-OneVision 72B?

La ventana de contexto de LLaVA-OneVision 72B contiene 32,768 tokens. Una respuesta puede tener hasta 4,096 tokens.

¿Qué tan rápido es LLaVA-OneVision 72B?

Aún no hay suficientes ejecuciones medidas de LLaVA-OneVision 72B en Railwail para indicar un tiempo de ejecución. Depende de la entrada, la configuración y la carga en el proveedor.

¿Es LLaVA-OneVision 72B mejor que BLIP?

Eso depende de la tarea. LLaVA-OneVision 72B (Replicate) y BLIP (Salesforce) son ambos modelos en la categoría Multimodal. La página de comparación muestra sus precios y especificaciones lado a lado.

Comparar LLaVA-OneVision 72B y BLIP

¿Puede LLaVA-OneVision 72B procesar imágenes?

Sí. LLaVA-OneVision 72B acepta imágenes como entrada además de texto.

¿Puedo usar LLaVA-OneVision 72B ahora mismo?

Actualmente no disponible: este modelo ha sido desactivado. La página permanece en línea; las alternativas disponibles de la misma categoría se enumeran más abajo.

Todos los modelos a través de una API

Una clave API para todos los modelos en Railwail. El uso se cobra con créditos prepagados, 1 crédito = USD 0.01.