LLaVA-OneVision 72B

MultimodalIndisponibil
de ReplicateID model: llava-onevision-72b

LMMs-Lab LLaVA-OneVision 72B. Unified single-image, multi-image and video instruction-tuned VLM with task-transfer across modalities.

Status
Indisponibil
Context
32.768 tokeni
Ieșire max.
4.096 tokeni
Intrare → ieșire
Text + Imagine + Video → Text
Dezvoltator
Replicate
Actualizat
25 iunie 2026

LLaVA-OneVision 72B nu este disponibil în acest moment

Indisponibil în prezent: acest model a fost dezactivat.

Poți citi în continuare detaliile pe această pagină. Alege una dintre alternativele disponibile de mai jos pentru a rula imediat un model comparabil.

Mergi la alternative
01
  • BLIPSalesforce

    Salesforce BLIP. Vision-language model for image captioning and visual question answering. Given an image it writes a short natural-language caption, or answers a question about the image when one is supplied. A widely used baseline for automatic captioning.

    ≈ 0,00030 USD/rulare

  • Anthropic's April 2026 flagship. 87.6% on SWE-bench Verified, 3x higher image resolution, output self-verification, vision + reasoning.

    6,00 USD/1M in

  • Anthropic's balanced mid-tier model from February 2026. Best price/performance for production workloads: 5x cheaper than Opus, near-flagship quality.

    3,60 USD/1M in

02

Playground

Încearcă LLaVA-OneVision 72B

Intrare & rezultat

Indisponibil în prezent

Indisponibil în prezent: acest model a fost dezactivat.

Playground-ul este dezactivat. Modele comparabile găsești în aceeași categorie: Vezi alternativele

Încearcă LLaVA-OneVision 72B

0 / 16.000

Setări avansate (4)

0 / 8.000

Rezultat
Răspunsul apare aici.

Această rulare

Fără preț – momentan indisponibil.

Nou aici?

5 credite gratuite (0,05 USD) când te înregistrezi cu Google

Utilizabil 24 ore după înregistrare, până la 5 rulări pe zi și maximum 2 credite pe rulare. Alte metode de conectare încep fără credite.

03

Despre LLaVA-OneVision 72B

Pe scurtDin 25 iunie 2026

LLaVA-OneVision 72B este un model de Replicate din categoria Multimodal. LLaVA-OneVision 72B nu este disponibil în prezent pe Railwail. Fereastra de context conține 32.768 token-uri, iar un răspuns poate fi lung de până la 4.096 token-uri.

04

Prețuri

Indisponibil în prezent: acest model a fost dezactivat. Nu există preț pentru acest model în acest moment, deci nu poate fi executat.

05

API

Apelează LLaVA-OneVision 72B cu cheia ta API Railwail. Folosește acest ID de model în cerere:

Niciun exemplu API verificat

API-ul public transmite un format de intrare diferit de ceea ce are nevoie acest model. Folosește playground-ul de mai sus.

06

Specificații

ID model
llava-onevision-72b
Dezvoltator
Replicate
Categorie
Multimodal
Intrare
Text, Imagine, Video
Ieșire
Text
Fereastră de context
32.768 tokeni
Ieșire max.
4.096 tokeni
Intrare catalog actualizată
25 iunie 2026

Parametri de intrare

Intrări și setări din schema de intrare a modelului. Exemplul din secțiunea API arată care dintre ele acceptă API-ul.

  • promptobligatoriu

    User message or question about the image

    Tip: Text
    Implicit:
    Valori permise: până la 16.000 caractere
  • top_p
    Tip: Număr
    Implicit: 1
    Valori permise: 0 până la 1
  • stream
    Tip: Da/Nu
    Implicit: false
    Valori permise:
  • image_url

    Optional image URL to analyze

    Tip: Text
    Implicit:
    Valori permise:
  • max_tokens
    Tip: Număr întreg
    Implicit: 1024
    Valori permise: 1 până la 4.096
  • temperature
    Tip: Număr
    Implicit: 0.7
    Valori permise: 0 până la 2
  • system_prompt

    Optional system instruction

    Tip: Text
    Implicit:
    Valori permise: până la 8.000 caractere

Etichete

  • replicate
  • multimodal
  • vision-understanding
  • llava
  • open-weights
07

Întrebări frecvente

Ce este LLaVA-OneVision 72B?

LLaVA-OneVision 72B este un model de Replicate din categoria Multimodal. Este listat pe Railwail, dar nu poate fi rulat în acest moment.

Cât costă LLaVA-OneVision 72B pe Railwail?

LLaVA-OneVision 72B nu poate fi rulat pe Railwail în acest moment, deci nu există preț curent. Alternativele disponibile cu prețuri sunt listate mai jos pe această pagină.

Care este fereastra de context a LLaVA-OneVision 72B?

Fereastra de context a LLaVA-OneVision 72B conține 32.768 token-uri. Un răspuns poate fi lung de până la 4.096 token-uri.

Cât de rapid este LLaVA-OneVision 72B?

Nu sunt suficiente rulări măsurate ale LLaVA-OneVision 72B pe Railwail încă pentru a indica un timp de rulare. Depinde de intrare, de setări și de sarcina la furnizor.

Este LLaVA-OneVision 72B mai bun decât BLIP?

Depinde de sarcină. LLaVA-OneVision 72B (Replicate) și BLIP (Salesforce) sunt ambele modele din categoria Multimodal. Pagina de comparație arată prețurile și specificațiile lor una lângă alta.

Compară LLaVA-OneVision 72B și BLIP

Poate LLaVA-OneVision 72B procesa imagini?

Da. LLaVA-OneVision 72B acceptă imagini ca intrare, pe lângă text.

Pot folosi LLaVA-OneVision 72B chiar acum?

Indisponibil în prezent: acest model a fost dezactivat. Pagina rămâne online; alternativele disponibile din aceeași categorie sunt listate mai jos.

Toate modelele printr-o singură API

O cheie API pentru fiecare model pe Railwail. Utilizarea se percepe din credite prepay, 1 credit = 0,01 USD.