LLaVA-OneVision 72B
llava-onevision-72bLMMs-Lab LLaVA-OneVision 72B. Unified single-image, multi-image and video instruction-tuned VLM with task-transfer across modalities.
- Status
- Indisponibil
- Context
- 32.768 tokeni
- Ieșire max.
- 4.096 tokeni
- Intrare → ieșire
- Text + Imagine + Video → Text
- Dezvoltator
- Replicate
- Actualizat
- 25 iunie 2026
LLaVA-OneVision 72B nu este disponibil în acest moment
Indisponibil în prezent: acest model a fost dezactivat.
Poți citi în continuare detaliile pe această pagină. Alege una dintre alternativele disponibile de mai jos pentru a rula imediat un model comparabil.
Mergi la alternativeModele comparabile
Toate din această categorie- BLIPSalesforce
Salesforce BLIP. Vision-language model for image captioning and visual question answering. Given an image it writes a short natural-language caption, or answers a question about the image when one is supplied. A widely used baseline for automatic captioning.
≈ 0,00030 USD/rulare
- Claude Opus 4.7Anthropic
Anthropic's April 2026 flagship. 87.6% on SWE-bench Verified, 3x higher image resolution, output self-verification, vision + reasoning.
6,00 USD/1M in
- Claude Sonnet 4.6Anthropic
Anthropic's balanced mid-tier model from February 2026. Best price/performance for production workloads: 5x cheaper than Opus, near-flagship quality.
3,60 USD/1M in
Playground
Încearcă LLaVA-OneVision 72B
Intrare & rezultat
Indisponibil în prezent: acest model a fost dezactivat.
Playground-ul este dezactivat. Modele comparabile găsești în aceeași categorie: Vezi alternativele
Această rulare
Fără preț – momentan indisponibil.
Nou aici?
5 credite gratuite (0,05 USD) când te înregistrezi cu Google
Utilizabil 24 ore după înregistrare, până la 5 rulări pe zi și maximum 2 credite pe rulare. Alte metode de conectare încep fără credite.
Despre LLaVA-OneVision 72B
LLaVA-OneVision 72B este un model de Replicate din categoria Multimodal. LLaVA-OneVision 72B nu este disponibil în prezent pe Railwail. Fereastra de context conține 32.768 token-uri, iar un răspuns poate fi lung de până la 4.096 token-uri.
Prețuri
Indisponibil în prezent: acest model a fost dezactivat. Nu există preț pentru acest model în acest moment, deci nu poate fi executat.
API
Niciun exemplu API verificat
API-ul public transmite un format de intrare diferit de ceea ce are nevoie acest model. Folosește playground-ul de mai sus.
Specificații
- ID model
llava-onevision-72b- Dezvoltator
- Replicate
- Categorie
- Multimodal
- Intrare
- Text, Imagine, Video
- Ieșire
- Text
- Fereastră de context
- 32.768 tokeni
- Ieșire max.
- 4.096 tokeni
- Intrare catalog actualizată
- 25 iunie 2026
Parametri de intrare
Intrări și setări din schema de intrare a modelului. Exemplul din secțiunea API arată care dintre ele acceptă API-ul.
promptobligatoriuUser message or question about the image
Tip: TextImplicit: –Valori permise: până la 16.000 caracteretop_pTip: NumărImplicit:1Valori permise: 0 până la 1streamTip: Da/NuImplicit:falseValori permise: –image_urlOptional image URL to analyze
Tip: TextImplicit: –Valori permise: –max_tokensTip: Număr întregImplicit:1024Valori permise: 1 până la 4.096temperatureTip: NumărImplicit:0.7Valori permise: 0 până la 2system_promptOptional system instruction
Tip: TextImplicit: –Valori permise: până la 8.000 caractere
Etichete
- replicate
- multimodal
- vision-understanding
- llava
- open-weights
Întrebări frecvente
Ce este LLaVA-OneVision 72B?
LLaVA-OneVision 72B este un model de Replicate din categoria Multimodal. Este listat pe Railwail, dar nu poate fi rulat în acest moment.
Cât costă LLaVA-OneVision 72B pe Railwail?
LLaVA-OneVision 72B nu poate fi rulat pe Railwail în acest moment, deci nu există preț curent. Alternativele disponibile cu prețuri sunt listate mai jos pe această pagină.
Care este fereastra de context a LLaVA-OneVision 72B?
Fereastra de context a LLaVA-OneVision 72B conține 32.768 token-uri. Un răspuns poate fi lung de până la 4.096 token-uri.
Cât de rapid este LLaVA-OneVision 72B?
Nu sunt suficiente rulări măsurate ale LLaVA-OneVision 72B pe Railwail încă pentru a indica un timp de rulare. Depinde de intrare, de setări și de sarcina la furnizor.
Este LLaVA-OneVision 72B mai bun decât BLIP?
Depinde de sarcină. LLaVA-OneVision 72B (Replicate) și BLIP (Salesforce) sunt ambele modele din categoria Multimodal. Pagina de comparație arată prețurile și specificațiile lor una lângă alta.
Compară LLaVA-OneVision 72B și BLIPPoate LLaVA-OneVision 72B procesa imagini?
Da. LLaVA-OneVision 72B acceptă imagini ca intrare, pe lângă text.
Pot folosi LLaVA-OneVision 72B chiar acum?
Indisponibil în prezent: acest model a fost dezactivat. Pagina rămâne online; alternativele disponibile din aceeași categorie sunt listate mai jos.
Toate modelele printr-o singură API
O cheie API pentru fiecare model pe Railwail. Utilizarea se percepe din credite prepay, 1 credit = 0,01 USD.