LLaVA-OneVision 72B
llava-onevision-72bLMMs-Lab LLaVA-OneVision 72B. Unified single-image, multi-image and video instruction-tuned VLM with task-transfer across modalities.
- Status
- Ikke tilgjengelig
- Kontekst
- 32 768 tokens
- Maks. utdata
- 4 096 tokens
- Input → output
- Tekst + Bilde + Video → Tekst
- Utvikler
- Replicate
- Oppdatert
- 25. juni 2026
LLaVA-OneVision 72B er for øyeblikket utilgjengelig
Ikke tilgjengelig for øyeblikket: dette modellen er deaktivert.
Du kan fortsatt lese detaljene på denne siden. Velg ett av de tilgjengelige alternativene nedenfor for å kjøre en sammenlignbar modell med en gang.
Gå til alternativerSammenlignbare modeller
Alle i denne kategorien- BLIPSalesforce
Salesforce BLIP. Vision-language model for image captioning and visual question answering. Given an image it writes a short natural-language caption, or answers a question about the image when one is supplied. A widely used baseline for automatic captioning.
≈ 0,00030 USD/kjøring
- Claude Opus 4.7Anthropic
Anthropic's April 2026 flagship. 87.6% on SWE-bench Verified, 3x higher image resolution, output self-verification, vision + reasoning.
6,00 USD/1M inn
- Claude Sonnet 4.6Anthropic
Anthropic's balanced mid-tier model from February 2026. Best price/performance for production workloads: 5x cheaper than Opus, near-flagship quality.
3,60 USD/1M inn
Playground
Prøv LLaVA-OneVision 72B
Inndata og resultat
Ikke tilgjengelig for øyeblikket: dette modellen er deaktivert.
Lekeplassen er deaktivert. Du finner sammenlignbare modeller i samme kategori: Se alternativer
Denne kjøringen
Ingen pris – ikke tilgjengelig for øyeblikket.
Ny her?
5 gratis credits (0,05 USD) når du registrerer deg med Google
Kan brukes 24 timer etter registrering, opptil 5 kjøringer per dag og maksimalt 2 credits per kjøring. Andre påloggingsmetoder starter uten credits.
Om LLaVA-OneVision 72B
LLaVA-OneVision 72B er en modell fra Replicate i kategorien Multimodal. LLaVA-OneVision 72B er for øyeblikket ikke tilgjengelig på Railwail. Kontekstvinduet inneholder 32 768 tokens, og ett svar kan være opptil 4 096 tokens langt.
Priser
Ikke tilgjengelig for øyeblikket: dette modellen er deaktivert. Det er ingen pris for denne modellen for øyeblikket, så den kan ikke kjøres.
API
Ingen verifisert API-eksempel
Det offentlige API-et sender et annet inngangsformat enn det denne modellen trenger. Bruk lekeplassen ovenfor.
Spesifikasjoner
- Modell-ID
llava-onevision-72b- Utvikler
- Replicate
- Kategori
- Multimodal
- Inndata
- Tekst, Bilde, Video
- Utdata
- Tekst
- Kontekstvindu
- 32 768 tokens
- Maks. utdata
- 4 096 tokens
- Katalogoppføring oppdatert
- 25. juni 2026
Inndataparametere
Inndataer og innstillinger fra modellens inndataskjema. Eksemplet i API-delen viser hvilke av dem APIen godtar.
promptobligatoriskUser message or question about the image
Type: TekstStandard: –Tillatte verdier: opptil 16 000 tegntop_pType: TallStandard:1Tillatte verdier: 0 til 1streamType: Ja/NeiStandard:falseTillatte verdier: –image_urlOptional image URL to analyze
Type: TekstStandard: –Tillatte verdier: –max_tokensType: HeltallStandard:1024Tillatte verdier: 1 til 4 096temperatureType: TallStandard:0.7Tillatte verdier: 0 til 2system_promptOptional system instruction
Type: TekstStandard: –Tillatte verdier: opptil 8 000 tegn
Merkelapper
- replicate
- multimodal
- vision-understanding
- llava
- open-weights
Ofte stilte spørsmål
Hva er LLaVA-OneVision 72B?
LLaVA-OneVision 72B er en modell fra Replicate i kategorien Multimodal. Den er oppført på Railwail, men kan ikke kjøres for øyeblikket.
Hvor mye koster LLaVA-OneVision 72B på Railwail?
LLaVA-OneVision 72B kan ikke kjøres på Railwail for øyeblikket, så det finnes ingen gjeldende pris. Tilgjengelige alternativer med priser er oppført lenger ned på denne siden.
Hvor stort er kontekstvinduet til LLaVA-OneVision 72B?
Kontekstvinduet til LLaVA-OneVision 72B inneholder 32 768 tokens. Ett svar kan være opptil 4 096 tokens langt.
Hvor rask er LLaVA-OneVision 72B?
Det finnes ennå ikke nok målte kjøringer av LLaVA-OneVision 72B på Railwail til å angi en kjøretid. Det avhenger av inndataene, innstillingene og belastningen hos leverandøren.
Er LLaVA-OneVision 72B bedre enn BLIP?
Det avhenger av oppgaven. LLaVA-OneVision 72B (Replicate) og BLIP (Salesforce) er begge modeller i kategorien Multimodal. Sammenligningssiden viser prisene og spesifikasjonene deres side ved side.
Sammenlign LLaVA-OneVision 72B og BLIPKan LLaVA-OneVision 72B behandle bilder?
Ja. LLaVA-OneVision 72B godtar bilder som inndata i tillegg til tekst.
Kan jeg bruke LLaVA-OneVision 72B akkurat nå?
Ikke tilgjengelig for øyeblikket: dette modellen er deaktivert. Siden forblir online; tilgjengelige alternativer fra samme kategori er oppført lenger ned.
Alle modeller gjennom én API
Én API-nøkkel for alle modeller på Railwail. Bruk belastes fra forhåndsbetalt kreditt, 1 kreditt = 0,01 USD.