LLaVA-OneVision 72B

MultimodalIkke tilgjengelig
av ReplicateModell-ID: llava-onevision-72b

LMMs-Lab LLaVA-OneVision 72B. Unified single-image, multi-image and video instruction-tuned VLM with task-transfer across modalities.

Status
Ikke tilgjengelig
Kontekst
32 768 tokens
Maks. utdata
4 096 tokens
Input → output
Tekst + Bilde + Video → Tekst
Utvikler
Replicate
Oppdatert
25. juni 2026

LLaVA-OneVision 72B er for øyeblikket utilgjengelig

Ikke tilgjengelig for øyeblikket: dette modellen er deaktivert.

Du kan fortsatt lese detaljene på denne siden. Velg ett av de tilgjengelige alternativene nedenfor for å kjøre en sammenlignbar modell med en gang.

Gå til alternativer
01

Sammenlignbare modeller

Alle i denne kategorien
  • BLIPSalesforce

    Salesforce BLIP. Vision-language model for image captioning and visual question answering. Given an image it writes a short natural-language caption, or answers a question about the image when one is supplied. A widely used baseline for automatic captioning.

    ≈ 0,00030 USD/kjøring

  • Anthropic's April 2026 flagship. 87.6% on SWE-bench Verified, 3x higher image resolution, output self-verification, vision + reasoning.

    6,00 USD/1M inn

  • Anthropic's balanced mid-tier model from February 2026. Best price/performance for production workloads: 5x cheaper than Opus, near-flagship quality.

    3,60 USD/1M inn

02

Playground

Prøv LLaVA-OneVision 72B

Inndata og resultat

Ikke tilgjengelig for øyeblikket

Ikke tilgjengelig for øyeblikket: dette modellen er deaktivert.

Lekeplassen er deaktivert. Du finner sammenlignbare modeller i samme kategori: Se alternativer

Prøv LLaVA-OneVision 72B

0 / 16 000

Avanserte innstillinger (4)

0 / 8 000

Resultat
Svaret vises her.

Denne kjøringen

Ingen pris – ikke tilgjengelig for øyeblikket.

Ny her?

5 gratis credits (0,05 USD) når du registrerer deg med Google

Kan brukes 24 timer etter registrering, opptil 5 kjøringer per dag og maksimalt 2 credits per kjøring. Andre påloggingsmetoder starter uten credits.

03

Om LLaVA-OneVision 72B

Kort sagtPer 25. juni 2026

LLaVA-OneVision 72B er en modell fra Replicate i kategorien Multimodal. LLaVA-OneVision 72B er for øyeblikket ikke tilgjengelig på Railwail. Kontekstvinduet inneholder 32 768 tokens, og ett svar kan være opptil 4 096 tokens langt.

04

Priser

Ikke tilgjengelig for øyeblikket: dette modellen er deaktivert. Det er ingen pris for denne modellen for øyeblikket, så den kan ikke kjøres.

05

API

Ring LLaVA-OneVision 72B med din Railwail API-nøkkel. Bruk denne modell-IDen i forespørselen:

Ingen verifisert API-eksempel

Det offentlige API-et sender et annet inngangsformat enn det denne modellen trenger. Bruk lekeplassen ovenfor.

06

Spesifikasjoner

Modell-ID
llava-onevision-72b
Utvikler
Replicate
Kategori
Multimodal
Inndata
Tekst, Bilde, Video
Utdata
Tekst
Kontekstvindu
32 768 tokens
Maks. utdata
4 096 tokens
Katalogoppføring oppdatert
25. juni 2026

Inndataparametere

Inndataer og innstillinger fra modellens inndataskjema. Eksemplet i API-delen viser hvilke av dem APIen godtar.

  • promptobligatorisk

    User message or question about the image

    Type: Tekst
    Standard:
    Tillatte verdier: opptil 16 000 tegn
  • top_p
    Type: Tall
    Standard: 1
    Tillatte verdier: 0 til 1
  • stream
    Type: Ja/Nei
    Standard: false
    Tillatte verdier:
  • image_url

    Optional image URL to analyze

    Type: Tekst
    Standard:
    Tillatte verdier:
  • max_tokens
    Type: Heltall
    Standard: 1024
    Tillatte verdier: 1 til 4 096
  • temperature
    Type: Tall
    Standard: 0.7
    Tillatte verdier: 0 til 2
  • system_prompt

    Optional system instruction

    Type: Tekst
    Standard:
    Tillatte verdier: opptil 8 000 tegn

Merkelapper

  • replicate
  • multimodal
  • vision-understanding
  • llava
  • open-weights
07

Ofte stilte spørsmål

Hva er LLaVA-OneVision 72B?

LLaVA-OneVision 72B er en modell fra Replicate i kategorien Multimodal. Den er oppført på Railwail, men kan ikke kjøres for øyeblikket.

Hvor mye koster LLaVA-OneVision 72B på Railwail?

LLaVA-OneVision 72B kan ikke kjøres på Railwail for øyeblikket, så det finnes ingen gjeldende pris. Tilgjengelige alternativer med priser er oppført lenger ned på denne siden.

Hvor stort er kontekstvinduet til LLaVA-OneVision 72B?

Kontekstvinduet til LLaVA-OneVision 72B inneholder 32 768 tokens. Ett svar kan være opptil 4 096 tokens langt.

Hvor rask er LLaVA-OneVision 72B?

Det finnes ennå ikke nok målte kjøringer av LLaVA-OneVision 72B på Railwail til å angi en kjøretid. Det avhenger av inndataene, innstillingene og belastningen hos leverandøren.

Er LLaVA-OneVision 72B bedre enn BLIP?

Det avhenger av oppgaven. LLaVA-OneVision 72B (Replicate) og BLIP (Salesforce) er begge modeller i kategorien Multimodal. Sammenligningssiden viser prisene og spesifikasjonene deres side ved side.

Sammenlign LLaVA-OneVision 72B og BLIP

Kan LLaVA-OneVision 72B behandle bilder?

Ja. LLaVA-OneVision 72B godtar bilder som inndata i tillegg til tekst.

Kan jeg bruke LLaVA-OneVision 72B akkurat nå?

Ikke tilgjengelig for øyeblikket: dette modellen er deaktivert. Siden forblir online; tilgjengelige alternativer fra samme kategori er oppført lenger ned.

Alle modeller gjennom én API

Én API-nøkkel for alle modeller på Railwail. Bruk belastes fra forhåndsbetalt kreditt, 1 kreditt = 0,01 USD.