LLaVA-OneVision 72B

MultimodalInte tillgÀnglig
av ReplicateModell-ID: llava-onevision-72b

LMMs-Lab LLaVA-OneVision 72B. Unified single-image, multi-image and video instruction-tuned VLM with task-transfer across modalities.

Status
Inte tillgÀnglig
Kontext
32 768 tokens
Max. utdata
4 096 tokens
Inmatning → utmatning
Text + Bild + Video → Text
Utvecklare
Replicate
Uppdaterad
25 juni 2026

LLaVA-OneVision 72B Àr för nÀrvarande otillgÀnglig

Inte tillgÀnglig för nÀrvarande: denna modell Àr inaktiverad.

Du kan fortfarande lÀsa detaljerna pÄ denna sida. VÀlj ett av de tillgÀngliga alternativen nedan för att köra en jÀmförbar modell direkt.

GĂ„ till alternativ
01

JÀmförbara modeller

Alla i denna kategori
  • BLIPSalesforce

    Salesforce BLIP. Vision-language model for image captioning and visual question answering. Given an image it writes a short natural-language caption, or answers a question about the image when one is supplied. A widely used baseline for automatic captioning.

    ≈ 0,00030 US$/körning

  • Anthropic's April 2026 flagship. 87.6% on SWE-bench Verified, 3x higher image resolution, output self-verification, vision + reasoning.

    6,00 US$/1M in

  • Anthropic's balanced mid-tier model from February 2026. Best price/performance for production workloads: 5x cheaper than Opus, near-flagship quality.

    3,60 US$/1M in

02

Playground

Prova LLaVA-OneVision 72B

Inmatning & resultat

Inte tillgÀnglig för nÀrvarande

Inte tillgÀnglig för nÀrvarande: denna modell Àr inaktiverad.

Lekplatsen Àr inaktiverad. Du hittar jÀmförbara modeller i samma kategori: Visa alternativ

Prova LLaVA-OneVision 72B

0 / 16 000

Avancerade instÀllningar (4)

0 / 8 000

Resultat
Svaret visas hÀr.

Denna körning

Inget pris – för nĂ€rvarande otillgĂ€ngligt.

Ny hÀr?

5 gratis credits (0,05 US$) nÀr du registrerar dig med Google

AnvÀndbar 24 timmar efter registrering, upp till 5 körningar per dag och högst 2 credits per körning. Andra inloggningsmetoder startar utan credits.

03

Om LLaVA-OneVision 72B

Kort sagtFrÄn och med 25 juni 2026

LLaVA-OneVision 72B Àr en modell av Replicate i kategorin Multimodal. LLaVA-OneVision 72B Àr för nÀrvarande inte tillgÀnglig pÄ Railwail. Kontextfönstret innehÄller 32 768 tokens, och ett svar kan vara upp till 4 096 tokens lÄngt.

04

Priser

Inte tillgÀnglig för nÀrvarande: denna modell Àr inaktiverad. Det finns ingen pris för denna modell för nÀrvarande, sÄ den kan inte köras.

05

API

Anropa LLaVA-OneVision 72B med din Railwail API-nyckel. AnvÀnd detta modell-ID i begÀran:

Inget verifierat API-exempel

Det offentliga API:et skickar ett annat inmatningsformat Àn vad denna modell behöver. AnvÀnd lekplatsen ovan.

06

Specifikationer

Modell-ID
llava-onevision-72b
Utvecklare
Replicate
Kategori
Multimodal
Inmatning
Text, Bild, Video
Utmatning
Text
Kontextfönster
32 768 tokens
Max. utmatning
4 096 tokens
KataloginlÀgg uppdaterat
25 juni 2026

Indataparametrar

Inmatningar och instÀllningar frÄn modellens indataschema. Exemplet i API-avsnittet visar vilka som API:et accepterar.

  • promptobligatorisk

    User message or question about the image

    Typ: Text
    Standard: –
    TillÄtna vÀrden: upp till 16 000 tecken
  • top_p
    Typ: Tal
    Standard: 1
    TillÄtna vÀrden: 0 till 1
  • stream
    Typ: Ja/Nej
    Standard: false
    TillĂ„tna vĂ€rden: –
  • image_url

    Optional image URL to analyze

    Typ: Text
    Standard: –
    TillĂ„tna vĂ€rden: –
  • max_tokens
    Typ: Heltal
    Standard: 1024
    TillÄtna vÀrden: 1 till 4 096
  • temperature
    Typ: Tal
    Standard: 0.7
    TillÄtna vÀrden: 0 till 2
  • system_prompt

    Optional system instruction

    Typ: Text
    Standard: –
    TillÄtna vÀrden: upp till 8 000 tecken

Taggar

  • replicate
  • multimodal
  • vision-understanding
  • llava
  • open-weights
07

Vanliga frÄgor

Vad Àr LLaVA-OneVision 72B?

LLaVA-OneVision 72B Àr en modell av Replicate i kategorin Multimodal. Den finns i Railwail-katalogen men kan inte köras för nÀrvarande.

Vad kostar LLaVA-OneVision 72B pÄ Railwail?

LLaVA-OneVision 72B kan inte köras pÄ Railwail för nÀrvarande, sÄ det finns inget aktuellt pris. TillgÀngliga alternativ med priser visas lÀngre ned pÄ denna sida.

Hur stort Àr kontextfönstret för LLaVA-OneVision 72B?

Kontextfönstret för LLaVA-OneVision 72B innehÄller 32 768 tokens. Ett svar kan vara upp till 4 096 tokens lÄngt.

Hur snabb Àr LLaVA-OneVision 72B?

Det finns Ànnu inte tillrÀckligt mÄnga uppmÀtta körningar av LLaVA-OneVision 72B pÄ Railwail för att ange en körningstid. Det beror pÄ inmatningen, instÀllningarna och belastningen hos leverantören.

Är LLaVA-OneVision 72B bĂ€ttre Ă€n BLIP?

Det beror pÄ uppgiften. LLaVA-OneVision 72B (Replicate) och BLIP (Salesforce) Àr bÄda modeller i kategorin Multimodal. JÀmförelsesidan visar deras priser och specifikationer sida vid sida.

JÀmför LLaVA-OneVision 72B och BLIP

Kan LLaVA-OneVision 72B bearbeta bilder?

Ja. LLaVA-OneVision 72B accepterar bilder som inmatning utöver text.

Kan jag anvÀnda LLaVA-OneVision 72B just nu?

Inte tillgÀnglig för nÀrvarande: denna modell Àr inaktiverad. Sidan förblir online; tillgÀngliga alternativ frÄn samma kategori visas lÀngre ned.

Alla modeller via ett API

En API-nyckel för alla modeller pÄ Railwail. AnvÀndningen debiteras frÄn förbetald kredit, 1 kredit = 0,01 US$.