LLaVA-OneVision 72B

MultimodaleNon disponibile
di ReplicateID modello: llava-onevision-72b

LMMs-Lab LLaVA-OneVision 72B. Unified single-image, multi-image and video instruction-tuned VLM with task-transfer across modalities.

Stato
Non disponibile
Contesto
32.768 token
Max. output
4096 token
Input → output
Testo + Immagine + Video → Testo
Sviluppatore
Replicate
Aggiornato
25 giugno 2026

LLaVA-OneVision 72B non è attualmente disponibile

Attualmente non disponibile: questo modello è stato disattivato.

Puoi comunque leggere i dettagli su questa pagina. Scegli una delle alternative disponibili di seguito per eseguire subito un modello comparabile.

Vai alle alternative
01

Modelli comparabili

Tutti in questa categoria
  • BLIPSalesforce

    Salesforce BLIP. Vision-language model for image captioning and visual question answering. Given an image it writes a short natural-language caption, or answers a question about the image when one is supplied. A widely used baseline for automatic captioning.

    ≈ 0,00030 USD/esecuzione

  • Anthropic's April 2026 flagship. 87.6% on SWE-bench Verified, 3x higher image resolution, output self-verification, vision + reasoning.

    6,00 USD/1M in

  • Anthropic's balanced mid-tier model from February 2026. Best price/performance for production workloads: 5x cheaper than Opus, near-flagship quality.

    3,60 USD/1M in

02

Playground

Prova LLaVA-OneVision 72B

Input e output

Attualmente non disponibile

Attualmente non disponibile: questo modello è stato disattivato.

Il playground è disabilitato. Trovi modelli comparabili nella stessa categoria: Visualizza alternative

Prova LLaVA-OneVision 72B

0 / 16.000

Impostazioni avanzate (4)

0 / 8000

Risultato
La risposta appare qui.

Questa esecuzione

Nessun prezzo – attualmente non disponibile.

Nuovo qui?

5 crediti gratuiti (0,05 USD) quando ti iscrivi con Google

Utilizzabile 24 ore dopo l'iscrizione, fino a 5 esecuzioni al giorno e al massimo 2 crediti per esecuzione. Altri metodi di accesso iniziano senza crediti.

03

Informazioni su LLaVA-OneVision 72B

RiassuntoA partire da 25 giugno 2026

LLaVA-OneVision 72B è un modello di Replicate nella categoria Multimodale. LLaVA-OneVision 72B non è attualmente disponibile su Railwail. La finestra di contesto contiene 32.768 token e una risposta può essere lunga fino a 4096 token.

04

Prezzi

Attualmente non disponibile: questo modello è stato disattivato. Al momento non c'è un prezzo per questo modello, quindi non può essere eseguito.

05

API

Chiama LLaVA-OneVision 72B con la tua chiave API Railwail. Usa questo ID modello nella richiesta:

Nessun esempio API verificato

L'API pubblica passa un formato di input diverso da quello richiesto da questo modello. Usa il playground sopra.

06

Specifiche

ID modello
llava-onevision-72b
Sviluppatore
Replicate
Categoria
Multimodale
Input
Testo, Immagine, Video
Output
Testo
Finestra di contesto
32.768 token
Output massimo
4096 token
Voce di catalogo aggiornata
25 giugno 2026

Parametri di input

Input e impostazioni dallo schema di input del modello. L'esempio nella sezione API mostra quali di essi l'API accetta.

  • promptObbligatorio

    User message or question about the image

    Tipo: Testo
    Predefinito: –
    Valori consentiti: fino a 16.000 caratteri
  • top_p
    Tipo: Numero
    Predefinito: 1
    Valori consentiti: 0 a 1
  • stream
    Tipo: Sì/No
    Predefinito: false
    Valori consentiti: –
  • image_url

    Optional image URL to analyze

    Tipo: Testo
    Predefinito: –
    Valori consentiti: –
  • max_tokens
    Tipo: Numero intero
    Predefinito: 1024
    Valori consentiti: 1 a 4096
  • temperature
    Tipo: Numero
    Predefinito: 0.7
    Valori consentiti: 0 a 2
  • system_prompt

    Optional system instruction

    Tipo: Testo
    Predefinito: –
    Valori consentiti: fino a 8000 caratteri

Etichette

  • replicate
  • multimodal
  • vision-understanding
  • llava
  • open-weights
07

Domande frequenti

Cos'è LLaVA-OneVision 72B?

LLaVA-OneVision 72B è un modello di Replicate nella categoria Multimodale. È elencato su Railwail ma non può essere eseguito al momento.

Quanto costa LLaVA-OneVision 72B su Railwail?

LLaVA-OneVision 72B non può essere eseguito su Railwail al momento, quindi non c'è un prezzo attuale. Le alternative disponibili con i prezzi sono elencate più in basso in questa pagina.

Qual è la finestra di contesto di LLaVA-OneVision 72B?

La finestra di contesto di LLaVA-OneVision 72B contiene 32.768 token. Una risposta può essere lunga fino a 4096 token.

Quanto è veloce LLaVA-OneVision 72B?

Non ci sono ancora abbastanza esecuzioni misurate di LLaVA-OneVision 72B su Railwail per indicare un tempo di esecuzione. Dipende dall'input, dalle impostazioni e dal carico presso il provider.

LLaVA-OneVision 72B è migliore di BLIP?

Dipende dall'attività. LLaVA-OneVision 72B (Replicate) e BLIP (Salesforce) sono entrambi modelli nella categoria Multimodale. La pagina di confronto mostra i loro prezzi e le specifiche affiancati.

Confronta LLaVA-OneVision 72B e BLIP

LLaVA-OneVision 72B può elaborare immagini?

Sì. LLaVA-OneVision 72B accetta immagini come input oltre al testo.

Posso usare LLaVA-OneVision 72B adesso?

Attualmente non disponibile: questo modello è stato disattivato. La pagina rimane online; le alternative disponibili della stessa categoria sono elencate più in basso.

Tutti i modelli tramite un'API

Una chiave API per tutti i modelli su Railwail. L'utilizzo viene addebitato da crediti prepagati, 1 credito = 0,01 USD.