LLaVA-OneVision 72B
llava-onevision-72bLMMs-Lab LLaVA-OneVision 72B. Unified single-image, multi-image and video instruction-tuned VLM with task-transfer across modalities.
- Stato
- Non disponibile
- Contesto
- 32.768 token
- Max. output
- 4096 token
- Input → output
- Testo + Immagine + Video → Testo
- Sviluppatore
- Replicate
- Aggiornato
- 25 giugno 2026
LLaVA-OneVision 72B non è attualmente disponibile
Attualmente non disponibile: questo modello è stato disattivato.
Puoi comunque leggere i dettagli su questa pagina. Scegli una delle alternative disponibili di seguito per eseguire subito un modello comparabile.
Vai alle alternativeModelli comparabili
Tutti in questa categoria- BLIPSalesforce
Salesforce BLIP. Vision-language model for image captioning and visual question answering. Given an image it writes a short natural-language caption, or answers a question about the image when one is supplied. A widely used baseline for automatic captioning.
≈ 0,00030 USD/esecuzione
- Claude Opus 4.7Anthropic
Anthropic's April 2026 flagship. 87.6% on SWE-bench Verified, 3x higher image resolution, output self-verification, vision + reasoning.
6,00Â USD/1M in
- Claude Sonnet 4.6Anthropic
Anthropic's balanced mid-tier model from February 2026. Best price/performance for production workloads: 5x cheaper than Opus, near-flagship quality.
3,60Â USD/1M in
Playground
Prova LLaVA-OneVision 72B
Input e output
Attualmente non disponibile: questo modello è stato disattivato.
Il playground è disabilitato. Trovi modelli comparabili nella stessa categoria: Visualizza alternative
Questa esecuzione
Nessun prezzo – attualmente non disponibile.
Nuovo qui?
5 crediti gratuiti (0,05Â USD) quando ti iscrivi con Google
Utilizzabile 24 ore dopo l'iscrizione, fino a 5 esecuzioni al giorno e al massimo 2 crediti per esecuzione. Altri metodi di accesso iniziano senza crediti.
Informazioni su LLaVA-OneVision 72B
LLaVA-OneVision 72B è un modello di Replicate nella categoria Multimodale. LLaVA-OneVision 72B non è attualmente disponibile su Railwail. La finestra di contesto contiene 32.768 token e una risposta può essere lunga fino a 4096 token.
Prezzi
Attualmente non disponibile: questo modello è stato disattivato. Al momento non c'è un prezzo per questo modello, quindi non può essere eseguito.
API
Nessun esempio API verificato
L'API pubblica passa un formato di input diverso da quello richiesto da questo modello. Usa il playground sopra.
Specifiche
- ID modello
llava-onevision-72b- Sviluppatore
- Replicate
- Categoria
- Multimodale
- Input
- Testo, Immagine, Video
- Output
- Testo
- Finestra di contesto
- 32.768 token
- Output massimo
- 4096 token
- Voce di catalogo aggiornata
- 25 giugno 2026
Parametri di input
Input e impostazioni dallo schema di input del modello. L'esempio nella sezione API mostra quali di essi l'API accetta.
promptObbligatorioUser message or question about the image
Tipo: TestoPredefinito: –Valori consentiti: fino a 16.000 caratteritop_pTipo: NumeroPredefinito:1Valori consentiti: 0 a 1streamTipo: Sì/NoPredefinito:falseValori consentiti: –image_urlOptional image URL to analyze
Tipo: TestoPredefinito: –Valori consentiti: –max_tokensTipo: Numero interoPredefinito:1024Valori consentiti: 1 a 4096temperatureTipo: NumeroPredefinito:0.7Valori consentiti: 0 a 2system_promptOptional system instruction
Tipo: TestoPredefinito: –Valori consentiti: fino a 8000 caratteri
Etichette
- replicate
- multimodal
- vision-understanding
- llava
- open-weights
Domande frequenti
Cos'è LLaVA-OneVision 72B?
LLaVA-OneVision 72B è un modello di Replicate nella categoria Multimodale. È elencato su Railwail ma non può essere eseguito al momento.
Quanto costa LLaVA-OneVision 72B su Railwail?
LLaVA-OneVision 72B non può essere eseguito su Railwail al momento, quindi non c'è un prezzo attuale. Le alternative disponibili con i prezzi sono elencate più in basso in questa pagina.
Qual è la finestra di contesto di LLaVA-OneVision 72B?
La finestra di contesto di LLaVA-OneVision 72B contiene 32.768 token. Una risposta può essere lunga fino a 4096 token.
Quanto è veloce LLaVA-OneVision 72B?
Non ci sono ancora abbastanza esecuzioni misurate di LLaVA-OneVision 72B su Railwail per indicare un tempo di esecuzione. Dipende dall'input, dalle impostazioni e dal carico presso il provider.
LLaVA-OneVision 72B è migliore di BLIP?
Dipende dall'attività . LLaVA-OneVision 72B (Replicate) e BLIP (Salesforce) sono entrambi modelli nella categoria Multimodale. La pagina di confronto mostra i loro prezzi e le specifiche affiancati.
Confronta LLaVA-OneVision 72B e BLIPLLaVA-OneVision 72B può elaborare immagini?
Sì. LLaVA-OneVision 72B accetta immagini come input oltre al testo.
Posso usare LLaVA-OneVision 72B adesso?
Attualmente non disponibile: questo modello è stato disattivato. La pagina rimane online; le alternative disponibili della stessa categoria sono elencate più in basso.
Tutti i modelli tramite un'API
Una chiave API per tutti i modelli su Railwail. L'utilizzo viene addebitato da crediti prepagati, 1 credito = 0,01Â USD.