LLaVA-OneVision 72B
llava-onevision-72bLMMs-Lab LLaVA-OneVision 72B. Unified single-image, multi-image and video instruction-tuned VLM with task-transfer across modalities.
- Κατάσταση
- Μη διαθέσιμο
- Περιεχόμενο
- 32,768 tokens
- Μέγ. έξοδος
- 4,096 tokens
- Είσοδος → Έξοδος
- Κείμενο + Εικόνα + Βίντεο → Κείμενο
- Προγραμματιστής
- Replicate
- Ενημερώθηκε
- 25 Ιουνίου 2026
Το LLaVA-OneVision 72B δεν είναι διαθέσιμο αυτή τη στιγμή
Προς το παρόν μη διαθέσιμο: αυτό το μοντέλο έχει απενεργοποιηθεί.
Μπορείτε να διαβάσετε τις λεπτομέρειες σε αυτήν τη σελίδα. Επιλέξτε μία από τις διαθέσιμες εναλλακτικές λύσεις παρακάτω για να εκτελέσετε αμέσως ένα συγκρίσιμο μοντέλο.
Μετάβαση στις εναλλακτικές λύσειςΣυγκρίσιμα μοντέλα
Όλα σε αυτήν την κατηγορία- BLIPSalesforce
Salesforce BLIP. Vision-language model for image captioning and visual question answering. Given an image it writes a short natural-language caption, or answers a question about the image when one is supplied. A widely used baseline for automatic captioning.
≈ 0,00030 $/εκτέλεση
- Claude Opus 4.7Anthropic
Anthropic's April 2026 flagship. 87.6% on SWE-bench Verified, 3x higher image resolution, output self-verification, vision + reasoning.
6,00 $/1M in
- Claude Sonnet 4.6Anthropic
Anthropic's balanced mid-tier model from February 2026. Best price/performance for production workloads: 5x cheaper than Opus, near-flagship quality.
3,60 $/1M in
Playground
Δοκιμάστε LLaVA-OneVision 72B
Είσοδος & Έξοδος
Προς το παρόν μη διαθέσιμο: αυτό το μοντέλο έχει απενεργοποιηθεί.
Το playground είναι απενεργοποιημένο. Μπορείτε να βρείτε συγκρίσιμα μοντέλα στην ίδια κατηγορία: Περιήγηση εναλλακτικών λύσεων
Αυτή η εκτέλεση
Χωρίς τιμή – προς το παρόν μη διαθέσιμο.
Νέος εδώ;
5 δωρεάν πιστωτικές μονάδες (0,05 $) όταν εγγραφείς με Google
Χρησιμοποιήσιμο 24 ώρες μετά την εγγραφή, έως 5 εκτελέσεις ανά ημέρα και το πολύ 2 πιστωτικές μονάδες ανά εκτέλεση. Άλλες μέθοδοι σύνδεσης ξεκινούν χωρίς πιστωτικές μονάδες.
Σχετικά με το LLaVA-OneVision 72B
Το LLaVA-OneVision 72B είναι ένα μοντέλο του Replicate στην κατηγορία Multimodal. Το LLaVA-OneVision 72B δεν είναι διαθέσιμο στο Railwail αυτή τη στιγμή. Το παράθυρο περιεχομένου περιέχει 32,768 tokens, και μια απάντηση μπορεί να είναι έως 4,096 tokens.
Τιμολόγηση
Προς το παρόν μη διαθέσιμο: αυτό το μοντέλο έχει απενεργοποιηθεί. Δεν υπάρχει τιμή για αυτό το μοντέλο αυτή τη στιγμή, επομένως δεν μπορεί να εκτελεστεί.
API
Κανένα επαληθευμένο παράδειγμα API
Το δημόσιο API περνά μια διαφορετική μορφή εισόδου από αυτή που χρειάζεται αυτό το μοντέλο. Χρησιμοποιήστε το playground παραπάνω.
Προδιαγραφές
- ID μοντέλου
llava-onevision-72b- Ανάπτυξη
- Replicate
- Κατηγορία
- Multimodal
- Είσοδος
- Κείμενο, Εικόνα, Βίντεο
- Έξοδος
- Κείμενο
- Παράθυρο περιεχομένου
- 32,768 tokens
- Μέγ. έξοδος
- 4,096 tokens
- Καταχώρηση καταλόγου ενημερώθηκε
- 25 Ιουνίου 2026
Παράμετροι εισόδου
Εισόδους και ρυθμίσεις από το σχήμα εισόδου του μοντέλου. Το παράδειγμα στην ενότητα API δείχνει ποιες από αυτές δέχεται το API.
promptΥποχρεωτικόUser message or question about the image
Τύπος: ΚείμενοΠροεπιλογή: –Επιτρεπόμενες τιμές: Έως 16,000 χαρακτήρεςtop_pΤύπος: ΑριθμόςΠροεπιλογή:1Επιτρεπόμενες τιμές: 0 έως 1streamΤύπος: Ναι/ΌχιΠροεπιλογή:falseΕπιτρεπόμενες τιμές: –image_urlOptional image URL to analyze
Τύπος: ΚείμενοΠροεπιλογή: –Επιτρεπόμενες τιμές: –max_tokensΤύπος: Ακέραιος αριθμόςΠροεπιλογή:1024Επιτρεπόμενες τιμές: 1 έως 4,096temperatureΤύπος: ΑριθμόςΠροεπιλογή:0.7Επιτρεπόμενες τιμές: 0 έως 2system_promptOptional system instruction
Τύπος: ΚείμενοΠροεπιλογή: –Επιτρεπόμενες τιμές: Έως 8,000 χαρακτήρες
Ετικέτες
- replicate
- multimodal
- vision-understanding
- llava
- open-weights
Συχνές ερωτήσεις
Τι είναι LLaVA-OneVision 72B;
Το LLaVA-OneVision 72B είναι ένα μοντέλο του Replicate στην κατηγορία Multimodal. Είναι καταχωρημένο στο Railwail αλλά δεν μπορεί να εκτελεστεί αυτή τη στιγμή.
Πόσο κοστίζει το LLaVA-OneVision 72B στο Railwail;
Το LLaVA-OneVision 72B δεν μπορεί να εκτελεστεί στο Railwail αυτή τη στιγμή, επομένως δεν υπάρχει τρέχουσα τιμή. Διαθέσιμες εναλλακτικές λύσεις με τιμές παρατίθενται παρακάτω σε αυτήν τη σελίδα.
Ποιο είναι το παράθυρο περιεχομένου του LLaVA-OneVision 72B;
Το παράθυρο περιεχομένου του LLaVA-OneVision 72B περιέχει 32,768 tokens. Μια απάντηση μπορεί να είναι έως 4,096 tokens.
Πόσο γρήγορο είναι το LLaVA-OneVision 72B;
Δεν υπάρχουν αρκετές μετρημένες εκτελέσεις του LLaVA-OneVision 72B στο Railwail ακόμα για να δηλωθεί ένας χρόνος εκτέλεσης. Εξαρτάται από την είσοδο, τις ρυθμίσεις και το φορτίο στον πάροχο.
Είναι το LLaVA-OneVision 72B καλύτερο από το BLIP;
Αυτό εξαρτάται από την εργασία. Το LLaVA-OneVision 72B (Replicate) και το BLIP (Salesforce) είναι και τα δύο μοντέλα στην κατηγορία Multimodal. Η σελίδα σύγκρισης δείχνει τις τιμές και τις προδιαγραφές τους παράλληλα.
Σύγκριση LLaVA-OneVision 72B και BLIPΜπορεί το LLaVA-OneVision 72B να επεξεργαστεί εικόνες;
Ναι. Το LLaVA-OneVision 72B δέχεται εικόνες ως είσοδο εκτός από κείμενο.
Μπορώ να χρησιμοποιήσω το LLaVA-OneVision 72B τώρα;
Προς το παρόν μη διαθέσιμο: αυτό το μοντέλο έχει απενεργοποιηθεί. Η σελίδα παραμένει ενεργή· διαθέσιμες εναλλακτικές λύσεις από την ίδια κατηγορία παρατίθενται παρακάτω.
Όλα τα μοντέλα μέσω ενός API
Ένα κλειδί API για κάθε μοντέλο στο Railwail. Η χρήση χρεώνεται από προπληρωμένα πιστωτικά, 1 πιστωτικό = 0,01 $.