LLaVA-OneVision 72B

MultimodalΜη διαθέσιμο
από ReplicateΑναγνωριστικό μοντέλου: llava-onevision-72b

LMMs-Lab LLaVA-OneVision 72B. Unified single-image, multi-image and video instruction-tuned VLM with task-transfer across modalities.

Κατάσταση
Μη διαθέσιμο
Περιεχόμενο
32,768 tokens
Μέγ. έξοδος
4,096 tokens
Είσοδος → Έξοδος
Κείμενο + Εικόνα + Βίντεο → Κείμενο
Προγραμματιστής
Replicate
Ενημερώθηκε
25 Ιουνίου 2026

Το LLaVA-OneVision 72B δεν είναι διαθέσιμο αυτή τη στιγμή

Προς το παρόν μη διαθέσιμο: αυτό το μοντέλο έχει απενεργοποιηθεί.

Μπορείτε να διαβάσετε τις λεπτομέρειες σε αυτήν τη σελίδα. Επιλέξτε μία από τις διαθέσιμες εναλλακτικές λύσεις παρακάτω για να εκτελέσετε αμέσως ένα συγκρίσιμο μοντέλο.

Μετάβαση στις εναλλακτικές λύσεις
01

Συγκρίσιμα μοντέλα

Όλα σε αυτήν την κατηγορία
  • BLIPSalesforce

    Salesforce BLIP. Vision-language model for image captioning and visual question answering. Given an image it writes a short natural-language caption, or answers a question about the image when one is supplied. A widely used baseline for automatic captioning.

    ≈ 0,00030 $/εκτέλεση

  • Anthropic's April 2026 flagship. 87.6% on SWE-bench Verified, 3x higher image resolution, output self-verification, vision + reasoning.

    6,00 $/1M in

  • Anthropic's balanced mid-tier model from February 2026. Best price/performance for production workloads: 5x cheaper than Opus, near-flagship quality.

    3,60 $/1M in

02

Playground

Δοκιμάστε LLaVA-OneVision 72B

Είσοδος & Έξοδος

Προς το παρόν μη διαθέσιμο

Προς το παρόν μη διαθέσιμο: αυτό το μοντέλο έχει απενεργοποιηθεί.

Το playground είναι απενεργοποιημένο. Μπορείτε να βρείτε συγκρίσιμα μοντέλα στην ίδια κατηγορία: Περιήγηση εναλλακτικών λύσεων

Δοκιμάστε LLaVA-OneVision 72B

0 / 16.000

Προηγμένες ρυθμίσεις (4)

0 / 8.000

Αποτέλεσμα
Η απάντηση εμφανίζεται εδώ.

Αυτή η εκτέλεση

Χωρίς τιμή – προς το παρόν μη διαθέσιμο.

Νέος εδώ;

5 δωρεάν πιστωτικές μονάδες (0,05 $) όταν εγγραφείς με Google

Χρησιμοποιήσιμο 24 ώρες μετά την εγγραφή, έως 5 εκτελέσεις ανά ημέρα και το πολύ 2 πιστωτικές μονάδες ανά εκτέλεση. Άλλες μέθοδοι σύνδεσης ξεκινούν χωρίς πιστωτικές μονάδες.

03

Σχετικά με το LLaVA-OneVision 72B

ΣύντομαΗμερομηνία: 25 Ιουνίου 2026

Το LLaVA-OneVision 72B είναι ένα μοντέλο του Replicate στην κατηγορία Multimodal. Το LLaVA-OneVision 72B δεν είναι διαθέσιμο στο Railwail αυτή τη στιγμή. Το παράθυρο περιεχομένου περιέχει 32,768 tokens, και μια απάντηση μπορεί να είναι έως 4,096 tokens.

04

Τιμολόγηση

Προς το παρόν μη διαθέσιμο: αυτό το μοντέλο έχει απενεργοποιηθεί. Δεν υπάρχει τιμή για αυτό το μοντέλο αυτή τη στιγμή, επομένως δεν μπορεί να εκτελεστεί.

05

API

Καλέστε το LLaVA-OneVision 72B με το κλειδί Railwail API. Χρησιμοποιήστε αυτό το ID μοντέλου στο αίτημα:

Κανένα επαληθευμένο παράδειγμα API

Το δημόσιο API περνά μια διαφορετική μορφή εισόδου από αυτή που χρειάζεται αυτό το μοντέλο. Χρησιμοποιήστε το playground παραπάνω.

06

Προδιαγραφές

ID μοντέλου
llava-onevision-72b
Ανάπτυξη
Replicate
Κατηγορία
Multimodal
Είσοδος
Κείμενο, Εικόνα, Βίντεο
Έξοδος
Κείμενο
Παράθυρο περιεχομένου
32,768 tokens
Μέγ. έξοδος
4,096 tokens
Καταχώρηση καταλόγου ενημερώθηκε
25 Ιουνίου 2026

Παράμετροι εισόδου

Εισόδους και ρυθμίσεις από το σχήμα εισόδου του μοντέλου. Το παράδειγμα στην ενότητα API δείχνει ποιες από αυτές δέχεται το API.

  • promptΥποχρεωτικό

    User message or question about the image

    Τύπος: Κείμενο
    Προεπιλογή:
    Επιτρεπόμενες τιμές: Έως 16,000 χαρακτήρες
  • top_p
    Τύπος: Αριθμός
    Προεπιλογή: 1
    Επιτρεπόμενες τιμές: 0 έως 1
  • stream
    Τύπος: Ναι/Όχι
    Προεπιλογή: false
    Επιτρεπόμενες τιμές:
  • image_url

    Optional image URL to analyze

    Τύπος: Κείμενο
    Προεπιλογή:
    Επιτρεπόμενες τιμές:
  • max_tokens
    Τύπος: Ακέραιος αριθμός
    Προεπιλογή: 1024
    Επιτρεπόμενες τιμές: 1 έως 4,096
  • temperature
    Τύπος: Αριθμός
    Προεπιλογή: 0.7
    Επιτρεπόμενες τιμές: 0 έως 2
  • system_prompt

    Optional system instruction

    Τύπος: Κείμενο
    Προεπιλογή:
    Επιτρεπόμενες τιμές: Έως 8,000 χαρακτήρες

Ετικέτες

  • replicate
  • multimodal
  • vision-understanding
  • llava
  • open-weights
07

Συχνές ερωτήσεις

Τι είναι LLaVA-OneVision 72B;

Το LLaVA-OneVision 72B είναι ένα μοντέλο του Replicate στην κατηγορία Multimodal. Είναι καταχωρημένο στο Railwail αλλά δεν μπορεί να εκτελεστεί αυτή τη στιγμή.

Πόσο κοστίζει το LLaVA-OneVision 72B στο Railwail;

Το LLaVA-OneVision 72B δεν μπορεί να εκτελεστεί στο Railwail αυτή τη στιγμή, επομένως δεν υπάρχει τρέχουσα τιμή. Διαθέσιμες εναλλακτικές λύσεις με τιμές παρατίθενται παρακάτω σε αυτήν τη σελίδα.

Ποιο είναι το παράθυρο περιεχομένου του LLaVA-OneVision 72B;

Το παράθυρο περιεχομένου του LLaVA-OneVision 72B περιέχει 32,768 tokens. Μια απάντηση μπορεί να είναι έως 4,096 tokens.

Πόσο γρήγορο είναι το LLaVA-OneVision 72B;

Δεν υπάρχουν αρκετές μετρημένες εκτελέσεις του LLaVA-OneVision 72B στο Railwail ακόμα για να δηλωθεί ένας χρόνος εκτέλεσης. Εξαρτάται από την είσοδο, τις ρυθμίσεις και το φορτίο στον πάροχο.

Είναι το LLaVA-OneVision 72B καλύτερο από το BLIP;

Αυτό εξαρτάται από την εργασία. Το LLaVA-OneVision 72B (Replicate) και το BLIP (Salesforce) είναι και τα δύο μοντέλα στην κατηγορία Multimodal. Η σελίδα σύγκρισης δείχνει τις τιμές και τις προδιαγραφές τους παράλληλα.

Σύγκριση LLaVA-OneVision 72B και BLIP

Μπορεί το LLaVA-OneVision 72B να επεξεργαστεί εικόνες;

Ναι. Το LLaVA-OneVision 72B δέχεται εικόνες ως είσοδο εκτός από κείμενο.

Μπορώ να χρησιμοποιήσω το LLaVA-OneVision 72B τώρα;

Προς το παρόν μη διαθέσιμο: αυτό το μοντέλο έχει απενεργοποιηθεί. Η σελίδα παραμένει ενεργή· διαθέσιμες εναλλακτικές λύσεις από την ίδια κατηγορία παρατίθενται παρακάτω.

Όλα τα μοντέλα μέσω ενός API

Ένα κλειδί API για κάθε μοντέλο στο Railwail. Η χρήση χρεώνεται από προπληρωμένα πιστωτικά, 1 πιστωτικό = 0,01 $.