Gemini 1.5 Pro (vision)
gemini-1-5-pro-visionGoogle Gemini 1.5 Pro with native multimodal input. Reads images, long PDFs, audio and video in up to a 2M-token context, useful for whole-document and long-video understanding.
- Κατάσταση
- Μη διαθέσιμο
- Περιεχόμενο
- 2.097.152 tokens
- Μέγ. έξοδος
- 8.192 tokens
- Είσοδος → Έξοδος
- Κείμενο + Εικόνα + Ήχος + Βίντεο → Κείμενο
- Προγραμματιστής
- Google DeepMind
- Ενημερώθηκε
- 23 Σεπτεμβρίου 2026
Το Gemini 1.5 Pro (vision) δεν είναι διαθέσιμο αυτή τη στιγμή
Μπορείτε να διαβάσετε τις λεπτομέρειες σε αυτήν τη σελίδα. Επιλέξτε μία από τις διαθέσιμες εναλλακτικές λύσεις παρακάτω για να εκτελέσετε αμέσως ένα συγκρίσιμο μοντέλο.
Μετάβαση στις εναλλακτικές λύσειςΟ πάροχος απέσυρε αυτό το μοντέλο.
Συγκρίσιμα μοντέλα
Όλα σε αυτήν την κατηγορία- BLIPSalesforce
Salesforce BLIP. Vision-language model for image captioning and visual question answering. Given an image it writes a short natural-language caption, or answers a question about the image when one is supplied. A widely used baseline for automatic captioning.
≈ 0,00030 $/εκτέλεση
Σύγκριση Gemini 1.5 Pro (vision) και BLIP - Claude Opus 4.7Anthropic
Anthropic's April 2026 flagship. 87.6% on SWE-bench Verified, 3x higher image resolution, output self-verification, vision + reasoning.
- Claude Sonnet 4.6Anthropic
Anthropic's balanced mid-tier model from February 2026. Best price/performance for production workloads: 5x cheaper than Opus, near-flagship quality.
Playground
Δοκιμάστε Gemini 1.5 Pro (vision)
Συνομιλία
Προς το παρόν μη διαθέσιμο.
Το playground είναι απενεργοποιημένο. Μπορείτε να βρείτε συγκρίσιμα μοντέλα στην ίδια κατηγορία: Περιήγηση εναλλακτικών λύσεων
Αυτή η εκτέλεση
Χωρίς τιμή – προς το παρόν μη διαθέσιμο.
Νέος εδώ;
10 δωρεάν πιστωτικές μονάδες (0,10 $) όταν εγγραφείς με Google
Χρησιμοποιήσιμο 24 ώρες μετά την εγγραφή, έως 5 εκτελέσεις ανά ημέρα και το πολύ 2 πιστωτικές μονάδες ανά εκτέλεση. Άλλες μέθοδοι σύνδεσης ξεκινούν χωρίς πιστωτικές μονάδες.
Σχετικά με το Gemini 1.5 Pro (vision)
Το Gemini 1.5 Pro (vision) είναι ένα μοντέλο του Google DeepMind στην κατηγορία Multimodal. Το Gemini 1.5 Pro (vision) δεν είναι διαθέσιμο στο Railwail αυτή τη στιγμή. Το παράθυρο περιεχομένου περιέχει 2.097.152 tokens, και μια απάντηση μπορεί να είναι έως 8.192 tokens.
Τιμολόγηση
Προς το παρόν μη διαθέσιμο. Δεν υπάρχει τιμή για αυτό το μοντέλο αυτή τη στιγμή, επομένως δεν μπορεί να εκτελεστεί.
API
Προς το παρόν μη διαθέσιμο
Το μοντέλο δεν έχει επαληθευμένη τιμή ή είναι απενεργοποιημένο· οι κλήσεις API απορρίπτονται.
Προδιαγραφές
- ID μοντέλου
gemini-1-5-pro-vision- Ανάπτυξη
- Google DeepMind
- Κατηγορία
- Multimodal
- Είσοδος
- Κείμενο, Εικόνα, Ήχος, Βίντεο
- Έξοδος
- Κείμενο
- Παράθυρο περιεχομένου
- 2.097.152 tokens
- Μέγ. έξοδος
- 8.192 tokens
- Κύκλος ζωής
- Αποσύρθηκε
- Καταχώρηση καταλόγου ενημερώθηκε
- 23 Σεπτεμβρίου 2026
Παράμετροι εισόδου
Εισόδους και ρυθμίσεις από το σχήμα εισόδου του μοντέλου. Το παράδειγμα στην ενότητα API δείχνει ποιες από αυτές δέχεται το API.
promptΥποχρεωτικόQuestion or instruction about the media
Τύπος: ΚείμενοΠροεπιλογή: –Επιτρεπόμενες τιμές: Έως 32.000 χαρακτήρεςtop_pΤύπος: ΑριθμόςΠροεπιλογή:0.95Επιτρεπόμενες τιμές: 0 έως 1streamΤύπος: Ναι/ΌχιΠροεπιλογή:falseΕπιτρεπόμενες τιμές: –image_urlImage, PDF or video URL to analyze
Τύπος: ΚείμενοΠροεπιλογή: –Επιτρεπόμενες τιμές: –max_tokensΤύπος: Ακέραιος αριθμόςΠροεπιλογή:2048Επιτρεπόμενες τιμές: 1 έως 8.192temperatureΤύπος: ΑριθμόςΠροεπιλογή:1Επιτρεπόμενες τιμές: 0 έως 2system_promptOptional system instruction
Τύπος: ΚείμενοΠροεπιλογή: –Επιτρεπόμενες τιμές: Έως 8.000 χαρακτήρες
Ετικέτες
- gemini
- vision
- multimodal
- long-context
- video-understanding
Συχνές ερωτήσεις
Τι είναι Gemini 1.5 Pro (vision);
Το Gemini 1.5 Pro (vision) είναι ένα μοντέλο του Google DeepMind στην κατηγορία Multimodal. Είναι καταχωρημένο στο Railwail αλλά δεν μπορεί να εκτελεστεί αυτή τη στιγμή.
Πόσο κοστίζει το Gemini 1.5 Pro (vision) στο Railwail;
Το Gemini 1.5 Pro (vision) δεν μπορεί να εκτελεστεί στο Railwail αυτή τη στιγμή, επομένως δεν υπάρχει τρέχουσα τιμή. Διαθέσιμες εναλλακτικές λύσεις με τιμές παρατίθενται παρακάτω σε αυτήν τη σελίδα.
Ποιο είναι το παράθυρο περιεχομένου του Gemini 1.5 Pro (vision);
Το παράθυρο περιεχομένου του Gemini 1.5 Pro (vision) περιέχει 2.097.152 tokens. Μια απάντηση μπορεί να είναι έως 8.192 tokens.
Πόσο γρήγορο είναι το Gemini 1.5 Pro (vision);
Δεν υπάρχουν αρκετές μετρημένες εκτελέσεις του Gemini 1.5 Pro (vision) στο Railwail ακόμα για να δηλωθεί ένας χρόνος εκτέλεσης. Εξαρτάται από την είσοδο, τις ρυθμίσεις και το φορτίο στον πάροχο.
Είναι το Gemini 1.5 Pro (vision) καλύτερο από το BLIP;
Αυτό εξαρτάται από την εργασία. Το Gemini 1.5 Pro (vision) (Google DeepMind) και το BLIP (Salesforce) είναι και τα δύο μοντέλα στην κατηγορία Multimodal. Η σελίδα σύγκρισης δείχνει τις τιμές και τις προδιαγραφές τους παράλληλα.
Σύγκριση Gemini 1.5 Pro (vision) και BLIPΜπορεί το Gemini 1.5 Pro (vision) να επεξεργαστεί εικόνες;
Ναι. Το Gemini 1.5 Pro (vision) δέχεται εικόνες ως είσοδο εκτός από κείμενο.
Μπορώ να χρησιμοποιήσω το Gemini 1.5 Pro (vision) τώρα;
Προς το παρόν μη διαθέσιμο. Η σελίδα παραμένει ενεργή· διαθέσιμες εναλλακτικές λύσεις από την ίδια κατηγορία παρατίθενται παρακάτω.
Όλα τα μοντέλα μέσω ενός API
Ένα κλειδί API για κάθε μοντέλο στο Railwail. Η χρήση χρεώνεται από προπληρωμένα πιστωτικά, 1 πιστωτικό = 0,01 $.