Gemini 1.5 Pro (vision)

MultimodalΑποσύρθηκεΜη διαθέσιμο
από Google DeepMindΑναγνωριστικό μοντέλου: gemini-1-5-pro-vision

Google Gemini 1.5 Pro with native multimodal input. Reads images, long PDFs, audio and video in up to a 2M-token context, useful for whole-document and long-video understanding.

Κατάσταση
Μη διαθέσιμο
Περιεχόμενο
2.097.152 tokens
Μέγ. έξοδος
8.192 tokens
Είσοδος → Έξοδος
Κείμενο + Εικόνα + Ήχος + Βίντεο → Κείμενο
Προγραμματιστής
Google DeepMind
Ενημερώθηκε
23 Σεπτεμβρίου 2026

Το Gemini 1.5 Pro (vision) δεν είναι διαθέσιμο αυτή τη στιγμή

Μπορείτε να διαβάσετε τις λεπτομέρειες σε αυτήν τη σελίδα. Επιλέξτε μία από τις διαθέσιμες εναλλακτικές λύσεις παρακάτω για να εκτελέσετε αμέσως ένα συγκρίσιμο μοντέλο.

Μετάβαση στις εναλλακτικές λύσεις

Ο πάροχος απέσυρε αυτό το μοντέλο.

01

Συγκρίσιμα μοντέλα

Όλα σε αυτήν την κατηγορία
02

Playground

Δοκιμάστε Gemini 1.5 Pro (vision)

Συνομιλία

Προς το παρόν μη διαθέσιμο

Προς το παρόν μη διαθέσιμο.

Το playground είναι απενεργοποιημένο. Μπορείτε να βρείτε συγκρίσιμα μοντέλα στην ίδια κατηγορία: Περιήγηση εναλλακτικών λύσεων

Δοκιμάστε Gemini 1.5 Pro (vision)

Στείλτε ένα μήνυμα. Η απάντηση φτάνει πλήρης όταν το μοντέλο τελειώσει (χωρίς streaming).

Μέγ. μήκος απάντησης (tokens)

Αυτή η εκτέλεση

Χωρίς τιμή – προς το παρόν μη διαθέσιμο.

Νέος εδώ;

10 δωρεάν πιστωτικές μονάδες (0,10 $) όταν εγγραφείς με Google

Χρησιμοποιήσιμο 24 ώρες μετά την εγγραφή, έως 5 εκτελέσεις ανά ημέρα και το πολύ 2 πιστωτικές μονάδες ανά εκτέλεση. Άλλες μέθοδοι σύνδεσης ξεκινούν χωρίς πιστωτικές μονάδες.

03

Σχετικά με το Gemini 1.5 Pro (vision)

ΣύντομαΗμερομηνία: 23 Σεπτεμβρίου 2026

Το Gemini 1.5 Pro (vision) είναι ένα μοντέλο του Google DeepMind στην κατηγορία Multimodal. Το Gemini 1.5 Pro (vision) δεν είναι διαθέσιμο στο Railwail αυτή τη στιγμή. Το παράθυρο περιεχομένου περιέχει 2.097.152 tokens, και μια απάντηση μπορεί να είναι έως 8.192 tokens.

Gemini 1.5 Pro accepts text, images, audio and video tokens in a single pass with a context window up to 2M tokens. That lets it ingest entire PDFs, hour-long videos or large image sets and answer questions across them. Common uses: long-document visual QA, video summarization and frame-level analysis, and mixed media extraction. Function calling and JSON output are first-class via the Gemini API.
04

Τιμολόγηση

Προς το παρόν μη διαθέσιμο. Δεν υπάρχει τιμή για αυτό το μοντέλο αυτή τη στιγμή, επομένως δεν μπορεί να εκτελεστεί.

05

API

Καλέστε το Gemini 1.5 Pro (vision) με το κλειδί Railwail API. Χρησιμοποιήστε αυτό το ID μοντέλου στο αίτημα:

Προς το παρόν μη διαθέσιμο

Το μοντέλο δεν έχει επαληθευμένη τιμή ή είναι απενεργοποιημένο· οι κλήσεις API απορρίπτονται.

06

Προδιαγραφές

ID μοντέλου
gemini-1-5-pro-vision
Ανάπτυξη
Google DeepMind
Κατηγορία
Multimodal
Είσοδος
Κείμενο, Εικόνα, Ήχος, Βίντεο
Έξοδος
Κείμενο
Παράθυρο περιεχομένου
2.097.152 tokens
Μέγ. έξοδος
8.192 tokens
Κύκλος ζωής
Αποσύρθηκε
Καταχώρηση καταλόγου ενημερώθηκε
23 Σεπτεμβρίου 2026

Παράμετροι εισόδου

Εισόδους και ρυθμίσεις από το σχήμα εισόδου του μοντέλου. Το παράδειγμα στην ενότητα API δείχνει ποιες από αυτές δέχεται το API.

  • promptΥποχρεωτικό

    Question or instruction about the media

    Τύπος: Κείμενο
    Προεπιλογή: –
    Επιτρεπόμενες τιμές: Έως 32.000 χαρακτήρες
  • top_p
    Τύπος: Αριθμός
    Προεπιλογή: 0.95
    Επιτρεπόμενες τιμές: 0 έως 1
  • stream
    Τύπος: Ναι/Όχι
    Προεπιλογή: false
    Επιτρεπόμενες τιμές: –
  • image_url

    Image, PDF or video URL to analyze

    Τύπος: Κείμενο
    Προεπιλογή: –
    Επιτρεπόμενες τιμές: –
  • max_tokens
    Τύπος: Ακέραιος αριθμός
    Προεπιλογή: 2048
    Επιτρεπόμενες τιμές: 1 έως 8.192
  • temperature
    Τύπος: Αριθμός
    Προεπιλογή: 1
    Επιτρεπόμενες τιμές: 0 έως 2
  • system_prompt

    Optional system instruction

    Τύπος: Κείμενο
    Προεπιλογή: –
    Επιτρεπόμενες τιμές: Έως 8.000 χαρακτήρες

Ετικέτες

  • google
  • gemini
  • vision
  • multimodal
  • long-context
  • video-understanding
07

Συχνές ερωτήσεις

Τι είναι Gemini 1.5 Pro (vision);

Το Gemini 1.5 Pro (vision) είναι ένα μοντέλο του Google DeepMind στην κατηγορία Multimodal. Είναι καταχωρημένο στο Railwail αλλά δεν μπορεί να εκτελεστεί αυτή τη στιγμή.

Πόσο κοστίζει το Gemini 1.5 Pro (vision) στο Railwail;

Το Gemini 1.5 Pro (vision) δεν μπορεί να εκτελεστεί στο Railwail αυτή τη στιγμή, επομένως δεν υπάρχει τρέχουσα τιμή. Διαθέσιμες εναλλακτικές λύσεις με τιμές παρατίθενται παρακάτω σε αυτήν τη σελίδα.

Ποιο είναι το παράθυρο περιεχομένου του Gemini 1.5 Pro (vision);

Το παράθυρο περιεχομένου του Gemini 1.5 Pro (vision) περιέχει 2.097.152 tokens. Μια απάντηση μπορεί να είναι έως 8.192 tokens.

Πόσο γρήγορο είναι το Gemini 1.5 Pro (vision);

Δεν υπάρχουν αρκετές μετρημένες εκτελέσεις του Gemini 1.5 Pro (vision) στο Railwail ακόμα για να δηλωθεί ένας χρόνος εκτέλεσης. Εξαρτάται από την είσοδο, τις ρυθμίσεις και το φορτίο στον πάροχο.

Είναι το Gemini 1.5 Pro (vision) καλύτερο από το BLIP;

Αυτό εξαρτάται από την εργασία. Το Gemini 1.5 Pro (vision) (Google DeepMind) και το BLIP (Salesforce) είναι και τα δύο μοντέλα στην κατηγορία Multimodal. Η σελίδα σύγκρισης δείχνει τις τιμές και τις προδιαγραφές τους παράλληλα.

Σύγκριση Gemini 1.5 Pro (vision) και BLIP

Μπορεί το Gemini 1.5 Pro (vision) να επεξεργαστεί εικόνες;

Ναι. Το Gemini 1.5 Pro (vision) δέχεται εικόνες ως είσοδο εκτός από κείμενο.

Μπορώ να χρησιμοποιήσω το Gemini 1.5 Pro (vision) τώρα;

Προς το παρόν μη διαθέσιμο. Η σελίδα παραμένει ενεργή· διαθέσιμες εναλλακτικές λύσεις από την ίδια κατηγορία παρατίθενται παρακάτω.

Όλα τα μοντέλα μέσω ενός API

Ένα κλειδί API για κάθε μοντέλο στο Railwail. Η χρήση χρεώνεται από προπληρωμένα πιστωτικά, 1 πιστωτικό = 0,01 $.