Gemini 1.5 Flash (vision)

MultimodalΑποσύρθηκεΜη διαθέσιμο
από Google DeepMindΑναγνωριστικό μοντέλου: gemini-1-5-flash-vision

Google Gemini 1.5 Flash, the fast low-cost multimodal model. 1M-token context, image/audio/video input, good for high-volume captioning, classification and long-video skim tasks.

Κατάσταση
Μη διαθέσιμο
Περιεχόμενο
1.048.576 tokens
Μέγ. έξοδος
8.192 tokens
Είσοδος → Έξοδος
Κείμενο + Εικόνα + Ήχος + Βίντεο → Κείμενο
Προγραμματιστής
Google DeepMind
Ενημερώθηκε
23 Σεπτεμβρίου 2026

Το Gemini 1.5 Flash (vision) δεν είναι διαθέσιμο αυτή τη στιγμή

Μπορείτε να διαβάσετε τις λεπτομέρειες σε αυτήν τη σελίδα. Επιλέξτε μία από τις διαθέσιμες εναλλακτικές λύσεις παρακάτω για να εκτελέσετε αμέσως ένα συγκρίσιμο μοντέλο.

Μετάβαση στις εναλλακτικές λύσεις

Ο πάροχος απέσυρε αυτό το μοντέλο.

01

Συγκρίσιμα μοντέλα

Όλα σε αυτήν την κατηγορία
02

Playground

Δοκιμάστε Gemini 1.5 Flash (vision)

Συνομιλία

Προς το παρόν μη διαθέσιμο

Προς το παρόν μη διαθέσιμο.

Το playground είναι απενεργοποιημένο. Μπορείτε να βρείτε συγκρίσιμα μοντέλα στην ίδια κατηγορία: Περιήγηση εναλλακτικών λύσεων

Δοκιμάστε Gemini 1.5 Flash (vision)

Στείλτε ένα μήνυμα. Η απάντηση φτάνει πλήρης όταν το μοντέλο τελειώσει (χωρίς streaming).

Μέγ. μήκος απάντησης (tokens)

Αυτή η εκτέλεση

Χωρίς τιμή – προς το παρόν μη διαθέσιμο.

Νέος εδώ;

10 δωρεάν πιστωτικές μονάδες (0,10 $) όταν εγγραφείς με Google

Χρησιμοποιήσιμο 24 ώρες μετά την εγγραφή, έως 5 εκτελέσεις ανά ημέρα και το πολύ 2 πιστωτικές μονάδες ανά εκτέλεση. Άλλες μέθοδοι σύνδεσης ξεκινούν χωρίς πιστωτικές μονάδες.

03

Σχετικά με το Gemini 1.5 Flash (vision)

ΣύντομαΗμερομηνία: 23 Σεπτεμβρίου 2026

Το Gemini 1.5 Flash (vision) είναι ένα μοντέλο του Google DeepMind στην κατηγορία Multimodal. Το Gemini 1.5 Flash (vision) δεν είναι διαθέσιμο στο Railwail αυτή τη στιγμή. Το παράθυρο περιεχομένου περιέχει 1.048.576 tokens, και μια απάντηση μπορεί να είναι έως 8.192 tokens.

Gemini 1.5 Flash is the latency- and cost-optimized member of the 1.5 family while keeping native multimodal input and a 1M-token context. It handles images, audio and video and is a practical default for high-throughput visual workloads: bulk captioning and tagging, content moderation, screenshot reading for agents, and quick passes over long videos before sending hard cases to a Pro model.
04

Τιμολόγηση

Προς το παρόν μη διαθέσιμο. Δεν υπάρχει τιμή για αυτό το μοντέλο αυτή τη στιγμή, επομένως δεν μπορεί να εκτελεστεί.

05

API

Καλέστε το Gemini 1.5 Flash (vision) με το κλειδί Railwail API. Χρησιμοποιήστε αυτό το ID μοντέλου στο αίτημα:

Προς το παρόν μη διαθέσιμο

Το μοντέλο δεν έχει επαληθευμένη τιμή ή είναι απενεργοποιημένο· οι κλήσεις API απορρίπτονται.

06

Προδιαγραφές

ID μοντέλου
gemini-1-5-flash-vision
Ανάπτυξη
Google DeepMind
Κατηγορία
Multimodal
Είσοδος
Κείμενο, Εικόνα, Ήχος, Βίντεο
Έξοδος
Κείμενο
Παράθυρο περιεχομένου
1.048.576 tokens
Μέγ. έξοδος
8.192 tokens
Κύκλος ζωής
Αποσύρθηκε
Καταχώρηση καταλόγου ενημερώθηκε
23 Σεπτεμβρίου 2026

Παράμετροι εισόδου

Εισόδους και ρυθμίσεις από το σχήμα εισόδου του μοντέλου. Το παράδειγμα στην ενότητα API δείχνει ποιες από αυτές δέχεται το API.

  • promptΥποχρεωτικό

    Question or instruction about the media

    Τύπος: Κείμενο
    Προεπιλογή: –
    Επιτρεπόμενες τιμές: Έως 32.000 χαρακτήρες
  • top_p
    Τύπος: Αριθμός
    Προεπιλογή: 0.95
    Επιτρεπόμενες τιμές: 0 έως 1
  • stream
    Τύπος: Ναι/Όχι
    Προεπιλογή: false
    Επιτρεπόμενες τιμές: –
  • image_url

    Image, PDF or video URL to analyze

    Τύπος: Κείμενο
    Προεπιλογή: –
    Επιτρεπόμενες τιμές: –
  • max_tokens
    Τύπος: Ακέραιος αριθμός
    Προεπιλογή: 2048
    Επιτρεπόμενες τιμές: 1 έως 8.192
  • temperature
    Τύπος: Αριθμός
    Προεπιλογή: 1
    Επιτρεπόμενες τιμές: 0 έως 2
  • system_prompt

    Optional system instruction

    Τύπος: Κείμενο
    Προεπιλογή: –
    Επιτρεπόμενες τιμές: Έως 8.000 χαρακτήρες

Ετικέτες

  • google
  • gemini
  • vision
  • multimodal
  • cost-efficient
  • long-context
07

Συχνές ερωτήσεις

Τι είναι Gemini 1.5 Flash (vision);

Το Gemini 1.5 Flash (vision) είναι ένα μοντέλο του Google DeepMind στην κατηγορία Multimodal. Είναι καταχωρημένο στο Railwail αλλά δεν μπορεί να εκτελεστεί αυτή τη στιγμή.

Πόσο κοστίζει το Gemini 1.5 Flash (vision) στο Railwail;

Το Gemini 1.5 Flash (vision) δεν μπορεί να εκτελεστεί στο Railwail αυτή τη στιγμή, επομένως δεν υπάρχει τρέχουσα τιμή. Διαθέσιμες εναλλακτικές λύσεις με τιμές παρατίθενται παρακάτω σε αυτήν τη σελίδα.

Ποιο είναι το παράθυρο περιεχομένου του Gemini 1.5 Flash (vision);

Το παράθυρο περιεχομένου του Gemini 1.5 Flash (vision) περιέχει 1.048.576 tokens. Μια απάντηση μπορεί να είναι έως 8.192 tokens.

Πόσο γρήγορο είναι το Gemini 1.5 Flash (vision);

Δεν υπάρχουν αρκετές μετρημένες εκτελέσεις του Gemini 1.5 Flash (vision) στο Railwail ακόμα για να δηλωθεί ένας χρόνος εκτέλεσης. Εξαρτάται από την είσοδο, τις ρυθμίσεις και το φορτίο στον πάροχο.

Είναι το Gemini 1.5 Flash (vision) καλύτερο από το BLIP;

Αυτό εξαρτάται από την εργασία. Το Gemini 1.5 Flash (vision) (Google DeepMind) και το BLIP (Salesforce) είναι και τα δύο μοντέλα στην κατηγορία Multimodal. Η σελίδα σύγκρισης δείχνει τις τιμές και τις προδιαγραφές τους παράλληλα.

Σύγκριση Gemini 1.5 Flash (vision) και BLIP

Μπορεί το Gemini 1.5 Flash (vision) να επεξεργαστεί εικόνες;

Ναι. Το Gemini 1.5 Flash (vision) δέχεται εικόνες ως είσοδο εκτός από κείμενο.

Μπορώ να χρησιμοποιήσω το Gemini 1.5 Flash (vision) τώρα;

Προς το παρόν μη διαθέσιμο. Η σελίδα παραμένει ενεργή· διαθέσιμες εναλλακτικές λύσεις από την ίδια κατηγορία παρατίθενται παρακάτω.

Όλα τα μοντέλα μέσω ενός API

Ένα κλειδί API για κάθε μοντέλο στο Railwail. Η χρήση χρεώνεται από προπληρωμένα πιστωτικά, 1 πιστωτικό = 0,01 $.