Gemini 3 Flash

MultimodalΛηγμένοΔιαθέσιμο
από Google DeepMindΑναγνωριστικό μοντέλου: gemini-3-flash

Google's April 2026 fast multimodal model. Combines Gemini 3 Pro's reasoning with Flash-tier latency and price. Default model in the Gemini app.

Τιμή · 1M εισόδου / εξόδου
0,60 $ / 3,60 $
Περιεχόμενο
1.048.576 tokens
Μέγ. έξοδος
65.536 tokens
Είσοδος → Έξοδος
Κείμενο + Εικόνα + Ήχος + Βίντεο → Κείμενο
Προγραμματιστής
Google DeepMind
Ενημερώθηκε
23 Σεπτεμβρίου 2026

Ο πάροχος διακόπτει αυτό το μοντέλο.

01

Playground

Δοκιμάστε Gemini 3 Flash

Συνομιλία

0,60 $/1M in
Δοκιμάστε Gemini 3 Flash

Στείλτε ένα μήνυμα. Η απάντηση φτάνει πλήρης όταν το μοντέλο τελειώσει (χωρίς streaming).

Μέγ. μήκος απάντησης (tokens)

Αυτή η εκτέλεση

το πολύ 0,0037 $ · 0,37 πιστωτικές μονάδες προεπιλεγμένες

Χρεώνονται τα tokens που χρησιμοποιήθηκαν πραγματικά· το αχρησιμοποίητο μέρος της προεπιλογής επιστρέφεται.

Νέος εδώ;

10 δωρεάν πιστωτικές μονάδες (0,10 $) όταν εγγραφείς με Google

Χρησιμοποιήσιμο 24 ώρες μετά την εγγραφή, έως 5 εκτελέσεις ανά ημέρα και το πολύ 2 πιστωτικές μονάδες ανά εκτέλεση. Άλλες μέθοδοι σύνδεσης ξεκινούν χωρίς πιστωτικές μονάδες. Αρκετό για 27 εκτελέσεις αυτού του μοντέλου.

02

Σχετικά με το Gemini 3 Flash

ΣύντομαΗμερομηνία: 23 Σεπτεμβρίου 2026

Το Gemini 3 Flash είναι ένα μοντέλο του Google DeepMind στην κατηγορία Multimodal. Στο Railwail, το Gemini 3 Flash κοστίζει 0,60 $ ανά 1M tokens εισόδου και 3,60 $ ανά 1M tokens εξόδου. Το παράθυρο περιεχομένου περιέχει 1.048.576 tokens, και μια απάντηση μπορεί να είναι έως 65.536 tokens.

Announced April 22, 2026, Gemini 3 Flash brings Pro-grade reasoning to the Flash latency tier. 1M-token context, fully multimodal (text, image, audio, video), 65K max output. The default model in the Gemini app and AI Mode in Search. PhD-level reasoning on common benchmarks at a fraction of the cost of 3.1 Pro. Recommended for high-throughput agentic workflows, real-time multimodal chat, RAG and consumer applications.

Φόντο

Σχετικά με Google DeepMind

Ιδρύθηκε 2010 · Mountain View, USA / London, UK

Google DeepMind is the merged AI research organisation formed in April 2023 by combining Google Brain with DeepMind. Demis Hassabis leads the unit as CEO. Flash variants have been Google's high-throughput tier since Gemini 1.5 Flash (May 2024), with Gemini 2.0 Flash (December 2024), 2.5 Flash (mid-2025) and Gemini 3 Flash (April 2026) representing the progression. DeepMind's seminal papers include 'Attention Is All You Need' (2017), AlphaGo (2016), AlphaFold (2018-2021, Nobel Prize 2024) and the Gemini Technical Report.

Επισκεφθείτε Google DeepMind

Αρχιτεκτονική

Sparse Mixture-of-Experts Transformer (multimodal, latency-optimized)

Gemini 3 Flash was announced April 22, 2026 as the default Flash-tier model and the new default model in the Gemini app and AI Mode in Search. It is a natively multimodal Sparse MoE Transformer engineered to combine Gemini 3 Pro's reasoning quality with Flash-grade latency, efficiency and cost. Pretraining used Google's TPU v6e infrastructure on a multi-trillion-token mixture of web text, code, books, image-text pairs, audio and video frames. Post-training combined supervised fine-tuning, RLHF, RL against verifiable rewards and distillation from larger Gemini 3.1 Pro teacher models. The architecture preserves Gemini's native multimodality across text, image, audio and video, the full tool-use API and Search grounding, while running at a fraction of Pro pricing. Gemini 3 Flash is the recommended default for high-throughput agentic workflows and consumer-facing multimodal chat.

Παράμετροι
Undisclosed (sparse MoE, smaller and sparser than Gemini 3.1 Pro)
Περιεχόμενο
1.048.576 tokens

Δυνατότητες

  • Pro-grade reasoning at Flash latency
  • 1,048,576 token context window
  • Natively multimodal: text, image, audio and video
  • Search grounding and Code Execution built into the API
  • Function calling, JSON schema and parallel tool calls
  • Default model in the Gemini app and AI Mode in Search
  • PhD-level reasoning on common benchmarks
  • Available via Vertex AI, AI Studio, Gemini Enterprise, Antigravity and the Gemini app
  • Strong long-video understanding (hour-long clips)
  • Cross-lingual fluency across 100+ languages
  • Best for: high-throughput agentic workflows, real-time multimodal chat, RAG, consumer applications.

Εκπαίδευση & άδεια

Pretrained on a multi-trillion-token mixture of web text, code, books, scientific papers, image-text pairs, audio and video frames. Heavily distilled from larger Gemini 3.1 Pro teacher models. Post-training uses supervised fine-tuning, RLHF and RL against verifiable rewards. Knowledge cutoff in late 2025.

Άδεια: Proprietary commercial license via Google AI Studio, Vertex AI and the Gemini app. Free tier available in the Gemini app and AI Mode in Search.

Δοκιμές ασφάλειας: Evaluated under Google DeepMind's Frontier Safety Framework v2 with internal red teams and external evaluators.

Γνωστοί περιορισμοί

  • Below Gemini 3.1 Pro on the hardest reasoning and long-context benchmarks
  • Smaller context window than 3.1 Pro (1M vs 2M)
  • Vision can misread dense tables and handwriting
  • Region availability is rolling out in 2026
  • Audio output not yet supported
03

Τιμολόγηση

Οι τιμές είναι σε δολάρια ΗΠΑ. Η χρήση χρεώνεται από προπληρωμένα πιστωτικά.
Είσοδος0,60 $ / 1M tokens
Έξοδος3,60 $ / 1M tokens
  • Χρέωση με βάση τα tokens που χρησιμοποιεί πραγματικά κάθε αίτημα.
  • 1 πιστωτική μονάδα = 0,01 $

Αριθμομηχανή κόστους

Αριθμομηχανή τιμών

/ αίτημα
/ αίτημα

Σύνολο

0,24 $

24 πιστωτικές μονάδες

Ανά αίτημα

0,0024 $ · 0,24 πιστωτικές μονάδες

Κάθε αίτημα στρογγυλοποιείται προς τα πάνω σε 0,01 πιστωτικές μονάδες.

04

API

Καλέστε το Gemini 3 Flash με το κλειδί Railwail API. Χρησιμοποιήστε αυτό το ID μοντέλου στο αίτημα:
curl https://railwail.com/api/v1/chat/completions \
  -H "Authorization: Bearer $RAILWAIL_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "gemini-3-flash",
    "messages": [
      {
        "role": "user",
        "content": "Explain what a vector database is in two sentences."
      }
    ],
    "max_tokens": 1024
  }'
Ορίστε το κλειδί σας ως RAILWAIL_API_KEYΔημιουργία κλειδιού API
05

Προδιαγραφές

ID μοντέλου
gemini-3-flash
Ανάπτυξη
Google DeepMind
Κατηγορία
Multimodal
Είσοδος
Κείμενο, Εικόνα, Ήχος, Βίντεο
Έξοδος
Κείμενο
Παράθυρο περιεχομένου
1.048.576 tokens
Μέγ. έξοδος
65.536 tokens
Χρέωση
Κατά χρήση (tokens ή χρόνος GPU)
Κύκλος ζωής
Ληγμένο
Μέγεθος μοντέλου
Undisclosed (sparse MoE, smaller and sparser than Gemini 3.1 Pro)
Άδεια
Proprietary commercial license via Google AI Studio, Vertex AI and the Gemini app. Free tier available in the Gemini app and AI Mode in Search.
Καταχώρηση καταλόγου ενημερώθηκε
23 Σεπτεμβρίου 2026

Παράμετροι εισόδου

Εισόδους και ρυθμίσεις από το σχήμα εισόδου του μοντέλου. Το παράδειγμα στην ενότητα API δείχνει ποιες από αυτές δέχεται το API.

  • promptΥποχρεωτικό

    User message

    Τύπος: Κείμενο
    Προεπιλογή: –
    Επιτρεπόμενες τιμές: Έως 32.000 χαρακτήρες
  • top_p
    Τύπος: Αριθμός
    Προεπιλογή: 0.95
    Επιτρεπόμενες τιμές: 0 έως 1
  • stream
    Τύπος: Ναι/Όχι
    Προεπιλογή: false
    Επιτρεπόμενες τιμές: –
  • image_url

    Optional image URL to analyze

    Τύπος: Κείμενο
    Προεπιλογή: –
    Επιτρεπόμενες τιμές: –
  • max_tokens
    Τύπος: Ακέραιος αριθμός
    Προεπιλογή: 4096
    Επιτρεπόμενες τιμές: 1 έως 32.000
  • temperature
    Τύπος: Αριθμός
    Προεπιλογή: 1
    Επιτρεπόμενες τιμές: 0 έως 2
  • system_prompt

    Optional system instruction

    Τύπος: Κείμενο
    Προεπιλογή: –
    Επιτρεπόμενες τιμές: Έως 8.000 χαρακτήρες

Ετικέτες

  • google
  • deepmind
  • balanced
  • multimodal
  • low-latency
  • long-context
  • 1m-context
06

Περιπτώσεις χρήσης

Για τι χρησιμοποιείται

  • Default consumer multimodal chat
  • High-throughput agentic workflows
  • Real-time RAG pipelines
  • Long-video summarisation and search
  • Production coding assistants
  • Voice and audio reasoning backends
  • AI Mode in Search and Antigravity workflows
07

Συχνές ερωτήσεις

Τι είναι Gemini 3 Flash;

Το Gemini 3 Flash είναι ένα μοντέλο του Google DeepMind στην κατηγορία Multimodal. Στο Railwail μπορείτε να το καλέσετε με ένα API key μέσω του Railwail API.

Πόσο κοστίζει το Gemini 3 Flash στο Railwail;

Στο Railwail, το Gemini 3 Flash κοστίζει 0,60 $ ανά 1M tokens εισόδου και 3,60 $ ανά 1M tokens εξόδου. Χρεώνεστε για αυτό που χρησιμοποιεί πραγματικά κάθε αίτημα. Η χρήση πληρώνεται από προπληρωμένες πιστωτικές μονάδες· 1 πιστωτική μονάδα ισούται με 0,01 $.

Ποιο είναι το παράθυρο περιεχομένου του Gemini 3 Flash;

Το παράθυρο περιεχομένου του Gemini 3 Flash περιέχει 1.048.576 tokens. Μια απάντηση μπορεί να είναι έως 65.536 tokens.

Πόσο γρήγορο είναι το Gemini 3 Flash;

Δεν υπάρχουν αρκετές μετρημένες εκτελέσεις του Gemini 3 Flash στο Railwail ακόμα για να δηλωθεί ένας χρόνος εκτέλεσης. Εξαρτάται από την είσοδο, τις ρυθμίσεις και το φορτίο στον πάροχο.

Είναι το Gemini 3 Flash καλύτερο από το BLIP;

Αυτό εξαρτάται από την εργασία. Το Gemini 3 Flash (Google DeepMind) και το BLIP (Salesforce) είναι και τα δύο μοντέλα στην κατηγορία Multimodal. Η σελίδα σύγκρισης δείχνει τις τιμές και τις προδιαγραφές τους παράλληλα.

Σύγκριση Gemini 3 Flash και BLIP

Μπορεί το Gemini 3 Flash να επεξεργαστεί εικόνες;

Ναι. Το Gemini 3 Flash δέχεται εικόνες ως είσοδο εκτός από κείμενο.

Πώς χρησιμοποιώ το Gemini 3 Flash μέσω του API;

Δημιουργήστε ένα Railwail API key και στείλτε το αίτημά σας με το ID μοντέλου gemini-3-flash. Παραδείγματα κώδικα για curl, Python και JavaScript βρίσκονται στην ενότητα API αυτής της σελίδας.

08

Συγκρίσιμα μοντέλα

Όλα σε αυτήν την κατηγορία

Χρησιμοποιήστε το Gemini 3 Flash μέσω του API

Ένα κλειδί API για κάθε μοντέλο στο Railwail. Η χρήση χρεώνεται από προπληρωμένα πιστωτικά, 1 πιστωτικό = 0,01 $.