Gemini 3 Flash

MultimodalDepășitDisponibil
de Google DeepMindID model: gemini-3-flash

Google's April 2026 fast multimodal model. Combines Gemini 3 Pro's reasoning with Flash-tier latency and price. Default model in the Gemini app.

Preț · 1M intrare/ieșire
0,60 USD / 3,60 USD
Context
1.048.576 tokeni
Ieșire max.
65.536 tokeni
Intrare → ieșire
Text + Imagine + Audio + Video → Text
Dezvoltator
Google DeepMind
Actualizat
23 septembrie 2026

Furnizorul elimină treptat acest model.

01

Playground

Încearcă Gemini 3 Flash

Chat

0,60 USD/1M in
Încearcă Gemini 3 Flash

Trimite un mesaj. Răspunsul sosește complet când modelul termină (fără streaming).

Lungimea max. a răspunsului (tokeni)

Această rulare

maximum 0,0037 USD · 0,37 credite rezervate

Se factureaza tokenurile efectiv utilizate; partea nefolosita a rezervării este rambursată.

Nou aici?

10 credite gratuite (0,10 USD) când te înregistrezi cu Google

Utilizabil 24 ore după înregistrare, până la 5 rulări pe zi și maximum 2 credite pe rulare. Alte metode de conectare încep fără credite. Suficient pentru 27 de rulări ale acestui model.

02

Despre Gemini 3 Flash

Pe scurtDin 23 septembrie 2026

Gemini 3 Flash este un model de Google DeepMind din categoria Multimodal. Pe Railwail, Gemini 3 Flash costă 0,60 USD per 1M tokeni de intrare și 3,60 USD per 1M tokeni de ieșire. Fereastra de context conține 1.048.576 token-uri, iar un răspuns poate fi lung de până la 65.536 token-uri.

Announced April 22, 2026, Gemini 3 Flash brings Pro-grade reasoning to the Flash latency tier. 1M-token context, fully multimodal (text, image, audio, video), 65K max output. The default model in the Gemini app and AI Mode in Search. PhD-level reasoning on common benchmarks at a fraction of the cost of 3.1 Pro. Recommended for high-throughput agentic workflows, real-time multimodal chat, RAG and consumer applications.

Fundal

Despre Google DeepMind

Fondat 2010 · Mountain View, USA / London, UK

Google DeepMind is the merged AI research organisation formed in April 2023 by combining Google Brain with DeepMind. Demis Hassabis leads the unit as CEO. Flash variants have been Google's high-throughput tier since Gemini 1.5 Flash (May 2024), with Gemini 2.0 Flash (December 2024), 2.5 Flash (mid-2025) and Gemini 3 Flash (April 2026) representing the progression. DeepMind's seminal papers include 'Attention Is All You Need' (2017), AlphaGo (2016), AlphaFold (2018-2021, Nobel Prize 2024) and the Gemini Technical Report.

Vizitează Google DeepMind

Arhitectură

Sparse Mixture-of-Experts Transformer (multimodal, latency-optimized)

Gemini 3 Flash was announced April 22, 2026 as the default Flash-tier model and the new default model in the Gemini app and AI Mode in Search. It is a natively multimodal Sparse MoE Transformer engineered to combine Gemini 3 Pro's reasoning quality with Flash-grade latency, efficiency and cost. Pretraining used Google's TPU v6e infrastructure on a multi-trillion-token mixture of web text, code, books, image-text pairs, audio and video frames. Post-training combined supervised fine-tuning, RLHF, RL against verifiable rewards and distillation from larger Gemini 3.1 Pro teacher models. The architecture preserves Gemini's native multimodality across text, image, audio and video, the full tool-use API and Search grounding, while running at a fraction of Pro pricing. Gemini 3 Flash is the recommended default for high-throughput agentic workflows and consumer-facing multimodal chat.

Parametri
Undisclosed (sparse MoE, smaller and sparser than Gemini 3.1 Pro)
Context
1.048.576 tokeni

Capabilități

  • Pro-grade reasoning at Flash latency
  • 1,048,576 token context window
  • Natively multimodal: text, image, audio and video
  • Search grounding and Code Execution built into the API
  • Function calling, JSON schema and parallel tool calls
  • Default model in the Gemini app and AI Mode in Search
  • PhD-level reasoning on common benchmarks
  • Available via Vertex AI, AI Studio, Gemini Enterprise, Antigravity and the Gemini app
  • Strong long-video understanding (hour-long clips)
  • Cross-lingual fluency across 100+ languages
  • Best for: high-throughput agentic workflows, real-time multimodal chat, RAG, consumer applications.

Antrenament & licență

Pretrained on a multi-trillion-token mixture of web text, code, books, scientific papers, image-text pairs, audio and video frames. Heavily distilled from larger Gemini 3.1 Pro teacher models. Post-training uses supervised fine-tuning, RLHF and RL against verifiable rewards. Knowledge cutoff in late 2025.

Licență: Proprietary commercial license via Google AI Studio, Vertex AI and the Gemini app. Free tier available in the Gemini app and AI Mode in Search.

Teste de siguranță: Evaluated under Google DeepMind's Frontier Safety Framework v2 with internal red teams and external evaluators.

Limitări cunoscute

  • Below Gemini 3.1 Pro on the hardest reasoning and long-context benchmarks
  • Smaller context window than 3.1 Pro (1M vs 2M)
  • Vision can misread dense tables and handwriting
  • Region availability is rolling out in 2026
  • Audio output not yet supported
03

Prețuri

Prețuri în dolari americani. Utilizarea se percepe din credite prepay.
Intrare0,60 USD / 1M token-uri
Ieșire3,60 USD / 1M token-uri
  • Se facturează token-urile pe care le folosește efectiv fiecare cerere.
  • 1 credit = 0,01 USD

Calculator de costuri

Calculator de preț

/ cerere
/ cerere

Total

0,24 USD

24 credite

Pe cerere

0,0024 USD · 0,24 credite

Fiecare cerere este rotunjită la 0,01 credite.

04

API

Apelează Gemini 3 Flash cu cheia ta API Railwail. Folosește acest ID de model în cerere:
curl https://railwail.com/api/v1/chat/completions \
  -H "Authorization: Bearer $RAILWAIL_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "gemini-3-flash",
    "messages": [
      {
        "role": "user",
        "content": "Explain what a vector database is in two sentences."
      }
    ],
    "max_tokens": 1024
  }'
Setează cheia ca RAILWAIL_API_KEYCreează cheie API
05

Specificații

ID model
gemini-3-flash
Dezvoltator
Google DeepMind
Categorie
Multimodal
Intrare
Text, Imagine, Audio, Video
Ieșire
Text
Fereastră de context
1.048.576 tokeni
Ieșire max.
65.536 tokeni
Facturare
După utilizare (tokeni sau timp GPU)
Ciclu de viață
Depășit
Dimensiune model
Undisclosed (sparse MoE, smaller and sparser than Gemini 3.1 Pro)
Licență
Proprietary commercial license via Google AI Studio, Vertex AI and the Gemini app. Free tier available in the Gemini app and AI Mode in Search.
Intrare catalog actualizată
23 septembrie 2026

Parametri de intrare

Intrări și setări din schema de intrare a modelului. Exemplul din secțiunea API arată care dintre ele acceptă API-ul.

  • promptobligatoriu

    User message

    Tip: Text
    Implicit: –
    Valori permise: până la 32.000 caractere
  • top_p
    Tip: Număr
    Implicit: 0.95
    Valori permise: 0 până la 1
  • stream
    Tip: Da/Nu
    Implicit: false
    Valori permise: –
  • image_url

    Optional image URL to analyze

    Tip: Text
    Implicit: –
    Valori permise: –
  • max_tokens
    Tip: Număr întreg
    Implicit: 4096
    Valori permise: 1 până la 32.000
  • temperature
    Tip: Număr
    Implicit: 1
    Valori permise: 0 până la 2
  • system_prompt

    Optional system instruction

    Tip: Text
    Implicit: –
    Valori permise: până la 8.000 caractere

Etichete

  • google
  • deepmind
  • balanced
  • multimodal
  • low-latency
  • long-context
  • 1m-context
06

Cazuri de utilizare

Pentru ce se folosește

  • Default consumer multimodal chat
  • High-throughput agentic workflows
  • Real-time RAG pipelines
  • Long-video summarisation and search
  • Production coding assistants
  • Voice and audio reasoning backends
  • AI Mode in Search and Antigravity workflows
07

Întrebări frecvente

Ce este Gemini 3 Flash?

Gemini 3 Flash este un model de Google DeepMind din categoria Multimodal. Pe Railwail îl poți apela cu o cheie API prin Railwail API.

Cât costă Gemini 3 Flash pe Railwail?

Pe Railwail, Gemini 3 Flash costă 0,60 USD per 1M tokeni de intrare și 3,60 USD per 1M tokeni de ieșire. Ți se percepe taxa pentru ceea ce fiecare cerere folosește efectiv. Utilizarea se plătește din credite prepay; 1 credit egal cu 0,01 USD.

Care este fereastra de context a Gemini 3 Flash?

Fereastra de context a Gemini 3 Flash conține 1.048.576 token-uri. Un răspuns poate fi lung de până la 65.536 token-uri.

Cât de rapid este Gemini 3 Flash?

Nu sunt suficiente rulări măsurate ale Gemini 3 Flash pe Railwail încă pentru a indica un timp de rulare. Depinde de intrare, de setări și de sarcina la furnizor.

Este Gemini 3 Flash mai bun decât BLIP?

Depinde de sarcină. Gemini 3 Flash (Google DeepMind) și BLIP (Salesforce) sunt ambele modele din categoria Multimodal. Pagina de comparație arată prețurile și specificațiile lor una lângă alta.

Compară Gemini 3 Flash și BLIP

Poate Gemini 3 Flash procesa imagini?

Da. Gemini 3 Flash acceptă imagini ca intrare, pe lângă text.

Cum folosesc Gemini 3 Flash prin API?

Creează o cheie Railwail API și trimite cererea cu ID-ul modelului gemini-3-flash. Exemple de cod pentru curl, Python și JavaScript sunt în secțiunea API a acestei pagini.

08

Folosește Gemini 3 Flash prin API

O cheie API pentru fiecare model pe Railwail. Utilizarea se percepe din credite prepay, 1 credit = 0,01 USD.