Gemini 3 Flash

MultimodálníZastaraléDostupné
od Google DeepMindID modelu: gemini-3-flash

Google's April 2026 fast multimodal model. Combines Gemini 3 Pro's reasoning with Flash-tier latency and price. Default model in the Gemini app.

Cena · 1M vstup/výstup
0,60 US$ / 3,60 US$
Kontext
1 048 576 tokenů
Max. výstup
65 536 tokenů
Vstup → výstup
Text + Obrázek + Audio + Video → Text
Vývojář
Google DeepMind
Aktualizováno
23. září 2026

Poskytovatel tento model postupně vyřazuje.

01

Playground

Vyzkoušet Gemini 3 Flash

Chat

0,60 US$/1M vstup
Vyzkoušet Gemini 3 Flash

Pošli zprávu. Odpověď přijde kompletní, jakmile je model hotov (bez streamování).

Maximální délka odpovědi (tokeny)

Tento běh

maximálně 0,0037 US$ · 0,37 credits rezervováno

Fakturují se skutečně použité tokeny, nevyužitá část rezervace se vrátí.

Nový zde?

10 bezplatných credits (0,10 US$) při registraci přes Google

Použitelné 24 hodin po registraci, až 5 běhů za den a maximálně 2 credits za běh. Ostatní způsoby přihlášení začínají bez credits. Stačí na 27 spuštění tohoto modelu.

02

O Gemini 3 Flash

StručněStav: 23. září 2026

Gemini 3 Flash je model od Google DeepMind v kategorii Multimodální. Na Railwail stojí Gemini 3 Flash 0,60 US$ za 1M vstupních tokenů a 3,60 US$ za 1M výstupních tokenů. Kontextní okno obsahuje 1 048 576 tokenů, odpověď může být dlouhá až 65 536 tokenů.

Announced April 22, 2026, Gemini 3 Flash brings Pro-grade reasoning to the Flash latency tier. 1M-token context, fully multimodal (text, image, audio, video), 65K max output. The default model in the Gemini app and AI Mode in Search. PhD-level reasoning on common benchmarks at a fraction of the cost of 3.1 Pro. Recommended for high-throughput agentic workflows, real-time multimodal chat, RAG and consumer applications.

Pozadí

O Google DeepMind

Založeno 2010 · Mountain View, USA / London, UK

Google DeepMind is the merged AI research organisation formed in April 2023 by combining Google Brain with DeepMind. Demis Hassabis leads the unit as CEO. Flash variants have been Google's high-throughput tier since Gemini 1.5 Flash (May 2024), with Gemini 2.0 Flash (December 2024), 2.5 Flash (mid-2025) and Gemini 3 Flash (April 2026) representing the progression. DeepMind's seminal papers include 'Attention Is All You Need' (2017), AlphaGo (2016), AlphaFold (2018-2021, Nobel Prize 2024) and the Gemini Technical Report.

Navštívit Google DeepMind

Architektura

Sparse Mixture-of-Experts Transformer (multimodal, latency-optimized)

Gemini 3 Flash was announced April 22, 2026 as the default Flash-tier model and the new default model in the Gemini app and AI Mode in Search. It is a natively multimodal Sparse MoE Transformer engineered to combine Gemini 3 Pro's reasoning quality with Flash-grade latency, efficiency and cost. Pretraining used Google's TPU v6e infrastructure on a multi-trillion-token mixture of web text, code, books, image-text pairs, audio and video frames. Post-training combined supervised fine-tuning, RLHF, RL against verifiable rewards and distillation from larger Gemini 3.1 Pro teacher models. The architecture preserves Gemini's native multimodality across text, image, audio and video, the full tool-use API and Search grounding, while running at a fraction of Pro pricing. Gemini 3 Flash is the recommended default for high-throughput agentic workflows and consumer-facing multimodal chat.

Parametry
Undisclosed (sparse MoE, smaller and sparser than Gemini 3.1 Pro)
Kontext
1 048 576 tokenů

Schopnosti

  • Pro-grade reasoning at Flash latency
  • 1,048,576 token context window
  • Natively multimodal: text, image, audio and video
  • Search grounding and Code Execution built into the API
  • Function calling, JSON schema and parallel tool calls
  • Default model in the Gemini app and AI Mode in Search
  • PhD-level reasoning on common benchmarks
  • Available via Vertex AI, AI Studio, Gemini Enterprise, Antigravity and the Gemini app
  • Strong long-video understanding (hour-long clips)
  • Cross-lingual fluency across 100+ languages
  • Best for: high-throughput agentic workflows, real-time multimodal chat, RAG, consumer applications.

Trénování a licence

Pretrained on a multi-trillion-token mixture of web text, code, books, scientific papers, image-text pairs, audio and video frames. Heavily distilled from larger Gemini 3.1 Pro teacher models. Post-training uses supervised fine-tuning, RLHF and RL against verifiable rewards. Knowledge cutoff in late 2025.

Licence: Proprietary commercial license via Google AI Studio, Vertex AI and the Gemini app. Free tier available in the Gemini app and AI Mode in Search.

Bezpečnostní testy: Evaluated under Google DeepMind's Frontier Safety Framework v2 with internal red teams and external evaluators.

Známá omezení

  • Below Gemini 3.1 Pro on the hardest reasoning and long-context benchmarks
  • Smaller context window than 3.1 Pro (1M vs 2M)
  • Vision can misread dense tables and handwriting
  • Region availability is rolling out in 2026
  • Audio output not yet supported
03

Ceny

Ceny v USD. Použití se účtuje z předplacených kreditů.
Vstup0,60 US$ / 1M tokenů
Výstup3,60 US$ / 1M tokenů
  • Účtují se tokeny, které jednotlivý požadavek skutečně spotřebuje.
  • 1 kredit = 0,01 US$

Kalkulátor nákladů

Kalkulátor cen

/ požadavek
/ požadavek

Celkem

0,24 US$

24 kreditů

Na požadavek

0,0024 US$ · 0,24 kreditů

Každý požadavek se zaokrouhluje nahoru na 0,01 kreditu.

04

API

Volejte Gemini 3 Flash s vaším API klíčem Railwail. V požadavku použijte toto ID modelu:
curl https://railwail.com/api/v1/chat/completions \
  -H "Authorization: Bearer $RAILWAIL_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "gemini-3-flash",
    "messages": [
      {
        "role": "user",
        "content": "Explain what a vector database is in two sentences."
      }
    ],
    "max_tokens": 1024
  }'
Nastavte svůj klíč jako RAILWAIL_API_KEYVytvořit API klíč
05

Specifikace

ID modelu
gemini-3-flash
Vývojář
Google DeepMind
Vstup
Text, Obrázek, Audio, Video
Výstup
Text
Kontextové okno
1 048 576 tokenů
Max. výstup
65 536 tokenů
Fakturace
Podle použití (tokeny nebo GPU čas)
Životní cyklus
Zastaralé
Velikost modelu
Undisclosed (sparse MoE, smaller and sparser than Gemini 3.1 Pro)
Licence
Proprietary commercial license via Google AI Studio, Vertex AI and the Gemini app. Free tier available in the Gemini app and AI Mode in Search.
Záznam v katalogu aktualizován
23. září 2026

Vstupní parametry

Vstupy a nastavení ze vstupního schématu modelu. Příklad v sekci API ukazuje, které z nich API přijímá.

  • promptpovinné

    User message

    Typ: Text
    Výchozí: –
    Povolené hodnoty: až 32 000 znaků
  • top_p
    Typ: Číslo
    Výchozí: 0.95
    Povolené hodnoty: 0 až 1
  • stream
    Typ: Ano/Ne
    Výchozí: false
    Povolené hodnoty: –
  • image_url

    Optional image URL to analyze

    Typ: Text
    Výchozí: –
    Povolené hodnoty: –
  • max_tokens
    Typ: Celé číslo
    Výchozí: 4096
    Povolené hodnoty: 1 až 32 000
  • temperature
    Typ: Číslo
    Výchozí: 1
    Povolené hodnoty: 0 až 2
  • system_prompt

    Optional system instruction

    Typ: Text
    Výchozí: –
    Povolené hodnoty: až 8 000 znaků

Štítky

  • google
  • deepmind
  • balanced
  • multimodal
  • low-latency
  • long-context
  • 1m-context
06

Případy použití

K čemu se používá

  • Default consumer multimodal chat
  • High-throughput agentic workflows
  • Real-time RAG pipelines
  • Long-video summarisation and search
  • Production coding assistants
  • Voice and audio reasoning backends
  • AI Mode in Search and Antigravity workflows
07

Často kladené otázky

Co je Gemini 3 Flash?

Gemini 3 Flash je model od Google DeepMind v kategorii Multimodální. Na Railwail jej můžete volat pomocí API klíče přes Railwail API.

Kolik stojí Gemini 3 Flash na Railwail?

Na Railwail stojí Gemini 3 Flash 0,60 US$ za 1M vstupních tokenů a 3,60 US$ za 1M výstupních tokenů. Platíte za to, co každý požadavek skutečně spotřebuje. Použití se platí z předplacených kreditů; 1 kredit se rovná 0,01 US$.

Jaké je kontextní okno Gemini 3 Flash?

Kontextní okno Gemini 3 Flash obsahuje 1 048 576 tokenů. Odpověď může být dlouhá až 65 536 tokenů.

Jak rychlý je Gemini 3 Flash?

Pro Gemini 3 Flash je na Railwail zatím příliš málo naměřených spuštění na uvedení doby běhu. Závisí na vstupu, nastavení a zátěži u poskytovatele.

Je Gemini 3 Flash lepší než BLIP?

Záleží na úkolu. Gemini 3 Flash (Google DeepMind) a BLIP (Salesforce) jsou oba modely v kategorii Multimodální. Stránka porovnání zobrazuje jejich ceny a specifikace vedle sebe.

Porovnat Gemini 3 Flash a BLIP

Může Gemini 3 Flash zpracovávat obrázky?

Ano. Gemini 3 Flash přijímá obrázky jako vstup kromě textu.

Jak mohu používat Gemini 3 Flash přes API?

Vytvořte Railwail API klíč a pošlete svůj požadavek s ID modelu gemini-3-flash. Příklady kódu pro curl, Python a JavaScript jsou v sekci API na této stránce.

08

Srovnatelné modely

Všechny v této kategorii

Používejte Gemini 3 Flash přes API

Jeden API klíč pro všechny modely na Railwail. Použití se účtuje z předplacených kreditů, 1 kredit = 0,01 US$.