Gemini 3 Flash

МультимодальніЗастарілеДоступно
від Google DeepMindID моделі: gemini-3-flash

Google's April 2026 fast multimodal model. Combines Gemini 3 Pro's reasoning with Flash-tier latency and price. Default model in the Gemini app.

Ціна · 1M вх/вих
0,60 USD / 3,60 USD
Контекст
1 048 576 токенів
Макс. вихід
65 536 токенів
Вхід → вихід
Текст + Зображення + Аудіо + Відео → Текст
Розробник
Google DeepMind
Оновлено
23 вересня 2026 р.

Постачальник припиняє роботу цієї моделі.

01

Playground

Спробувати Gemini 3 Flash

Чат

0,60 USD/1M вх
Спробувати Gemini 3 Flash

Надішліть повідомлення. Відповідь надійде повністю, коли модель завершить роботу (без потокової передачі).

Макс. довжина відповіді (токени)

Цей запуск

максимум 0,0037 USD · 0,37 кредитів зарезервовано

Розраховуються фактично використані токени; невикористана частина резервування повертається.

Новенький?

10 безплатних кредитів (0,10 USD) при реєстрації через Google

Доступно 24 годин після реєстрації, до 5 запусків на день і максимум 2 кредитів за запуск. Інші способи входу стартують без кредитів. Достатньо для 27 запусків цієї моделі.

02

Про Gemini 3 Flash

КороткоСтаном на 23 вересня 2026 р.

Gemini 3 Flash — це модель від Google DeepMind у категорії Мультимодальні. На Railwail Gemini 3 Flash коштує 0,60 USD за 1M вхідних токенів і 3,60 USD за 1M вихідних токенів. Контекстне вікно містить 1 048 576 токенів, а одна відповідь може бути довжиною до 65 536 токенів.

Announced April 22, 2026, Gemini 3 Flash brings Pro-grade reasoning to the Flash latency tier. 1M-token context, fully multimodal (text, image, audio, video), 65K max output. The default model in the Gemini app and AI Mode in Search. PhD-level reasoning on common benchmarks at a fraction of the cost of 3.1 Pro. Recommended for high-throughput agentic workflows, real-time multimodal chat, RAG and consumer applications.

Фон

Про Google DeepMind

Засновано 2010 · Mountain View, USA / London, UK

Google DeepMind is the merged AI research organisation formed in April 2023 by combining Google Brain with DeepMind. Demis Hassabis leads the unit as CEO. Flash variants have been Google's high-throughput tier since Gemini 1.5 Flash (May 2024), with Gemini 2.0 Flash (December 2024), 2.5 Flash (mid-2025) and Gemini 3 Flash (April 2026) representing the progression. DeepMind's seminal papers include 'Attention Is All You Need' (2017), AlphaGo (2016), AlphaFold (2018-2021, Nobel Prize 2024) and the Gemini Technical Report.

Відвідати Google DeepMind

Архітектура

Sparse Mixture-of-Experts Transformer (multimodal, latency-optimized)

Gemini 3 Flash was announced April 22, 2026 as the default Flash-tier model and the new default model in the Gemini app and AI Mode in Search. It is a natively multimodal Sparse MoE Transformer engineered to combine Gemini 3 Pro's reasoning quality with Flash-grade latency, efficiency and cost. Pretraining used Google's TPU v6e infrastructure on a multi-trillion-token mixture of web text, code, books, image-text pairs, audio and video frames. Post-training combined supervised fine-tuning, RLHF, RL against verifiable rewards and distillation from larger Gemini 3.1 Pro teacher models. The architecture preserves Gemini's native multimodality across text, image, audio and video, the full tool-use API and Search grounding, while running at a fraction of Pro pricing. Gemini 3 Flash is the recommended default for high-throughput agentic workflows and consumer-facing multimodal chat.

Параметри
Undisclosed (sparse MoE, smaller and sparser than Gemini 3.1 Pro)
Контекст
1 048 576 токенів

Можливості

  • Pro-grade reasoning at Flash latency
  • 1,048,576 token context window
  • Natively multimodal: text, image, audio and video
  • Search grounding and Code Execution built into the API
  • Function calling, JSON schema and parallel tool calls
  • Default model in the Gemini app and AI Mode in Search
  • PhD-level reasoning on common benchmarks
  • Available via Vertex AI, AI Studio, Gemini Enterprise, Antigravity and the Gemini app
  • Strong long-video understanding (hour-long clips)
  • Cross-lingual fluency across 100+ languages
  • Best for: high-throughput agentic workflows, real-time multimodal chat, RAG, consumer applications.

Навчання та ліцензія

Pretrained on a multi-trillion-token mixture of web text, code, books, scientific papers, image-text pairs, audio and video frames. Heavily distilled from larger Gemini 3.1 Pro teacher models. Post-training uses supervised fine-tuning, RLHF and RL against verifiable rewards. Knowledge cutoff in late 2025.

Ліцензія: Proprietary commercial license via Google AI Studio, Vertex AI and the Gemini app. Free tier available in the Gemini app and AI Mode in Search.

Тестування безпеки: Evaluated under Google DeepMind's Frontier Safety Framework v2 with internal red teams and external evaluators.

Відомі обмеження

  • Below Gemini 3.1 Pro on the hardest reasoning and long-context benchmarks
  • Smaller context window than 3.1 Pro (1M vs 2M)
  • Vision can misread dense tables and handwriting
  • Region availability is rolling out in 2026
  • Audio output not yet supported
03

Ціни

Ціни в доларах США. Використання оплачується з попередньо поповнених кредитів.
Вхідні дані0,60 USD / 1M токенів
Вихідні дані3,60 USD / 1M токенів
  • Оплачується за токенами, які насправді використовує кожен запит.
  • 1 кредит = 0,01 USD

Калькулятор вартості

Калькулятор ціни

/ запит
/ запит

Всього

0,24 USD

24 кредитів

За запит

0,0024 USD · 0,24 кредитів

Кожен запит округлюється до 0,01 кредиту.

04

API

Викличте Gemini 3 Flash за допомогою вашого API-ключа Railwail. Використовуйте цей ID моделі в запиті:
curl https://railwail.com/api/v1/chat/completions \
  -H "Authorization: Bearer $RAILWAIL_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "gemini-3-flash",
    "messages": [
      {
        "role": "user",
        "content": "Explain what a vector database is in two sentences."
      }
    ],
    "max_tokens": 1024
  }'
Встановіть ключ як RAILWAIL_API_KEYСтворити API-ключ
05

Характеристики

ID моделі
gemini-3-flash
Розробник
Google DeepMind
Вхідні дані
Текст, Зображення, Аудіо, Відео
Вихідні дані
Текст
Контекстне вікно
1 048 576 токенів
Макс. вихідні дані
65 536 токенів
Виставлення рахунків
За використанням (токени або час GPU)
Життєвий цикл
Застаріле
Розмір моделі
Undisclosed (sparse MoE, smaller and sparser than Gemini 3.1 Pro)
Ліцензія
Proprietary commercial license via Google AI Studio, Vertex AI and the Gemini app. Free tier available in the Gemini app and AI Mode in Search.
Запис у каталозі оновлено
23 вересня 2026 р.

Вхідні параметри

Вхідні дані та налаштування зі схеми вхідних даних моделі. Приклад у розділі API показує, які з них приймає API.

  • promptобов'язково

    User message

    Тип: Текст
    За замовчуванням: –
    Допустимі значення: до 32 000 символів
  • top_p
    Тип: Число
    За замовчуванням: 0.95
    Допустимі значення: 0 до 1
  • stream
    Тип: Так/Ні
    За замовчуванням: false
    Допустимі значення: –
  • image_url

    Optional image URL to analyze

    Тип: Текст
    За замовчуванням: –
    Допустимі значення: –
  • max_tokens
    Тип: Ціле число
    За замовчуванням: 4096
    Допустимі значення: 1 до 32 000
  • temperature
    Тип: Число
    За замовчуванням: 1
    Допустимі значення: 0 до 2
  • system_prompt

    Optional system instruction

    Тип: Текст
    За замовчуванням: –
    Допустимі значення: до 8 000 символів

Теги

  • google
  • deepmind
  • balanced
  • multimodal
  • low-latency
  • long-context
  • 1m-context
06

Варіанти використання

Для чого це використовується

  • Default consumer multimodal chat
  • High-throughput agentic workflows
  • Real-time RAG pipelines
  • Long-video summarisation and search
  • Production coding assistants
  • Voice and audio reasoning backends
  • AI Mode in Search and Antigravity workflows
07

Часті питання

Що таке Gemini 3 Flash?

Gemini 3 Flash — це модель від Google DeepMind у категорії Мультимодальні. На Railwail ви можете викликати її за допомогою API-ключа через Railwail API.

Скільки коштує Gemini 3 Flash на Railwail?

На Railwail Gemini 3 Flash коштує 0,60 USD за 1M вхідних токенів і 3,60 USD за 1M вихідних токенів. Вам буде виставлено рахунок за те, що насправді використовує кожен запит. Використання оплачується з попередньо придбаних кредитів; 1 кредит дорівнює 0,01 USD.

Яке контекстне вікно у Gemini 3 Flash?

Контекстне вікно Gemini 3 Flash містить 1 048 576 токенів. Одна відповідь може бути довжиною до 65 536 токенів.

Наскільки швидкий Gemini 3 Flash?

На Railwail поки що недостатньо виміряних запусків Gemini 3 Flash, щоб вказати час виконання. Це залежить від введення, налаштувань та навантаження у постачальника.

Чи Gemini 3 Flash краще за BLIP?

Це залежить від завдання. Gemini 3 Flash (Google DeepMind) і BLIP (Salesforce) — обидві моделі в категорії Мультимодальні. На сторінці порівняння показані їхні ціни та специфікації поруч.

Порівняти Gemini 3 Flash і BLIP

Чи може Gemini 3 Flash обробляти зображення?

Так. Gemini 3 Flash приймає зображення як введення, крім тексту.

Як використовувати Gemini 3 Flash через API?

Створіть API-ключ Railwail і надішліть свій запит з ID моделі gemini-3-flash. Приклади коду для curl, Python і JavaScript знаходяться в розділі API на цій сторінці.

08

Порівнювані моделі

Усі в цій категорії

Використовуйте Gemini 3 Flash через API

Один API-ключ для всіх моделей на Railwail. Використання оплачується з попередньо поповнених кредитів, 1 кредит = 0,01 USD.