Gemini 3 Flash

МультимодальныеСнято с производстваДоступно
от Google DeepMindID модели: gemini-3-flash

Google's April 2026 fast multimodal model. Combines Gemini 3 Pro's reasoning with Flash-tier latency and price. Default model in the Gemini app.

Цена · 1M вход/выход
0,60 $ / 3,60 $
Контекст
1 048 576 токенов
Макс. выход
65 536 токенов
Вход → выход
Текст + Изображение + Аудио + Видео → Текст
Разработчик
Google DeepMind
Обновлено
23 сентября 2026 г.

Поставщик снимает эту модель с производства.

01

Playground

Попробовать Gemini 3 Flash

Чат

0,60 $/1M вход
Попробовать Gemini 3 Flash

Отправьте сообщение. Ответ придёт полностью, когда модель закончит работу (без потоковой передачи).

Макс. длина ответа (токены)

Этот запуск

максимум 0,0037 $ · 0,37 кредитов зарезервировано

Оплачиваются только использованные токены; неиспользованная часть резервирования возвращается.

Впервые здесь?

10 бесплатных кредитов (0,10 $) при регистрации через Google

Доступно 24 часов после регистрации, до 5 запусков в день и максимум 2 кредитов за запуск. Другие способы входа начинают без кредитов. Достаточно для 27 запусков этой модели.

02

О Gemini 3 Flash

КороткоПо состоянию на 23 сентября 2026 г.

Gemini 3 Flash — это модель от Google DeepMind в категории Мультимодальные. На Railwail Gemini 3 Flash стоит 0,60 $ за 1M входных токенов и 3,60 $ за 1M выходных токенов. Контекстное окно содержит 1 048 576 токенов, ответ может быть до 65 536 токенов.

Announced April 22, 2026, Gemini 3 Flash brings Pro-grade reasoning to the Flash latency tier. 1M-token context, fully multimodal (text, image, audio, video), 65K max output. The default model in the Gemini app and AI Mode in Search. PhD-level reasoning on common benchmarks at a fraction of the cost of 3.1 Pro. Recommended for high-throughput agentic workflows, real-time multimodal chat, RAG and consumer applications.

Фон

О Google DeepMind

Основана в 2010 · Mountain View, USA / London, UK

Google DeepMind is the merged AI research organisation formed in April 2023 by combining Google Brain with DeepMind. Demis Hassabis leads the unit as CEO. Flash variants have been Google's high-throughput tier since Gemini 1.5 Flash (May 2024), with Gemini 2.0 Flash (December 2024), 2.5 Flash (mid-2025) and Gemini 3 Flash (April 2026) representing the progression. DeepMind's seminal papers include 'Attention Is All You Need' (2017), AlphaGo (2016), AlphaFold (2018-2021, Nobel Prize 2024) and the Gemini Technical Report.

Посетить Google DeepMind

Архитектура

Sparse Mixture-of-Experts Transformer (multimodal, latency-optimized)

Gemini 3 Flash was announced April 22, 2026 as the default Flash-tier model and the new default model in the Gemini app and AI Mode in Search. It is a natively multimodal Sparse MoE Transformer engineered to combine Gemini 3 Pro's reasoning quality with Flash-grade latency, efficiency and cost. Pretraining used Google's TPU v6e infrastructure on a multi-trillion-token mixture of web text, code, books, image-text pairs, audio and video frames. Post-training combined supervised fine-tuning, RLHF, RL against verifiable rewards and distillation from larger Gemini 3.1 Pro teacher models. The architecture preserves Gemini's native multimodality across text, image, audio and video, the full tool-use API and Search grounding, while running at a fraction of Pro pricing. Gemini 3 Flash is the recommended default for high-throughput agentic workflows and consumer-facing multimodal chat.

Параметры
Undisclosed (sparse MoE, smaller and sparser than Gemini 3.1 Pro)
Контекст
1 048 576 токенов

Возможности

  • Pro-grade reasoning at Flash latency
  • 1,048,576 token context window
  • Natively multimodal: text, image, audio and video
  • Search grounding and Code Execution built into the API
  • Function calling, JSON schema and parallel tool calls
  • Default model in the Gemini app and AI Mode in Search
  • PhD-level reasoning on common benchmarks
  • Available via Vertex AI, AI Studio, Gemini Enterprise, Antigravity and the Gemini app
  • Strong long-video understanding (hour-long clips)
  • Cross-lingual fluency across 100+ languages
  • Best for: high-throughput agentic workflows, real-time multimodal chat, RAG, consumer applications.

Обучение и лицензия

Pretrained on a multi-trillion-token mixture of web text, code, books, scientific papers, image-text pairs, audio and video frames. Heavily distilled from larger Gemini 3.1 Pro teacher models. Post-training uses supervised fine-tuning, RLHF and RL against verifiable rewards. Knowledge cutoff in late 2025.

Лицензия: Proprietary commercial license via Google AI Studio, Vertex AI and the Gemini app. Free tier available in the Gemini app and AI Mode in Search.

Тестирование безопасности: Evaluated under Google DeepMind's Frontier Safety Framework v2 with internal red teams and external evaluators.

Известные ограничения

  • Below Gemini 3.1 Pro on the hardest reasoning and long-context benchmarks
  • Smaller context window than 3.1 Pro (1M vs 2M)
  • Vision can misread dense tables and handwriting
  • Region availability is rolling out in 2026
  • Audio output not yet supported
03

Цены

Цены в долларах США. Использование оплачивается из предоплаченных кредитов.
Входные данные0,60 $ / 1M токенов
Выходные данные3,60 $ / 1M токенов
  • Оплата рассчитывается по токенам, которые фактически использует каждый запрос.
  • 1 кредит = 0,01 $

Калькулятор стоимости

Калькулятор цен

/ запр.
/ запр.

Итого

0,24 $

24 кредитов

За запрос

0,0024 $ · 0,24 кредитов

Каждый запрос округляется до 0,01 кредита.

04

API

Вызовите Gemini 3 Flash с помощью вашего API-ключа Railwail. Используйте этот ID модели в запросе:
curl https://railwail.com/api/v1/chat/completions \
  -H "Authorization: Bearer $RAILWAIL_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "gemini-3-flash",
    "messages": [
      {
        "role": "user",
        "content": "Explain what a vector database is in two sentences."
      }
    ],
    "max_tokens": 1024
  }'
Установите ключ как RAILWAIL_API_KEYСоздать API-ключ
05

Спецификации

ID модели
gemini-3-flash
Разработчик
Google DeepMind
Входные данные
Текст, Изображение, Аудио, Видео
Выходные данные
Текст
Контекстное окно
1 048 576 токенов
Макс. выходные данные
65 536 токенов
Тарификация
По использованию (токены или время GPU)
Жизненный цикл
Снято с производства
Размер модели
Undisclosed (sparse MoE, smaller and sparser than Gemini 3.1 Pro)
Лицензия
Proprietary commercial license via Google AI Studio, Vertex AI and the Gemini app. Free tier available in the Gemini app and AI Mode in Search.
Запись в каталоге обновлена
23 сентября 2026 г.

Входные параметры

Входные данные и параметры из схемы входных данных модели. Пример в разделе API показывает, какие из них принимает API.

  • promptобязательно

    User message

    Тип: Текст
    По умолчанию: –
    Допустимые значения: до 32 000 символов
  • top_p
    Тип: Число
    По умолчанию: 0.95
    Допустимые значения: от 0 до 1
  • stream
    Тип: Да/Нет
    По умолчанию: false
    Допустимые значения: –
  • image_url

    Optional image URL to analyze

    Тип: Текст
    По умолчанию: –
    Допустимые значения: –
  • max_tokens
    Тип: Целое число
    По умолчанию: 4096
    Допустимые значения: от 1 до 32 000
  • temperature
    Тип: Число
    По умолчанию: 1
    Допустимые значения: от 0 до 2
  • system_prompt

    Optional system instruction

    Тип: Текст
    По умолчанию: –
    Допустимые значения: до 8 000 символов

Теги

  • google
  • deepmind
  • balanced
  • multimodal
  • low-latency
  • long-context
  • 1m-context
06

Применение

Для чего это используется

  • Default consumer multimodal chat
  • High-throughput agentic workflows
  • Real-time RAG pipelines
  • Long-video summarisation and search
  • Production coding assistants
  • Voice and audio reasoning backends
  • AI Mode in Search and Antigravity workflows
07

Часто задаваемые вопросы

Что такое Gemini 3 Flash?

Gemini 3 Flash — модель от Google DeepMind в категории Мультимодальные. На Railwail вы можете вызвать её через API Railwail с помощью ключа API.

Сколько стоит Gemini 3 Flash на Railwail?

На Railwail Gemini 3 Flash стоит 0,60 $ за 1M входных токенов и 3,60 $ за 1M выходных токенов. Вы платите за то, что фактически использует каждый запрос. Использование оплачивается предоплаченными кредитами; 1 кредит = 0,01 $.

Какой размер контекстного окна у Gemini 3 Flash?

Контекстное окно Gemini 3 Flash содержит 1 048 576 токенов. Ответ может быть до 65 536 токенов.

Насколько быстра Gemini 3 Flash?

На Railwail пока недостаточно измеренных запусков Gemini 3 Flash, чтобы указать время выполнения. Оно зависит от входных данных, параметров и нагрузки на провайдера.

Gemini 3 Flash лучше, чем BLIP?

Это зависит от задачи. Gemini 3 Flash (Google DeepMind) и BLIP (Salesforce) — обе модели в категории Мультимодальные. На странице сравнения показаны их цены и характеристики рядом.

Сравнить Gemini 3 Flash и BLIP

Может ли Gemini 3 Flash обрабатывать изображения?

Да. Gemini 3 Flash принимает изображения на входе в дополнение к тексту.

Как использовать Gemini 3 Flash через API?

Создайте ключ API Railwail и отправьте запрос с ID модели gemini-3-flash. Примеры кода для curl, Python и JavaScript находятся в разделе API на этой странице.

08

Сравнимые модели

Все в этой категории

Использовать Gemini 3 Flash через API

Один API-ключ для всех моделей на Railwail. Использование оплачивается из предоплаченных кредитов, 1 кредит = 0,01 $.