DeepSeek V4 Flash

Текст і чатЗастарілеДоступно
від DeepSeekID моделі: deepseek-v4-flash

Efficiency-optimized variant of DeepSeek V4. 284B MoE / 13B active, 1M context, ultra-low pricing for high-throughput workloads.

Ціна · 1M вх/вих
0,36 USD / 1,44 USD
Контекст
1 048 575 токенів
Макс. вихід
384 000 токенів
Вхід → вихід
Текст → Текст
Час виконання (медіана)
1,3 s
Розробник
DeepSeek

Постачальник припиняє роботу цієї моделі.

Доступна новіша версія: DeepSeek V4.1 Flash

01

Playground

Спробувати DeepSeek V4 Flash

Чат

0,36 USD/1M вх
Спробувати DeepSeek V4 Flash

Надішліть повідомлення. Відповідь надійде повністю, коли модель завершить роботу (без потокової передачі).

Системний промпт
Макс. довжина відповіді (токени)

Цей запуск

максимум 0,0015 USD · 0,15 кредитів зарезервовано

Розраховуються фактично використані токени; невикористана частина резервування повертається.

Новенький?

10 безплатних кредитів (0,10 USD) при реєстрації через Google

Доступно 24 годин після реєстрації, до 5 запусків на день і максимум 2 кредитів за запуск. Інші способи входу стартують без кредитів. Достатньо для 66 запусків цієї моделі.

02

Про DeepSeek V4 Flash

КороткоСтаном на 23 вересня 2026 р.

DeepSeek V4 Flash — це модель від DeepSeek у категорії Текст і чат. На Railwail DeepSeek V4 Flash коштує 0,36 USD за 1M вхідних токенів і 1,44 USD за 1M вихідних токенів. Контекстне вікно містить 1 048 575 токенів, а одна відповідь може бути довжиною до 384 000 токенів. Новіша версія: DeepSeek V4.1 Flash.

DeepSeek-V4-Flash is the cost-efficient sibling of V4-Pro, released April 2026 as part of the V4 Preview. 284B total / 13B active MoE parameters with the same 1M-token context window. Designed for high-throughput agentic loops, RAG and batch tasks where latency and cost matter more than raw capability. Recommended for production agents, classification at scale, large-scale data extraction.

Фон

Про DeepSeek AI

Засновано 2023 · Hangzhou, China

DeepSeek AI is a Chinese AI research lab founded in 2023 by Liang Wenfeng, founder of the High-Flyer quantitative hedge fund. The lab is funded primarily by High-Flyer's profits. Its mission is open frontier AI, with all flagship models released with open weights. Major releases include DeepSeek LLM (2023), DeepSeek-V2 (May 2024), DeepSeek-V3 (December 2024), DeepSeek-R1 (January 2026), DeepSeek V3.1 (early 2026) and the DeepSeek V4 family (April 24, 2026), comprising V4-Pro and V4-Flash. DeepSeek is credited with popularising large-scale Reinforcement Learning from Verifiable Rewards and consistently tops open-weights leaderboards.

Відвідати DeepSeek AI

Архітектура

Sparse Mixture-of-Experts Transformer (efficiency-optimized open-weights)

DeepSeek-V4-Flash was released April 24, 2026 as the efficiency-optimized sibling of V4-Pro. It is a Sparse MoE Transformer with 284B total parameters and 13B activated per token, retaining the full 1M-token native context window and 384K-token max output of the Pro variant at significantly lower inference cost. The model uses the same DeepSeek architectural stack: Multi-head Latent Attention (MLA), DeepSeekMoE with fine-grained expert specialization and shared experts, and FP8 mixed-precision training. Post-training combined supervised fine-tuning, RLVR on math/code/tool-use trajectories, and heavy distillation from the V4-Pro teacher model. V4 Flash is published with open weights under a permissive license and is designed for production-scale RAG, agentic loops and high-throughput workloads. At $0.112 input / $0.224 output per million tokens it undercuts every Western frontier model by an order of magnitude.

Параметри
284B total / 13B active per token
Контекст
1 048 575 токенів

Можливості

  • 1M token native context window with 384K max output
  • 284B MoE / 13B active parameters
  • Ultra-low pricing ($0.112 / $0.224 per million tokens)
  • Distilled from DeepSeek V4-Pro teacher model
  • FP8-trained for compute efficiency
  • Multi-head Latent Attention for memory-efficient long context
  • Function calling and structured JSON output
  • Strong on math, STEM and coding for its size
  • Available via DeepSeek API, OpenRouter, Together and self-hosted with vLLM/SGLang
  • Open weights under a permissive license
  • Best for: production agents, RAG pipelines, high-throughput data extraction, on-premise inference under tight cost budgets.

Навчання та ліцензія

Pretrained on the same multi-trillion-token mixture as V4-Pro. Post-training combines supervised fine-tuning, RLVR and distillation from the V4-Pro teacher model. Knowledge cutoff approximately early 2026.

Ліцензія: Open weights under a permissive license that allows commercial use. Hosted API access via deepseek.com.

Тестування безпеки: DeepSeek publishes model cards but provides limited external red-teaming. Safety filters are lighter than Western frontier labs; deployers are responsible for downstream alignment.

Відомі обмеження

  • Below V4-Pro on the hardest reasoning and coding benchmarks
  • Light built-in safety alignment relative to Western frontier models
  • No native vision or audio input (text-only)
  • Older deepseek-chat / deepseek-reasoner endpoints will be deprecated July 24, 2026
  • Some Chinese-language safety constraints apply
03

Ціни

Ціни в доларах США. Використання оплачується з попередньо поповнених кредитів.
Вхідні дані0,36 USD / 1M токенів
Вихідні дані1,44 USD / 1M токенів
  • Оплачується за токенами, які насправді використовує кожен запит.
  • 1 кредит = 0,01 USD

Калькулятор вартості

Калькулятор ціни

/ запит
/ запит

Всього

0,11 USD

11 кредитів

За запит

0,0011 USD · 0,11 кредитів

Кожен запит округлюється до 0,01 кредиту.

04

API

Викличте DeepSeek V4 Flash за допомогою вашого API-ключа Railwail. Використовуйте цей ID моделі в запиті:
curl https://railwail.com/api/v1/chat/completions \
  -H "Authorization: Bearer $RAILWAIL_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "deepseek-v4-flash",
    "messages": [
      {
        "role": "user",
        "content": "Explain what a vector database is in two sentences."
      }
    ],
    "max_tokens": 1024
  }'
Встановіть ключ як RAILWAIL_API_KEYСтворити API-ключ
05

Характеристики

ID моделі
deepseek-v4-flash
Розробник
DeepSeek
Категорія
Текст і чат
Вхідні дані
Текст
Вихідні дані
Текст
Контекстне вікно
1 048 575 токенів
Макс. вихідні дані
384 000 токенів
Виставлення рахунків
За використанням (токени або час GPU)
Час виконання (медіана)
1,3 s15 завершених запусків на Railwail за останні 90 днів
Життєвий цикл
Застаріле
Розмір моделі
284B total / 13B active per token
Ліцензія
Open weights under a permissive license that allows commercial use. Hosted API access via deepseek.com.
Запис у каталозі оновлено
23 вересня 2026 р.

Теги

  • deepseek
  • open-weights
  • moe
  • cost-efficient
  • long-context
  • 1m-context
06

Варіанти використання

Для чого це використовується

  • Production RAG pipelines
  • High-throughput coding subagents
  • Bulk data extraction and classification
  • Cost-sensitive enterprise APIs
  • On-premise inference under tight cost budgets
  • Long-document summarisation at scale
  • Real-time chat backends
07

Часті питання

Що таке DeepSeek V4 Flash?

DeepSeek V4 Flash — це модель від DeepSeek у категорії Текст і чат. На Railwail ви можете викликати її за допомогою API-ключа через Railwail API.

Скільки коштує DeepSeek V4 Flash на Railwail?

На Railwail DeepSeek V4 Flash коштує 0,36 USD за 1M вхідних токенів і 1,44 USD за 1M вихідних токенів. Вам буде виставлено рахунок за те, що насправді використовує кожен запит. Використання оплачується з попередньо придбаних кредитів; 1 кредит дорівнює 0,01 USD.

Яке контекстне вікно у DeepSeek V4 Flash?

Контекстне вікно DeepSeek V4 Flash містить 1 048 575 токенів. Одна відповідь може бути довжиною до 384 000 токенів.

Наскільки швидкий DeepSeek V4 Flash?

На Railwail медіанний час виконання DeepSeek V4 Flash за останні 90 днів становив 1,3 s, на основі 15 завершених запусків.

Чи DeepSeek V4 Flash краще за DeepSeek V4.1 Flash?

Це залежить від завдання. DeepSeek V4 Flash (DeepSeek) і DeepSeek V4.1 Flash (DeepSeek) — обидві моделі в категорії Текст і чат. На сторінці порівняння показані їхні ціни та специфікації поруч.

Порівняти DeepSeek V4 Flash і DeepSeek V4.1 Flash

Як використовувати DeepSeek V4 Flash через API?

Створіть API-ключ Railwail і надішліть свій запит з ID моделі deepseek-v4-flash. Приклади коду для curl, Python і JavaScript знаходяться в розділі API на цій сторінці.

08

Порівнювані моделі

Усі в цій категорії

Використовуйте DeepSeek V4 Flash через API

Один API-ключ для всіх моделей на Railwail. Використання оплачується з попередньо поповнених кредитів, 1 кредит = 0,01 USD.