DeepSeek V4 Flash

Text a chatZastaraléDostupné
od DeepSeekID modelu: deepseek-v4-flash

Efficiency-optimized variant of DeepSeek V4. 284B MoE / 13B active, 1M context, ultra-low pricing for high-throughput workloads.

Cena · 1M vstup/výstup
0,36 US$ / 1,44 US$
Kontext
1 048 575 tokenů
Max. výstup
384 000 tokenů
Vstup → výstup
Text → Text
Doba běhu (medián)
1,3 s
Vývojář
DeepSeek

Poskytovatel tento model postupně vyřazuje.

Dostupná novější verze: DeepSeek V4.1 Flash

01

Playground

Vyzkoušet DeepSeek V4 Flash

Chat

0,36 US$/1M vstup
Vyzkoušet DeepSeek V4 Flash

Pošli zprávu. Odpověď přijde kompletní, jakmile je model hotov (bez streamování).

Systémový prompt
Maximální délka odpovědi (tokeny)

Tento běh

maximálně 0,0015 US$ · 0,15 credits rezervováno

Fakturují se skutečně použité tokeny, nevyužitá část rezervace se vrátí.

Nový zde?

10 bezplatných credits (0,10 US$) při registraci přes Google

Použitelné 24 hodin po registraci, až 5 běhů za den a maximálně 2 credits za běh. Ostatní způsoby přihlášení začínají bez credits. Stačí na 66 spuštění tohoto modelu.

02

O DeepSeek V4 Flash

StručněStav: 23. září 2026

DeepSeek V4 Flash je model od DeepSeek v kategorii Text a chat. Na Railwail stojí DeepSeek V4 Flash 0,36 US$ za 1M vstupních tokenů a 1,44 US$ za 1M výstupních tokenů. Kontextní okno obsahuje 1 048 575 tokenů, odpověď může být dlouhá až 384 000 tokenů. Novější verze: DeepSeek V4.1 Flash.

DeepSeek-V4-Flash is the cost-efficient sibling of V4-Pro, released April 2026 as part of the V4 Preview. 284B total / 13B active MoE parameters with the same 1M-token context window. Designed for high-throughput agentic loops, RAG and batch tasks where latency and cost matter more than raw capability. Recommended for production agents, classification at scale, large-scale data extraction.

Pozadí

O DeepSeek AI

Založeno 2023 · Hangzhou, China

DeepSeek AI is a Chinese AI research lab founded in 2023 by Liang Wenfeng, founder of the High-Flyer quantitative hedge fund. The lab is funded primarily by High-Flyer's profits. Its mission is open frontier AI, with all flagship models released with open weights. Major releases include DeepSeek LLM (2023), DeepSeek-V2 (May 2024), DeepSeek-V3 (December 2024), DeepSeek-R1 (January 2026), DeepSeek V3.1 (early 2026) and the DeepSeek V4 family (April 24, 2026), comprising V4-Pro and V4-Flash. DeepSeek is credited with popularising large-scale Reinforcement Learning from Verifiable Rewards and consistently tops open-weights leaderboards.

Navštívit DeepSeek AI

Architektura

Sparse Mixture-of-Experts Transformer (efficiency-optimized open-weights)

DeepSeek-V4-Flash was released April 24, 2026 as the efficiency-optimized sibling of V4-Pro. It is a Sparse MoE Transformer with 284B total parameters and 13B activated per token, retaining the full 1M-token native context window and 384K-token max output of the Pro variant at significantly lower inference cost. The model uses the same DeepSeek architectural stack: Multi-head Latent Attention (MLA), DeepSeekMoE with fine-grained expert specialization and shared experts, and FP8 mixed-precision training. Post-training combined supervised fine-tuning, RLVR on math/code/tool-use trajectories, and heavy distillation from the V4-Pro teacher model. V4 Flash is published with open weights under a permissive license and is designed for production-scale RAG, agentic loops and high-throughput workloads. At $0.112 input / $0.224 output per million tokens it undercuts every Western frontier model by an order of magnitude.

Parametry
284B total / 13B active per token
Kontext
1 048 575 tokenů

Schopnosti

  • 1M token native context window with 384K max output
  • 284B MoE / 13B active parameters
  • Ultra-low pricing ($0.112 / $0.224 per million tokens)
  • Distilled from DeepSeek V4-Pro teacher model
  • FP8-trained for compute efficiency
  • Multi-head Latent Attention for memory-efficient long context
  • Function calling and structured JSON output
  • Strong on math, STEM and coding for its size
  • Available via DeepSeek API, OpenRouter, Together and self-hosted with vLLM/SGLang
  • Open weights under a permissive license
  • Best for: production agents, RAG pipelines, high-throughput data extraction, on-premise inference under tight cost budgets.

Trénování a licence

Pretrained on the same multi-trillion-token mixture as V4-Pro. Post-training combines supervised fine-tuning, RLVR and distillation from the V4-Pro teacher model. Knowledge cutoff approximately early 2026.

Licence: Open weights under a permissive license that allows commercial use. Hosted API access via deepseek.com.

Bezpečnostní testy: DeepSeek publishes model cards but provides limited external red-teaming. Safety filters are lighter than Western frontier labs; deployers are responsible for downstream alignment.

Známá omezení

  • Below V4-Pro on the hardest reasoning and coding benchmarks
  • Light built-in safety alignment relative to Western frontier models
  • No native vision or audio input (text-only)
  • Older deepseek-chat / deepseek-reasoner endpoints will be deprecated July 24, 2026
  • Some Chinese-language safety constraints apply
03

Ceny

Ceny v USD. Použití se účtuje z předplacených kreditů.
Vstup0,36 US$ / 1M tokenů
Výstup1,44 US$ / 1M tokenů
  • Účtují se tokeny, které jednotlivý požadavek skutečně spotřebuje.
  • 1 kredit = 0,01 US$

Kalkulátor nákladů

Kalkulátor cen

/ požadavek
/ požadavek

Celkem

0,11 US$

11 kreditů

Na požadavek

0,0011 US$ · 0,11 kreditů

Každý požadavek se zaokrouhluje nahoru na 0,01 kreditu.

04

API

Volejte DeepSeek V4 Flash s vaším API klíčem Railwail. V požadavku použijte toto ID modelu:
curl https://railwail.com/api/v1/chat/completions \
  -H "Authorization: Bearer $RAILWAIL_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "deepseek-v4-flash",
    "messages": [
      {
        "role": "user",
        "content": "Explain what a vector database is in two sentences."
      }
    ],
    "max_tokens": 1024
  }'
Nastavte svůj klíč jako RAILWAIL_API_KEYVytvořit API klíč
05

Specifikace

ID modelu
deepseek-v4-flash
Vývojář
DeepSeek
Kategorie
Text a chat
Vstup
Text
Výstup
Text
Kontextové okno
1 048 575 tokenů
Max. výstup
384 000 tokenů
Fakturace
Podle použití (tokeny nebo GPU čas)
Doba běhu (medián)
1,3 s15 dokončených běhů na Railwail za posledních 90 dní
Životní cyklus
Zastaralé
Velikost modelu
284B total / 13B active per token
Licence
Open weights under a permissive license that allows commercial use. Hosted API access via deepseek.com.
Záznam v katalogu aktualizován
23. září 2026

Štítky

  • deepseek
  • open-weights
  • moe
  • cost-efficient
  • long-context
  • 1m-context
06

Případy použití

K čemu se používá

  • Production RAG pipelines
  • High-throughput coding subagents
  • Bulk data extraction and classification
  • Cost-sensitive enterprise APIs
  • On-premise inference under tight cost budgets
  • Long-document summarisation at scale
  • Real-time chat backends
07

Často kladené otázky

Co je DeepSeek V4 Flash?

DeepSeek V4 Flash je model od DeepSeek v kategorii Text a chat. Na Railwail jej můžete volat pomocí API klíče přes Railwail API.

Kolik stojí DeepSeek V4 Flash na Railwail?

Na Railwail stojí DeepSeek V4 Flash 0,36 US$ za 1M vstupních tokenů a 1,44 US$ za 1M výstupních tokenů. Platíte za to, co každý požadavek skutečně spotřebuje. Použití se platí z předplacených kreditů; 1 kredit se rovná 0,01 US$.

Jaké je kontextní okno DeepSeek V4 Flash?

Kontextní okno DeepSeek V4 Flash obsahuje 1 048 575 tokenů. Odpověď může být dlouhá až 384 000 tokenů.

Jak rychlý je DeepSeek V4 Flash?

Na Railwail byla medián doby běhu DeepSeek V4 Flash za posledních 90 dní 1,3 s, na základě 15 dokončených spuštění.

Je DeepSeek V4 Flash lepší než DeepSeek V4.1 Flash?

Záleží na úkolu. DeepSeek V4 Flash (DeepSeek) a DeepSeek V4.1 Flash (DeepSeek) jsou oba modely v kategorii Text a chat. Stránka porovnání zobrazuje jejich ceny a specifikace vedle sebe.

Porovnat DeepSeek V4 Flash a DeepSeek V4.1 Flash

Jak mohu používat DeepSeek V4 Flash přes API?

Vytvořte Railwail API klíč a pošlete svůj požadavek s ID modelu deepseek-v4-flash. Příklady kódu pro curl, Python a JavaScript jsou v sekci API na této stránce.

08

Srovnatelné modely

Všechny v této kategorii

Používejte DeepSeek V4 Flash přes API

Jeden API klíč pro všechny modely na Railwail. Použití se účtuje z předplacených kreditů, 1 kredit = 0,01 US$.