DeepSeek V4 Flash

Tekst og chatUtfasesTilgjengelig
av DeepSeekModell-ID: deepseek-v4-flash

Efficiency-optimized variant of DeepSeek V4. 284B MoE / 13B active, 1M context, ultra-low pricing for high-throughput workloads.

Pris · 1M inn/ut
0,36 USD / 1,44 USD
Kontekst
1 048 575 tokens
Maks. utdata
384 000 tokens
Input → output
Tekst → Tekst
Kjøretid (median)
1,3 s
Utvikler
DeepSeek

Leverandøren faser ut denne modellen.

Nyere versjon tilgjengelig: DeepSeek V4.1 Flash

01

Playground

Prøv DeepSeek V4 Flash

Chat

0,36 USD/1M inn
Prøv DeepSeek V4 Flash

Send en melding. Svaret kommer fullstendig når modellen er ferdig (ingen streaming).

Systemprompt
Maks. svarslengde (tokens)

Denne kjøringen

maksimalt 0,0015 USD · 0,15 credits reservert

Fakturert etter faktisk brukte tokens; ubrukt del av reservasjonen refunderes.

Ny her?

10 gratis credits (0,10 USD) når du registrerer deg med Google

Kan brukes 24 timer etter registrering, opptil 5 kjøringer per dag og maksimalt 2 credits per kjøring. Andre påloggingsmetoder starter uten credits. Nok for 66 kjøringer av denne modellen.

02

Om DeepSeek V4 Flash

Kort sagtPer 23. september 2026

DeepSeek V4 Flash er en modell fra DeepSeek i kategorien Tekst og chat. På Railwail koster DeepSeek V4 Flash 0,36 USD per 1M inndatatokens og 1,44 USD per 1M utdatatokens. Kontekstvinduet inneholder 1 048 575 tokens, og ett svar kan være opptil 384 000 tokens langt. Nyere versjon: DeepSeek V4.1 Flash.

DeepSeek-V4-Flash is the cost-efficient sibling of V4-Pro, released April 2026 as part of the V4 Preview. 284B total / 13B active MoE parameters with the same 1M-token context window. Designed for high-throughput agentic loops, RAG and batch tasks where latency and cost matter more than raw capability. Recommended for production agents, classification at scale, large-scale data extraction.

Bakgrunn

Om DeepSeek AI

Grunnlagt 2023 · Hangzhou, China

DeepSeek AI is a Chinese AI research lab founded in 2023 by Liang Wenfeng, founder of the High-Flyer quantitative hedge fund. The lab is funded primarily by High-Flyer's profits. Its mission is open frontier AI, with all flagship models released with open weights. Major releases include DeepSeek LLM (2023), DeepSeek-V2 (May 2024), DeepSeek-V3 (December 2024), DeepSeek-R1 (January 2026), DeepSeek V3.1 (early 2026) and the DeepSeek V4 family (April 24, 2026), comprising V4-Pro and V4-Flash. DeepSeek is credited with popularising large-scale Reinforcement Learning from Verifiable Rewards and consistently tops open-weights leaderboards.

Besøk DeepSeek AI

Arkitektur

Sparse Mixture-of-Experts Transformer (efficiency-optimized open-weights)

DeepSeek-V4-Flash was released April 24, 2026 as the efficiency-optimized sibling of V4-Pro. It is a Sparse MoE Transformer with 284B total parameters and 13B activated per token, retaining the full 1M-token native context window and 384K-token max output of the Pro variant at significantly lower inference cost. The model uses the same DeepSeek architectural stack: Multi-head Latent Attention (MLA), DeepSeekMoE with fine-grained expert specialization and shared experts, and FP8 mixed-precision training. Post-training combined supervised fine-tuning, RLVR on math/code/tool-use trajectories, and heavy distillation from the V4-Pro teacher model. V4 Flash is published with open weights under a permissive license and is designed for production-scale RAG, agentic loops and high-throughput workloads. At $0.112 input / $0.224 output per million tokens it undercuts every Western frontier model by an order of magnitude.

Parametere
284B total / 13B active per token
Kontekst
1 048 575 tokens

Evner

  • 1M token native context window with 384K max output
  • 284B MoE / 13B active parameters
  • Ultra-low pricing ($0.112 / $0.224 per million tokens)
  • Distilled from DeepSeek V4-Pro teacher model
  • FP8-trained for compute efficiency
  • Multi-head Latent Attention for memory-efficient long context
  • Function calling and structured JSON output
  • Strong on math, STEM and coding for its size
  • Available via DeepSeek API, OpenRouter, Together and self-hosted with vLLM/SGLang
  • Open weights under a permissive license
  • Best for: production agents, RAG pipelines, high-throughput data extraction, on-premise inference under tight cost budgets.

Trening og lisens

Pretrained on the same multi-trillion-token mixture as V4-Pro. Post-training combines supervised fine-tuning, RLVR and distillation from the V4-Pro teacher model. Knowledge cutoff approximately early 2026.

Lisens: Open weights under a permissive license that allows commercial use. Hosted API access via deepseek.com.

Sikkerhetstesting: DeepSeek publishes model cards but provides limited external red-teaming. Safety filters are lighter than Western frontier labs; deployers are responsible for downstream alignment.

Kjente begrensninger

  • Below V4-Pro on the hardest reasoning and coding benchmarks
  • Light built-in safety alignment relative to Western frontier models
  • No native vision or audio input (text-only)
  • Older deepseek-chat / deepseek-reasoner endpoints will be deprecated July 24, 2026
  • Some Chinese-language safety constraints apply
03

Priser

Priser i amerikanske dollar. Bruk belastes fra forhåndsbetalt kreditt.
Inndata0,36 USD / 1M tokener
Utdata1,44 USD / 1M tokener
  • Faktureres etter tokenene som hver forespørsel faktisk bruker.
  • 1 kreditt = 0,01 USD

Kostnadsberegner

Prisberegner

/ forespørsel
/ forespørsel

Totalt

0,11 USD

11 credits

Per forespørsel

0,0011 USD · 0,11 credits

Hver forespørsel rundes opp til 0,01 credits.

04

API

Ring DeepSeek V4 Flash med din Railwail API-nøkkel. Bruk denne modell-IDen i forespørselen:
curl https://railwail.com/api/v1/chat/completions \
  -H "Authorization: Bearer $RAILWAIL_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "deepseek-v4-flash",
    "messages": [
      {
        "role": "user",
        "content": "Explain what a vector database is in two sentences."
      }
    ],
    "max_tokens": 1024
  }'
Sett nøkkelen din som RAILWAIL_API_KEYOpprett API-nøkkel
05

Spesifikasjoner

Modell-ID
deepseek-v4-flash
Utvikler
DeepSeek
Inndata
Tekst
Utdata
Tekst
Kontekstvindu
1 048 575 tokens
Maks. utdata
384 000 tokens
Fakturering
Etter bruk (tokens eller GPU-tid)
Kjøringstid (median)
1,3 s15 fullførte kjøringer på Railwail de siste 90 dagene
Livssyklus
Utfases
Modellstørrelse
284B total / 13B active per token
Lisens
Open weights under a permissive license that allows commercial use. Hosted API access via deepseek.com.
Katalogoppføring oppdatert
23. september 2026

Merkelapper

  • deepseek
  • open-weights
  • moe
  • cost-efficient
  • long-context
  • 1m-context
06

Brukstilfeller

Hva det brukes til

  • Production RAG pipelines
  • High-throughput coding subagents
  • Bulk data extraction and classification
  • Cost-sensitive enterprise APIs
  • On-premise inference under tight cost budgets
  • Long-document summarisation at scale
  • Real-time chat backends
07

Ofte stilte spørsmål

Hva er DeepSeek V4 Flash?

DeepSeek V4 Flash er en modell fra DeepSeek i kategorien Tekst og chat. På Railwail kan du kalle den med en API-nøkkel gjennom Railwail API.

Hvor mye koster DeepSeek V4 Flash på Railwail?

På Railwail koster DeepSeek V4 Flash 0,36 USD per 1M inndatatokens og 1,44 USD per 1M utdatatokens. Du betaler for det hver forespørsel faktisk bruker. Bruk betales fra forhåndskjøpte kreditter; 1 kreditt tilsvarer 0,01 USD.

Hvor stort er kontekstvinduet til DeepSeek V4 Flash?

Kontekstvinduet til DeepSeek V4 Flash inneholder 1 048 575 tokens. Ett svar kan være opptil 384 000 tokens langt.

Hvor rask er DeepSeek V4 Flash?

På Railwail var mediankjøretiden for DeepSeek V4 Flash de siste 90 dagene 1,3 s, basert på 15 fullførte kjøringer.

Er DeepSeek V4 Flash bedre enn DeepSeek V4.1 Flash?

Det avhenger av oppgaven. DeepSeek V4 Flash (DeepSeek) og DeepSeek V4.1 Flash (DeepSeek) er begge modeller i kategorien Tekst og chat. Sammenligningssiden viser prisene og spesifikasjonene deres side ved side.

Sammenlign DeepSeek V4 Flash og DeepSeek V4.1 Flash

Hvordan bruker jeg DeepSeek V4 Flash gjennom API-en?

Opprett en Railwail API-nøkkel og send forespørselen din med modell-ID-en deepseek-v4-flash. Kodeeksempler for curl, Python og JavaScript finnes i API-delen av denne siden.

08

Sammenlignbare modeller

Alle i denne kategorien

Bruk DeepSeek V4 Flash via APIen

Én API-nøkkel for alle modeller på Railwail. Bruk belastes fra forhåndsbetalt kreditt, 1 kreditt = 0,01 USD.