DeepSeek V4 Flash

Texte et chatObsolĂšteDisponible
par DeepSeekID du modĂšle: deepseek-v4-flash

Efficiency-optimized variant of DeepSeek V4. 284B MoE / 13B active, 1M context, ultra-low pricing for high-throughput workloads.

Prix · 1M entrée/sortie
0,36 $US / 1,44 $US
Contexte
1.048.575 tokens
Max. sortie
384.000 tokens
EntrĂ©e → Sortie
Texte → Texte
Temps d'exécution (médiane)
1,3 s
Développeur
DeepSeek

Le fournisseur supprime progressivement ce modĂšle.

Nouvelle version disponible : DeepSeek V4.1 Flash

01

Playground

Essayer DeepSeek V4 Flash

Chat

0,36 $US/1M entrée
Essayer DeepSeek V4 Flash

Envoyez un message. La réponse arrive complÚte une fois que le modÚle a terminé (sans streaming).

Prompt systĂšme
Longueur max. de la réponse (tokens)

Cette exécution

au maximum 0,0015 $US · 0,15 crédits réservés

Facturation selon les tokens réellement utilisés ; la partie inutilisée de la réservation est remboursée.

Nouveau par ici ?

10 crédits gratuits (0,10 $US) lors de l'inscription avec Google

Utilisable 24 heures aprÚs l'inscription, jusqu'à 5 exécutions par jour et au maximum 2 crédits par exécution. Les autres méthodes de connexion commencent sans crédits. Suffisant pour 66 exécutions de ce modÚle.

02

À propos de DeepSeek V4 Flash

RésuméAu 23 septembre 2026

DeepSeek V4 Flash est un modĂšle de DeepSeek dans la catĂ©gorie Texte et chat. Sur Railwail, DeepSeek V4 Flash coĂ»te 0,36 $US par 1M tokens d'entrĂ©e et 1,44 $US par 1M tokens de sortie. La fenĂȘtre de contexte contient 1.048.575 tokens, et une rĂ©ponse peut faire jusqu'Ă  384.000 tokens. Version plus rĂ©cente : DeepSeek V4.1 Flash.

DeepSeek-V4-Flash is the cost-efficient sibling of V4-Pro, released April 2026 as part of the V4 Preview. 284B total / 13B active MoE parameters with the same 1M-token context window. Designed for high-throughput agentic loops, RAG and batch tasks where latency and cost matter more than raw capability. Recommended for production agents, classification at scale, large-scale data extraction.

ArriĂšre-plan

À propos de DeepSeek AI

Fondée 2023 · Hangzhou, China

DeepSeek AI is a Chinese AI research lab founded in 2023 by Liang Wenfeng, founder of the High-Flyer quantitative hedge fund. The lab is funded primarily by High-Flyer's profits. Its mission is open frontier AI, with all flagship models released with open weights. Major releases include DeepSeek LLM (2023), DeepSeek-V2 (May 2024), DeepSeek-V3 (December 2024), DeepSeek-R1 (January 2026), DeepSeek V3.1 (early 2026) and the DeepSeek V4 family (April 24, 2026), comprising V4-Pro and V4-Flash. DeepSeek is credited with popularising large-scale Reinforcement Learning from Verifiable Rewards and consistently tops open-weights leaderboards.

Visiter DeepSeek AI

Architecture

Sparse Mixture-of-Experts Transformer (efficiency-optimized open-weights)

DeepSeek-V4-Flash was released April 24, 2026 as the efficiency-optimized sibling of V4-Pro. It is a Sparse MoE Transformer with 284B total parameters and 13B activated per token, retaining the full 1M-token native context window and 384K-token max output of the Pro variant at significantly lower inference cost. The model uses the same DeepSeek architectural stack: Multi-head Latent Attention (MLA), DeepSeekMoE with fine-grained expert specialization and shared experts, and FP8 mixed-precision training. Post-training combined supervised fine-tuning, RLVR on math/code/tool-use trajectories, and heavy distillation from the V4-Pro teacher model. V4 Flash is published with open weights under a permissive license and is designed for production-scale RAG, agentic loops and high-throughput workloads. At $0.112 input / $0.224 output per million tokens it undercuts every Western frontier model by an order of magnitude.

ParamĂštres
284B total / 13B active per token
Contexte
1.048.575 tokens

Capacités

  • 1M token native context window with 384K max output
  • 284B MoE / 13B active parameters
  • Ultra-low pricing ($0.112 / $0.224 per million tokens)
  • Distilled from DeepSeek V4-Pro teacher model
  • FP8-trained for compute efficiency
  • Multi-head Latent Attention for memory-efficient long context
  • Function calling and structured JSON output
  • Strong on math, STEM and coding for its size
  • Available via DeepSeek API, OpenRouter, Together and self-hosted with vLLM/SGLang
  • Open weights under a permissive license
  • Best for: production agents, RAG pipelines, high-throughput data extraction, on-premise inference under tight cost budgets.

Formation & licence

Pretrained on the same multi-trillion-token mixture as V4-Pro. Post-training combines supervised fine-tuning, RLVR and distillation from the V4-Pro teacher model. Knowledge cutoff approximately early 2026.

Licence: Open weights under a permissive license that allows commercial use. Hosted API access via deepseek.com.

Tests de sécurité: DeepSeek publishes model cards but provides limited external red-teaming. Safety filters are lighter than Western frontier labs; deployers are responsible for downstream alignment.

Limitations connues

  • Below V4-Pro on the hardest reasoning and coding benchmarks
  • Light built-in safety alignment relative to Western frontier models
  • No native vision or audio input (text-only)
  • Older deepseek-chat / deepseek-reasoner endpoints will be deprecated July 24, 2026
  • Some Chinese-language safety constraints apply
03

Tarification

Prix en dollars américains. L'utilisation est facturée à partir de crédits prépayés.
Entrée0,36 $US / 1M tokens
Sortie1,44 $US / 1M tokens
  • FacturĂ© selon les tokens que chaque requĂȘte utilise rĂ©ellement.
  • 1 crĂ©dit = 0,01 $US

Calculateur de coûts

Calculatrice de prix

/ req.
/ req.

Total

0,11 $US

11 crédits

Par requĂȘte

0,0011 $US · 0,11 crédits

Chaque requĂȘte est arrondie Ă  0,01 crĂ©dits.

04

API

Appelez DeepSeek V4 Flash avec votre clĂ© API Railwail. Utilisez cet ID de modĂšle dans la requĂȘte :
curl https://railwail.com/api/v1/chat/completions \
  -H "Authorization: Bearer $RAILWAIL_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "deepseek-v4-flash",
    "messages": [
      {
        "role": "user",
        "content": "Explain what a vector database is in two sentences."
      }
    ],
    "max_tokens": 1024
  }'
Définissez votre clé comme RAILWAIL_API_KEYCréer une clé API
05

Spécifications

ID du modĂšle
deepseek-v4-flash
Développeur
DeepSeek
Catégorie
Texte et chat
Entrée
Texte
Sortie
Texte
FenĂȘtre de contexte
1.048.575 tokens
Sortie max.
384.000 tokens
Facturation
À l'usage (tokens ou temps GPU)
Temps d'exécution (médiane)
1,3 s15 exécutions terminées sur Railwail au cours des 90 derniers jours
Cycle de vie
ObsolĂšte
Taille du modĂšle
284B total / 13B active per token
Licence
Open weights under a permissive license that allows commercial use. Hosted API access via deepseek.com.
Entrée du catalogue mise à jour
23 septembre 2026

Étiquettes

  • deepseek
  • open-weights
  • moe
  • cost-efficient
  • long-context
  • 1m-context
06

Cas d'usage

À quoi ça sert

  • Production RAG pipelines
  • High-throughput coding subagents
  • Bulk data extraction and classification
  • Cost-sensitive enterprise APIs
  • On-premise inference under tight cost budgets
  • Long-document summarisation at scale
  • Real-time chat backends
07

Questions fréquemment posées

Qu'est-ce que DeepSeek V4 Flash ?

DeepSeek V4 Flash est un modÚle de DeepSeek dans la catégorie Texte et chat. Sur Railwail, vous pouvez l'appeler avec une clé API via l'API Railwail.

Combien coûte DeepSeek V4 Flash sur Railwail ?

Sur Railwail, DeepSeek V4 Flash coĂ»te 0,36 $US par 1M tokens d'entrĂ©e et 1,44 $US par 1M tokens de sortie. Vous ĂȘtes facturĂ© pour ce que chaque requĂȘte utilise rĂ©ellement. L'utilisation est payĂ©e Ă  partir de crĂ©dits prĂ©payĂ©s ; 1 crĂ©dit Ă©quivaut Ă  0,01 $US.

Quelle est la fenĂȘtre de contexte de DeepSeek V4 Flash ?

La fenĂȘtre de contexte de DeepSeek V4 Flash contient 1.048.575 tokens. Une rĂ©ponse peut faire jusqu'Ă  384.000 tokens.

Quelle est la vitesse de DeepSeek V4 Flash ?

Sur Railwail, le temps d'exécution médian de DeepSeek V4 Flash au cours des 90 derniers jours était 1,3 s, basé sur 15 exécutions terminées.

DeepSeek V4 Flash est-il meilleur que DeepSeek V4.1 Flash ?

Cela dépend de la tùche. DeepSeek V4 Flash (DeepSeek) et DeepSeek V4.1 Flash (DeepSeek) sont tous deux des modÚles de la catégorie Texte et chat. La page de comparaison affiche leurs prix et spécifications cÎte à cÎte.

Comparer DeepSeek V4 Flash et DeepSeek V4.1 Flash

Comment utiliser DeepSeek V4 Flash via l'API ?

CrĂ©ez une clĂ© API Railwail et envoyez votre requĂȘte avec l'ID de modĂšle deepseek-v4-flash. Des exemples de code pour curl, Python et JavaScript se trouvent dans la section API de cette page.

08

ModĂšles comparables

Tous dans cette catégorie

Utiliser DeepSeek V4 Flash via l'API

Une clé API pour tous les modÚles sur Railwail. L'utilisation est facturée à partir de crédits prépayés, 1 crédit = 0,01 $US.