DeepSeek V4 Flash

Texte et chatObsolèteDisponible
par DeepSeekID du modèle: deepseek-v4-flash

Efficiency-optimized variant of DeepSeek V4. 284B MoE / 13B active, 1M context, ultra-low pricing for high-throughput workloads.

Prix · 1M entrée/sortie
0,36 $US / 1,44 $US
Contexte
1 048 575 tokens
Max. sortie
384 000 tokens
Entrée → Sortie
Texte → Texte
Temps d'exécution (médiane)
1,3 s
Développeur
DeepSeek

Le fournisseur supprime progressivement ce modèle.

Nouvelle version disponible : DeepSeek V4.1 Flash

01

Playground

Essayer DeepSeek V4 Flash

Chat

0,36 $US/1M entrée
Essayer DeepSeek V4 Flash

Envoyez un message. La réponse arrive complète une fois que le modèle a terminé (sans streaming).

Prompt système
Longueur max. de la réponse (tokens)

Cette exécution

au maximum 0,0015 $US · 0,15 crédits réservés

Facturation selon les tokens réellement utilisés ; la partie inutilisée de la réservation est remboursée.

Nouveau par ici ?

10 crédits gratuits (0,10 $US) lors de l'inscription avec Google

Utilisable 24 heures après l'inscription, jusqu'à 5 exécutions par jour et au maximum 2 crédits par exécution. Les autres méthodes de connexion commencent sans crédits. Suffisant pour 66 exécutions de ce modèle.

02

À propos de DeepSeek V4 Flash

RésuméAu 23 septembre 2026

DeepSeek V4 Flash est un modèle de DeepSeek dans la catégorie Texte et chat. Sur Railwail, DeepSeek V4 Flash coûte 0,36 $US par 1M tokens d'entrée et 1,44 $US par 1M tokens de sortie. La fenêtre de contexte contient 1 048 575 tokens, et une réponse peut faire jusqu'à 384 000 tokens. Version plus récente : DeepSeek V4.1 Flash.

DeepSeek-V4-Flash is the cost-efficient sibling of V4-Pro, released April 2026 as part of the V4 Preview. 284B total / 13B active MoE parameters with the same 1M-token context window. Designed for high-throughput agentic loops, RAG and batch tasks where latency and cost matter more than raw capability. Recommended for production agents, classification at scale, large-scale data extraction.

Arrière-plan

À propos de DeepSeek AI

Fondée 2023 · Hangzhou, China

DeepSeek AI is a Chinese AI research lab founded in 2023 by Liang Wenfeng, founder of the High-Flyer quantitative hedge fund. The lab is funded primarily by High-Flyer's profits. Its mission is open frontier AI, with all flagship models released with open weights. Major releases include DeepSeek LLM (2023), DeepSeek-V2 (May 2024), DeepSeek-V3 (December 2024), DeepSeek-R1 (January 2026), DeepSeek V3.1 (early 2026) and the DeepSeek V4 family (April 24, 2026), comprising V4-Pro and V4-Flash. DeepSeek is credited with popularising large-scale Reinforcement Learning from Verifiable Rewards and consistently tops open-weights leaderboards.

Visiter DeepSeek AI

Architecture

Sparse Mixture-of-Experts Transformer (efficiency-optimized open-weights)

DeepSeek-V4-Flash was released April 24, 2026 as the efficiency-optimized sibling of V4-Pro. It is a Sparse MoE Transformer with 284B total parameters and 13B activated per token, retaining the full 1M-token native context window and 384K-token max output of the Pro variant at significantly lower inference cost. The model uses the same DeepSeek architectural stack: Multi-head Latent Attention (MLA), DeepSeekMoE with fine-grained expert specialization and shared experts, and FP8 mixed-precision training. Post-training combined supervised fine-tuning, RLVR on math/code/tool-use trajectories, and heavy distillation from the V4-Pro teacher model. V4 Flash is published with open weights under a permissive license and is designed for production-scale RAG, agentic loops and high-throughput workloads. At $0.112 input / $0.224 output per million tokens it undercuts every Western frontier model by an order of magnitude.

Paramètres
284B total / 13B active per token
Contexte
1 048 575 tokens

Capacités

  • 1M token native context window with 384K max output
  • 284B MoE / 13B active parameters
  • Ultra-low pricing ($0.112 / $0.224 per million tokens)
  • Distilled from DeepSeek V4-Pro teacher model
  • FP8-trained for compute efficiency
  • Multi-head Latent Attention for memory-efficient long context
  • Function calling and structured JSON output
  • Strong on math, STEM and coding for its size
  • Available via DeepSeek API, OpenRouter, Together and self-hosted with vLLM/SGLang
  • Open weights under a permissive license
  • Best for: production agents, RAG pipelines, high-throughput data extraction, on-premise inference under tight cost budgets.

Entraînement et licence

Pretrained on the same multi-trillion-token mixture as V4-Pro. Post-training combines supervised fine-tuning, RLVR and distillation from the V4-Pro teacher model. Knowledge cutoff approximately early 2026.

Licence: Open weights under a permissive license that allows commercial use. Hosted API access via deepseek.com.

Tests de sécurité: DeepSeek publishes model cards but provides limited external red-teaming. Safety filters are lighter than Western frontier labs; deployers are responsible for downstream alignment.

Limitations connues

  • Below V4-Pro on the hardest reasoning and coding benchmarks
  • Light built-in safety alignment relative to Western frontier models
  • No native vision or audio input (text-only)
  • Older deepseek-chat / deepseek-reasoner endpoints will be deprecated July 24, 2026
  • Some Chinese-language safety constraints apply
03

Tarification

Prix en dollars US. L'utilisation est facturée à partir de crédits prépayés.
Entrée0,36 $US / 1M tokens
Sortie1,44 $US / 1M tokens
  • Facturé selon les tokens que chaque requête utilise réellement.
  • 1 crédit = 0,01 $US

Calculateur de coûts

Calculateur de prix

/ req.
/ req.

Total

0,11 $US

11 crédits

Par requête

0,0011 $US · 0,11 crédits

Chaque requête est arrondie à 0,01 crédit.

04

API

Appelez DeepSeek V4 Flash avec votre clé API Railwail. Utilisez cet ID de modèle dans la requête :
curl https://railwail.com/api/v1/chat/completions \
  -H "Authorization: Bearer $RAILWAIL_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "deepseek-v4-flash",
    "messages": [
      {
        "role": "user",
        "content": "Explain what a vector database is in two sentences."
      }
    ],
    "max_tokens": 1024
  }'
Définissez votre clé en tant que RAILWAIL_API_KEYCréer une clé API
05

Spécifications

ID du modèle
deepseek-v4-flash
Développeur
DeepSeek
Catégorie
Texte et chat
Entrée
Texte
Sortie
Texte
Fenêtre de contexte
1 048 575 tokens
Sortie max.
384 000 tokens
Facturation
À l'usage (tokens ou temps GPU)
Temps d'exécution (médiane)
1,3 s15 exécutions terminées sur Railwail au cours des 90 derniers jours
Cycle de vie
Obsolète
Taille du modèle
284B total / 13B active per token
Licence
Open weights under a permissive license that allows commercial use. Hosted API access via deepseek.com.
Entrée du catalogue mise à jour
23 septembre 2026

Étiquettes

  • deepseek
  • open-weights
  • moe
  • cost-efficient
  • long-context
  • 1m-context
06

Cas d'usage

À quoi ça sert

  • Production RAG pipelines
  • High-throughput coding subagents
  • Bulk data extraction and classification
  • Cost-sensitive enterprise APIs
  • On-premise inference under tight cost budgets
  • Long-document summarisation at scale
  • Real-time chat backends
07

Questions fréquemment posées

Qu'est-ce que DeepSeek V4 Flash ?

DeepSeek V4 Flash est un modèle de DeepSeek dans la catégorie Texte et chat. Sur Railwail, vous pouvez l'appeler avec une clé API via l'API Railwail.

Combien coûte DeepSeek V4 Flash sur Railwail ?

Sur Railwail, DeepSeek V4 Flash coûte 0,36 $US par 1M tokens d'entrée et 1,44 $US par 1M tokens de sortie. Vous êtes facturé pour ce que chaque requête utilise réellement. L'utilisation est payée à partir de crédits prépayés ; 1 crédit équivaut à 0,01 $US.

Quelle est la fenêtre de contexte de DeepSeek V4 Flash ?

La fenêtre de contexte de DeepSeek V4 Flash contient 1 048 575 tokens. Une réponse peut faire jusqu'à 384 000 tokens.

Quelle est la vitesse de DeepSeek V4 Flash ?

Sur Railwail, le temps d'exécution médian de DeepSeek V4 Flash au cours des 90 derniers jours était 1,3 s, basé sur 15 exécutions terminées.

DeepSeek V4 Flash est-il meilleur que DeepSeek V4.1 Flash ?

Cela dépend de la tâche. DeepSeek V4 Flash (DeepSeek) et DeepSeek V4.1 Flash (DeepSeek) sont tous deux des modèles de la catégorie Texte et chat. La page de comparaison affiche leurs prix et spécifications côte à côte.

Comparer DeepSeek V4 Flash et DeepSeek V4.1 Flash

Comment utiliser DeepSeek V4 Flash via l'API ?

Créez une clé API Railwail et envoyez votre requête avec l'ID de modèle deepseek-v4-flash. Des exemples de code pour curl, Python et JavaScript se trouvent dans la section API de cette page.

08

Modèles comparables

Tous dans cette catégorie

Utiliser DeepSeek V4 Flash via l'API

Une clé API pour tous les modèles sur Railwail. L'utilisation est facturée à partir de crédits prépayés, 1 crédit = 0,01 $US.