DeepSeek V4.1 Flash
deepseek-v4-1-flashDeepSeek's current Flash model (API name deepseek-flash, model version DeepSeek-V4.1-Flash): 1M-token context, up to 384K output tokens, JSON output, tool calls and vision input.
- Prix · 1M entrée/sortie
- 0,36Â $US / 1,44Â $US
- Contexte
- 1 000 000 tokens
- Max. sortie
- 384 000 tokens
- Entrée → Sortie
- Texte + Image → Texte
- Développeur
- DeepSeek
- Mis à jour
- 23 septembre 2026
Playground
Essayer DeepSeek V4.1 Flash
Chat
Cette exécution
au maximum 0,0015 $US · 0,15 crédits réservés
Facturation selon les tokens réellement utilisés ; la partie inutilisée de la réservation est remboursée.
Nouveau par ici ?
5 crédits gratuits (0,05 $US) lors de l'inscription avec Google
Utilisable 24 heures après l'inscription, jusqu'à 5 exécutions par jour et au maximum 2 crédits par exécution. Les autres méthodes de connexion commencent sans crédits. Suffisant pour 33 exécutions de ce modèle.
À propos de DeepSeek V4.1 Flash
DeepSeek V4.1 Flash est un modèle de DeepSeek dans la catégorie Texte et chat. Sur Railwail, DeepSeek V4.1 Flash coûte 0,36 $US par 1M tokens d'entrée et 1,44 $US par 1M tokens de sortie. La fenêtre de contexte contient 1 000 000 tokens, et une réponse peut faire jusqu'à 384 000 tokens.
Tarification
| Entrée | 0,36 $US / 1M tokens |
|---|---|
| Sortie | 1,44Â $US / 1M tokens |
- Facturé selon les tokens que chaque requête utilise réellement.
- 1 crédit = 0,01 $US
Calculateur de coûts
Calculateur de prix
Total
0,11Â $US
11 crédits
Par requête
0,0011 $US · 0,11 crédits
Chaque requête est arrondie à 0,01 crédit.
API
curl https://railwail.com/api/v1/chat/completions \
-H "Authorization: Bearer $RAILWAIL_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "deepseek-v4-1-flash",
"messages": [
{
"role": "user",
"content": "Explain what a vector database is in two sentences."
}
],
"max_tokens": 1024
}'import os
from openai import OpenAI
client = OpenAI(
api_key=os.environ["RAILWAIL_API_KEY"],
base_url="https://railwail.com/api/v1",
)
completion = client.chat.completions.create(
model="deepseek-v4-1-flash",
messages=[
{
"role": "user",
"content": "Explain what a vector database is in two sentences.",
},
],
max_tokens=1024,
)
print(completion.choices[0].message.content)import OpenAI from "openai";
const client = new OpenAI({
apiKey: process.env.RAILWAIL_API_KEY,
baseURL: "https://railwail.com/api/v1",
});
const completion = await client.chat.completions.create({
model: "deepseek-v4-1-flash",
messages: [
{
role: "user",
content: "Explain what a vector database is in two sentences."
}
],
max_tokens: 1024
});
console.log(completion.choices[0].message.content);// npm install railwail
import railwail from "railwail";
const rw = railwail(process.env.RAILWAIL_API_KEY);
const res = await rw.chat("deepseek-v4-1-flash", [
{ role: "user", content: "Explain what a vector database is in two sentences." },
], { max_tokens: 1024 });
console.log(res.choices[0].message.content);Spécifications
- ID du modèle
deepseek-v4-1-flash- Développeur
- DeepSeek
- Catégorie
- Texte et chat
- Entrée
- Texte, Image
- Sortie
- Texte
- Fenêtre de contexte
- 1 000 000 tokens
- Sortie max.
- 384 000 tokens
- Facturation
- À l'usage (tokens ou temps GPU)
- Publié
- 10 septembre 2026
- Cycle de vie
- Version actuelle
- Entrée du catalogue mise à jour
- 23 septembre 2026
Paramètres d'entrée
Entrées et paramètres du schéma d'entrée du modèle. L'exemple dans la section API montre lesquels l'API accepte.
promptObligatoireUser message
Type: TexteDéfaut: –Valeurs autorisées: Jusqu'à 32 000 caractèrestop_pType: NombreDéfaut:1Valeurs autorisées: 0 à 1streamType: Oui/NonDéfaut:falseValeurs autorisées: –max_tokensType: Nombre entierDéfaut:4096Valeurs autorisées: 1 à 384 000temperatureType: NombreDéfaut:0.7Valeurs autorisées: 0 à 2system_promptOptional system instruction
Type: TexteDéfaut: –Valeurs autorisées: Jusqu'à 8 000 caractères
Étiquettes
- deepseek
- open-weights
- cost-efficient
- long-context
- 1m-context
- anon-free
Cas d'usage
Questions fréquemment posées
Qu'est-ce que DeepSeek V4.1 Flash ?
DeepSeek V4.1 Flash est un modèle de DeepSeek dans la catégorie Texte et chat. Sur Railwail, vous pouvez l'appeler avec une clé API via l'API Railwail.
Combien coûte DeepSeek V4.1 Flash sur Railwail ?
Sur Railwail, DeepSeek V4.1 Flash coûte 0,36 $US par 1M tokens d'entrée et 1,44 $US par 1M tokens de sortie. Vous êtes facturé pour ce que chaque requête utilise réellement. L'utilisation est payée à partir de crédits prépayés ; 1 crédit équivaut à 0,01 $US.
Quelle est la fenêtre de contexte de DeepSeek V4.1 Flash ?
La fenêtre de contexte de DeepSeek V4.1 Flash contient 1 000 000 tokens. Une réponse peut faire jusqu'à 384 000 tokens.
Quelle est la vitesse de DeepSeek V4.1 Flash ?
Il n'y a pas encore assez d'exécutions mesurées de DeepSeek V4.1 Flash sur Railwail pour indiquer un temps d'exécution. Cela dépend de l'entrée, des paramètres et de la charge chez le fournisseur.
DeepSeek V4.1 Flash est-il meilleur que Claude Fable 5.1 ?
Cela dépend de la tâche. DeepSeek V4.1 Flash (DeepSeek) et Claude Fable 5.1 (Anthropic) sont tous deux des modèles de la catégorie Texte et chat. La page de comparaison affiche leurs prix et spécifications côte à côte.
Comparer DeepSeek V4.1 Flash et Claude Fable 5.1DeepSeek V4.1 Flash peut-il traiter des images ?
Oui. DeepSeek V4.1 Flash accepte les images en entrée en plus du texte.
Comment utiliser DeepSeek V4.1 Flash via l'API ?
Créez une clé API Railwail et envoyez votre requête avec l'ID de modèle deepseek-v4-1-flash. Des exemples de code pour curl, Python et JavaScript se trouvent dans la section API de cette page.
Modèles comparables
Tous dans cette catégorie- Claude Fable 5.1Anthropic
Anthropic's model for the most demanding reasoning and long-horizon agentic work. 1M-token context window, up to 128K output tokens, adaptive thinking that is always on.
- Claude Opus 4.8Anthropic
The most capable model of Anthropic's Opus 4 series. State of the art on long-horizon agentic work, coding and knowledge tasks, with a 1M-token context window at standard pricing.
- Claude Opus 5.5Anthropic
Anthropic's current Opus model for long-running agentic coding and knowledge work. 1M-token context window, up to 128K output tokens, adaptive thinking that is always on.
Utiliser DeepSeek V4.1 Flash via l'API
Une clé API pour tous les modèles sur Railwail. L'utilisation est facturée à partir de crédits prépayés, 1 crédit = 0,01 $US.