DeepSeek V4 Flash

Texto e chatDescontinuadoDisponível
por DeepSeekID do modelo: deepseek-v4-flash

Efficiency-optimized variant of DeepSeek V4. 284B MoE / 13B active, 1M context, ultra-low pricing for high-throughput workloads.

Preço · 1M entrada/saída
US$ 0,36 / US$ 1,44
Contexto
1.048.575 tokens
Saída máxima
384.000 tokens
Entrada → Saída
Texto → Texto
Tempo de execução (mediana)
1,3 s
Desenvolvedor
DeepSeek

O provedor está descontinuando este modelo.

Nova versão disponível: DeepSeek V4.1 Flash

01

Playground

Experimentar DeepSeek V4 Flash

Chat

US$ 0,36/1M entrada
Experimentar DeepSeek V4 Flash

Envie uma mensagem. A resposta chega completa assim que o modelo termina (sem streaming).

Prompt do sistema
Comprimento máximo da resposta (tokens)

Esta execução

no máximo US$ 0,0015 · 0,15 créditos reservados

Cobrado pelos tokens realmente utilizados; a parte não utilizada da reserva é reembolsada.

Novo por aqui?

10 créditos grátis (US$ 0,10) ao se inscrever com Google

Utilizável 24 horas após inscrição, até 5 execuções por dia e no máximo 2 créditos por execução. Outros métodos de login começam sem créditos. Suficiente para 66 execuções deste modelo.

02

Sobre DeepSeek V4 Flash

ResumoA partir de 23 de setembro de 2026

DeepSeek V4 Flash é um modelo de DeepSeek na categoria Texto e chat. No Railwail, DeepSeek V4 Flash custa US$ 0,36 por 1M tokens de entrada e US$ 1,44 por 1M tokens de saída. A janela de contexto contém 1.048.575 tokens, e uma resposta pode ter até 384.000 tokens. Versão mais recente: DeepSeek V4.1 Flash.

DeepSeek-V4-Flash is the cost-efficient sibling of V4-Pro, released April 2026 as part of the V4 Preview. 284B total / 13B active MoE parameters with the same 1M-token context window. Designed for high-throughput agentic loops, RAG and batch tasks where latency and cost matter more than raw capability. Recommended for production agents, classification at scale, large-scale data extraction.

Fundo

Sobre DeepSeek AI

Fundado em 2023 · Hangzhou, China

DeepSeek AI is a Chinese AI research lab founded in 2023 by Liang Wenfeng, founder of the High-Flyer quantitative hedge fund. The lab is funded primarily by High-Flyer's profits. Its mission is open frontier AI, with all flagship models released with open weights. Major releases include DeepSeek LLM (2023), DeepSeek-V2 (May 2024), DeepSeek-V3 (December 2024), DeepSeek-R1 (January 2026), DeepSeek V3.1 (early 2026) and the DeepSeek V4 family (April 24, 2026), comprising V4-Pro and V4-Flash. DeepSeek is credited with popularising large-scale Reinforcement Learning from Verifiable Rewards and consistently tops open-weights leaderboards.

Visite DeepSeek AI

Arquitetura

Sparse Mixture-of-Experts Transformer (efficiency-optimized open-weights)

DeepSeek-V4-Flash was released April 24, 2026 as the efficiency-optimized sibling of V4-Pro. It is a Sparse MoE Transformer with 284B total parameters and 13B activated per token, retaining the full 1M-token native context window and 384K-token max output of the Pro variant at significantly lower inference cost. The model uses the same DeepSeek architectural stack: Multi-head Latent Attention (MLA), DeepSeekMoE with fine-grained expert specialization and shared experts, and FP8 mixed-precision training. Post-training combined supervised fine-tuning, RLVR on math/code/tool-use trajectories, and heavy distillation from the V4-Pro teacher model. V4 Flash is published with open weights under a permissive license and is designed for production-scale RAG, agentic loops and high-throughput workloads. At $0.112 input / $0.224 output per million tokens it undercuts every Western frontier model by an order of magnitude.

Parâmetros
284B total / 13B active per token
Contexto
1.048.575 tokens

Capacidades

  • 1M token native context window with 384K max output
  • 284B MoE / 13B active parameters
  • Ultra-low pricing ($0.112 / $0.224 per million tokens)
  • Distilled from DeepSeek V4-Pro teacher model
  • FP8-trained for compute efficiency
  • Multi-head Latent Attention for memory-efficient long context
  • Function calling and structured JSON output
  • Strong on math, STEM and coding for its size
  • Available via DeepSeek API, OpenRouter, Together and self-hosted with vLLM/SGLang
  • Open weights under a permissive license
  • Best for: production agents, RAG pipelines, high-throughput data extraction, on-premise inference under tight cost budgets.

Treinamento & licença

Pretrained on the same multi-trillion-token mixture as V4-Pro. Post-training combines supervised fine-tuning, RLVR and distillation from the V4-Pro teacher model. Knowledge cutoff approximately early 2026.

Licença: Open weights under a permissive license that allows commercial use. Hosted API access via deepseek.com.

Testes de segurança: DeepSeek publishes model cards but provides limited external red-teaming. Safety filters are lighter than Western frontier labs; deployers are responsible for downstream alignment.

Limitações conhecidas

  • Below V4-Pro on the hardest reasoning and coding benchmarks
  • Light built-in safety alignment relative to Western frontier models
  • No native vision or audio input (text-only)
  • Older deepseek-chat / deepseek-reasoner endpoints will be deprecated July 24, 2026
  • Some Chinese-language safety constraints apply
03

Preços

Preços em dólares americanos. O uso é cobrado a partir de créditos pré-pagos.
EntradaUS$ 0,36 / 1M tokens
SaídaUS$ 1,44 / 1M tokens
  • Cobrado pelos tokens que cada solicitação realmente utiliza.
  • 1 crédito = US$ 0,01

Calculadora de custos

Calculadora de preços

/ req.
/ req.

Total

US$ 0,11

11 créditos

Por requisição

US$ 0,0011 · 0,11 créditos

Cada requisição é arredondada para 0,01 créditos.

04

API

Chame DeepSeek V4 Flash com sua chave de API Railwail. Use este ID de modelo na solicitação:
curl https://railwail.com/api/v1/chat/completions \
  -H "Authorization: Bearer $RAILWAIL_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "deepseek-v4-flash",
    "messages": [
      {
        "role": "user",
        "content": "Explain what a vector database is in two sentences."
      }
    ],
    "max_tokens": 1024
  }'
Defina sua chave como RAILWAIL_API_KEYCriar chave de API
05

Especificações

ID do modelo
deepseek-v4-flash
Desenvolvedor
DeepSeek
Categoria
Texto e chat
Entrada
Texto
Saída
Texto
Janela de contexto
1.048.575 tokens
Saída máx.
384.000 tokens
Faturamento
Por uso (tokens ou tempo de GPU)
Tempo de execução (mediana)
1,3 s15 execuções concluídas no Railwail nos últimos 90 dias
Ciclo de vida
Descontinuado
Tamanho do modelo
284B total / 13B active per token
Licença
Open weights under a permissive license that allows commercial use. Hosted API access via deepseek.com.
Entrada do catálogo atualizada
23 de setembro de 2026

Etiquetas

  • deepseek
  • open-weights
  • moe
  • cost-efficient
  • long-context
  • 1m-context
06

Casos de uso

Para que é utilizado

  • Production RAG pipelines
  • High-throughput coding subagents
  • Bulk data extraction and classification
  • Cost-sensitive enterprise APIs
  • On-premise inference under tight cost budgets
  • Long-document summarisation at scale
  • Real-time chat backends
07

Perguntas frequentes

O que é DeepSeek V4 Flash?

DeepSeek V4 Flash é um modelo de DeepSeek na categoria Texto e chat. No Railwail você pode chamá-lo com uma chave de API através da API Railwail.

Quanto custa DeepSeek V4 Flash no Railwail?

No Railwail, DeepSeek V4 Flash custa US$ 0,36 por 1M tokens de entrada e US$ 1,44 por 1M tokens de saída. Você é cobrado pelo que cada solicitação realmente usa. O uso é pago com créditos pré-pagos; 1 crédito equivale a US$ 0,01.

Qual é a janela de contexto de DeepSeek V4 Flash?

A janela de contexto de DeepSeek V4 Flash contém 1.048.575 tokens. Uma resposta pode ter até 384.000 tokens.

Qual é a velocidade de DeepSeek V4 Flash?

No Railwail, o tempo de execução mediano de DeepSeek V4 Flash nos últimos 90 dias foi 1,3 s, com base em 15 execuções concluídas.

DeepSeek V4 Flash é melhor que DeepSeek V4.1 Flash?

Depende da tarefa. DeepSeek V4 Flash (DeepSeek) e DeepSeek V4.1 Flash (DeepSeek) são ambos modelos na categoria Texto e chat. A página de comparação mostra seus preços e especificações lado a lado.

Comparar DeepSeek V4 Flash e DeepSeek V4.1 Flash

Como uso DeepSeek V4 Flash através da API?

Crie uma chave de API Railwail e envie sua solicitação com o ID do modelo deepseek-v4-flash. Exemplos de código para curl, Python e JavaScript estão na seção API desta página.

08

Modelos comparáveis

Todos nesta categoria

Usar DeepSeek V4 Flash via API

Uma chave API para todos os modelos no Railwail. O uso é cobrado a partir de créditos pré-pagos, 1 crédito = US$ 0,01.