DeepSeek V4 Pro

Texto y chatNuevoDisponible
de DeepSeekID del modelo: deepseek-v4-pro

DeepSeek's April 2026 flagship. 1.6T MoE / 49B active params, 1M context, rivals top closed-source models on STEM and coding at a fraction of the price.

Precio · 1M entrada/salida
1,584 US$ / 4,752 US$
Contexto
1.048.576 tokens
Salida máxima
384.000 tokens
Entrada → Salida
Texto → Texto
Desarrollador
DeepSeek
Actualizado
23 de septiembre de 2026
01

Playground

Probar DeepSeek V4 Pro

Chat

1,584 US$/1M entrada
Probar DeepSeek V4 Pro

Envía un mensaje. La respuesta llega completa una vez que el modelo termina (sin streaming).

Prompt del sistema
Longitud máxima de respuesta (tokens)

Esta ejecución

como máximo 0,0049 US$ · 0,49 créditos reservados

Se facturan los tokens realmente utilizados; la parte no utilizada de la reserva se reembolsa.

¿Eres nuevo aquí?

10 créditos gratis (0,10 US$) cuando te registres con Google

Disponible 24 horas después del registro, hasta 5 ejecuciones por día y como máximo 2 créditos por ejecución. Otros métodos de inicio de sesión comienzan sin créditos. Suficiente para 20 ejecuciones de este modelo.

02

Acerca de DeepSeek V4 Pro

ResumenA fecha de 23 de septiembre de 2026

DeepSeek V4 Pro es un modelo de DeepSeek en la categoría Texto y chat. En Railwail, DeepSeek V4 Pro cuesta 1,584 US$ por 1M tokens de entrada y 4,752 US$ por 1M tokens de salida. La ventana de contexto contiene 1.048.576 tokens, y una respuesta puede tener hasta 384.000 tokens.

Released April 24, 2026 as part of the DeepSeek V4 Preview, DeepSeek-V4-Pro is a 1.6T-parameter Mixture-of-Experts model with 49B activated parameters. Native 1M-token context, 384K max output. Tops open-weights leaderboards on Math/STEM/Coding (~81% SWE-bench Verified) and rivals frontier closed-source models. Best for: open-weights coding agents, long-document analysis, cost-efficient reasoning workloads.

Fondo

Acerca de DeepSeek AI

Fundado en 2023 · Hangzhou, China

DeepSeek AI is a Chinese AI research lab founded in 2023 by Liang Wenfeng, the founder of the High-Flyer quantitative hedge fund. The lab is funded primarily by High-Flyer's profits and operates independently of major Chinese tech conglomerates. DeepSeek's mission is to build open frontier AI: every flagship model has been released with open weights and a permissive license. Major releases include DeepSeek LLM (late 2023), DeepSeek-V2 (May 2024, MoE), DeepSeek-V3 (December 2024, 671B MoE / 37B active), DeepSeek-R1 (January 2026 family, reasoning), DeepSeek V3.1 (early 2026) and the DeepSeek V4 family released as preview April 24, 2026. DeepSeek's models repeatedly top open-weights leaderboards on coding, math and reasoning at a fraction of the training cost claimed by Western labs, and the team is credited with popularising large-scale Reinforcement Learning from Verifiable Rewards.

Visitar DeepSeek AI

Arquitectura

Sparse Mixture-of-Experts Transformer (frontier open-weights)

DeepSeek-V4-Pro was released April 24, 2026 as the flagship of the V4 family. It is a Sparse MoE Transformer with 1.6T total parameters and 49B activated per token, supporting a native 1M-token context window with up to 384K-token max output. The model was trained on the lab's expanded GPU cluster using DeepSeek's signature recipe: large-scale pretraining on a multi-trillion-token mixture of web text, code, books, scientific papers and curated math/STEM data, followed by extensive Reinforcement Learning from Verifiable Rewards (RLVR) on math, coding and tool-use trajectories. Architectural innovations introduced in V3 - Multi-head Latent Attention (MLA), DeepSeekMoE with fine-grained expert specialization and shared experts, and FP8 mixed-precision training - are retained and refined. V4 Pro is published with open weights under a permissive license and runs natively in both server and inference frameworks such as vLLM and SGLang. DeepSeek treats the V4 launch as a preview phase and has announced that the older deepseek-chat and deepseek-reasoner endpoints will be deprecated on July 24, 2026.

Parámetros
1.6T total / 49B active per token
Contexto
1.048.576 tokens

Capacidades

  • 1M token native context window with 384K max output
  • ~81% SWE-bench Verified - rivals top closed-source models
  • Top open-weights scores on Math/STEM/Coding benchmarks
  • 1.6T MoE / 49B active parameters
  • FP8-trained for compute efficiency
  • Multi-head Latent Attention for memory-efficient long context
  • Function calling and structured JSON output
  • Cache hit pricing at $0.0145 per million tokens enables cheap multi-turn agents
  • Available via DeepSeek API, OpenRouter, Together, Fireworks and self-hosted with vLLM/SGLang
  • Open weights under a permissive license
  • Best for: open-weights coding agents, long-document analysis, cost-efficient reasoning workloads, on-premise enterprise deployments.

Entrenamiento y licencia

Pretrained on a multi-trillion-token mixture of web text, code, books, scientific papers and curated math/STEM data. Post-training applies large-scale Reinforcement Learning from Verifiable Rewards (RLVR) on math, coding and tool-use tasks, plus supervised fine-tuning and instruction tuning. Knowledge cutoff approximately early 2026.

Licencia: Open weights under a permissive license that allows commercial use. Hosted API access via deepseek.com.

Pruebas de seguridad: DeepSeek publishes model cards but provides limited external red-teaming. Safety filters are lighter than Western frontier labs; deployers are responsible for downstream alignment.

Limitaciones conocidas

  • Light built-in safety alignment relative to Western frontier models
  • No native vision or audio input (text-only)
  • Pro variant requires substantial GPU resources to self-host
  • Older deepseek-chat / deepseek-reasoner endpoints will be deprecated July 24, 2026
  • Some Chinese-language safety constraints apply
03

Precios

Precios en dólares estadounidenses. El uso se cobra con créditos prepagados.
Entrada1,584 US$ / 1M tokens
Salida4,752 US$ / 1M tokens
  • Se facturan los tokens que cada solicitud realmente utiliza.
  • 1 crédito = 0,01 US$

Calculadora de costes

Calculadora de precios

/ solicitud
/ solicitud

Total

0,40 US$

40 créditos

Por solicitud

0,004 US$ · 0,4 créditos

Cada solicitud se redondea a 0,01 créditos.

04

API

Llama a DeepSeek V4 Pro con tu clave API de Railwail. Usa este ID de modelo en la solicitud:
curl https://railwail.com/api/v1/chat/completions \
  -H "Authorization: Bearer $RAILWAIL_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "deepseek-v4-pro",
    "messages": [
      {
        "role": "user",
        "content": "Explain what a vector database is in two sentences."
      }
    ],
    "max_tokens": 1024
  }'
Establece tu clave como RAILWAIL_API_KEYCrear clave API
05

Especificaciones

ID del modelo
deepseek-v4-pro
Desarrollador
DeepSeek
Categoría
Texto y chat
Entrada
Texto
Salida
Texto
Ventana de contexto
1.048.576 tokens
Salida máxima
384.000 tokens
Facturación
Por uso (tokens o tiempo de GPU)
Lanzado
24 de abril de 2026
Ciclo de vida
Versión actual
Tamaño del modelo
1.6T total / 49B active per token
Licencia
Open weights under a permissive license that allows commercial use. Hosted API access via deepseek.com.
Entrada del catálogo actualizada
23 de septiembre de 2026

Parámetros de entrada

Entradas y configuración del esquema de entrada del modelo. El ejemplo en la sección API muestra cuáles de ellas acepta la API.

  • promptObligatorio

    User message

    Tipo: Texto
    Predeterminado: –
    Valores permitidos: Hasta 32.000 caracteres
  • top_p
    Tipo: Número
    Predeterminado: 1
    Valores permitidos: 0 a 1
  • stream
    Tipo: Sí/No
    Predeterminado: false
    Valores permitidos: –
  • max_tokens
    Tipo: Número entero
    Predeterminado: 4096
    Valores permitidos: 1 a 32.000
  • temperature
    Tipo: Número
    Predeterminado: 0.7
    Valores permitidos: 0 a 2
  • system_prompt

    Optional system instruction

    Tipo: Texto
    Predeterminado: –
    Valores permitidos: Hasta 8000 caracteres

Etiquetas

  • deepseek
  • open-weights
  • moe
  • coding
  • reasoning
  • long-context
  • 1m-context
  • flagship
06

Casos de uso

Para qué se utiliza

  • Open-weights coding agents
  • Long-document analysis
  • On-premise enterprise deployments
  • Cost-efficient frontier reasoning workloads
  • Math and STEM tutoring backends
  • Research and academic use under permissive license
  • RAG over millions of tokens of context
07

Preguntas frecuentes

¿Qué es DeepSeek V4 Pro?

DeepSeek V4 Pro es un modelo de DeepSeek en la categoría Texto y chat. En Railwail puedes llamarlo con una clave API a través de la API de Railwail.

¿Cuánto cuesta DeepSeek V4 Pro en Railwail?

En Railwail, DeepSeek V4 Pro cuesta 1,584 US$ por 1M tokens de entrada y 4,752 US$ por 1M tokens de salida. Se te cobra por lo que cada solicitud realmente consume. El uso se paga con créditos prepagados; 1 crédito equivale a 0,01 US$.

¿Cuál es la ventana de contexto de DeepSeek V4 Pro?

La ventana de contexto de DeepSeek V4 Pro contiene 1.048.576 tokens. Una respuesta puede tener hasta 384.000 tokens.

¿Qué velocidad tiene DeepSeek V4 Pro?

Aún no hay suficientes ejecuciones medidas de DeepSeek V4 Pro en Railwail para indicar un tiempo de ejecución. Depende de la entrada, la configuración y la carga en el proveedor.

¿Es DeepSeek V4 Pro mejor que Claude Fable 5.1?

Depende de la tarea. DeepSeek V4 Pro (DeepSeek) y Claude Fable 5.1 (Anthropic) son ambos modelos en la categoría Texto y chat. La página de comparación muestra sus precios y especificaciones lado a lado.

Comparar DeepSeek V4 Pro y Claude Fable 5.1

¿Cómo uso DeepSeek V4 Pro a través de la API?

Crea una clave API de Railwail y envía tu solicitud con el ID de modelo deepseek-v4-pro. Los ejemplos de código para curl, Python y JavaScript están en la sección API de esta página.

08

Modelos comparables

Todos en esta categoría

Usar DeepSeek V4 Pro a través de la API

Una clave API para todos los modelos en Railwail. El uso se cobra desde créditos prepagados, 1 crédito = 0,01 US$.