GPT-5.4 Mini

MultimodalNuevoDisponible
de OpenAIID del modelo: gpt-5-4-mini

OpenAI's efficient mid-tier model. 2x faster than its predecessor, 400k context, approaches GPT-5.4 quality on SWE-Bench Pro at a fraction of the cost.

Precio · 1M entrada/salida
0,90 US$ / 5,40 US$
Contexto
400.000 tokens
Salida máxima
128.000 tokens
Entrada → Salida
Texto + Imagen → Texto
Desarrollador
OpenAI
Actualizado
23 de septiembre de 2026
01

Playground

Probar GPT-5.4 Mini

Chat

0,90 US$/1M entrada
Probar GPT-5.4 Mini

Envía un mensaje. La respuesta llega completa una vez que el modelo termina (sin streaming).

Prompt del sistema
Longitud máxima de respuesta (tokens)

Esta ejecución

como máximo 0,0056 US$ · 0,56 créditos reservados

Se facturan los tokens realmente utilizados; la parte no utilizada de la reserva se reembolsa.

¿Eres nuevo aquí?

10 créditos gratis (0,10 US$) cuando te registres con Google

Disponible 24 horas después del registro, hasta 5 ejecuciones por día y como máximo 2 créditos por ejecución. Otros métodos de inicio de sesión comienzan sin créditos. Suficiente para 17 ejecuciones de este modelo.

02

Acerca de GPT-5.4 Mini

ResumenA fecha de 23 de septiembre de 2026

GPT-5.4 Mini es un modelo de OpenAI en la categoría Multimodal. En Railwail, GPT-5.4 Mini cuesta 0,90 US$ por 1M tokens de entrada y 5,40 US$ por 1M tokens de salida. La ventana de contexto contiene 400.000 tokens, y una respuesta puede tener hasta 128.000 tokens.

Released March 17, 2026, GPT-5.4 mini brings the strengths of GPT-5.4 to a smaller, faster model designed for the subagent era. 400K context, vision input, integrated tool use, and 2x faster latency than GPT-5 mini. Significant gains on coding, reasoning, multimodal understanding and tool use; approaches the full GPT-5.4 on SWE-Bench Pro and OSWorld-Verified. Recommended for subagent workflows, customer-facing chat, coding assistants and high-volume API workloads.

Fondo

Acerca de OpenAI

Fundado en 2015 · San Francisco, USA

OpenAI was founded in December 2015 as a non-profit AI research organisation and transitioned to a capped-profit structure in 2019. The GPT lineage spans GPT-1 (2018) through GPT-5 (mid-2025) and the GPT-5.x family (2025-2026) which unified the o-series reasoning models with the general-purpose GPT line. GPT-5.4 mini and nano were announced on March 17, 2026 as the small-model tier of the GPT-5.4 generation. OpenAI is backed by Microsoft, Khosla, Andreessen Horowitz, Thrive Capital and Sequoia, with total funding above $60 billion and a 2026 valuation above $300 billion.

Visitar OpenAI

Arquitectura

Unified Transformer (mid-tier, with integrated 'Thinking' tier)

GPT-5.4 mini was announced March 17, 2026 alongside GPT-5.4 nano as the small-model tier of the GPT-5.4 generation. It is a smaller variant of the unified GPT-5.4 architecture, retaining native text + image input, an integrated 'Thinking' tier for reasoning on demand, and the full tool-use API, while running more than 2x faster than GPT-5 mini at significantly lower cost. Pretraining used a similar multi-trillion-token mixture as GPT-5.4 with heavier distillation pressure from larger teacher models. Post-training included supervised fine-tuning, RLHF and reinforcement learning against verifiable rewards on coding, reasoning and tool-use trajectories. On evaluations such as SWE-Bench Pro and OSWorld-Verified, GPT-5.4 mini approaches the performance of full GPT-5.4 while costing roughly one-third as much.

Parámetros
Undisclosed (estimated tens of billions of parameters, likely sparse MoE)
Contexto
400.000 tokens

Capacidades

  • 2x faster than GPT-5 mini at lower cost
  • Approaches full GPT-5.4 on SWE-Bench Pro and OSWorld-Verified
  • 400K token context window
  • Native multimodal input: text and images
  • Integrated 'Thinking' tier activates for harder reasoning
  • Native tool use, function calling and parallel tool calls
  • Designed for the subagent era: works well under an orchestrator
  • Strong coding, classification and extraction performance
  • Available in ChatGPT, Codex CLI and the OpenAI API
  • Regional processing endpoints available with 10% uplift
  • Best for: subagent workflows, customer-facing chat, coding assistants, high-volume API workloads.

Entrenamiento y licencia

Pretrained on a multi-trillion-token mixture of web text, code, scientific papers and licensed data; heavy distillation from larger GPT-5.4 teacher models. Post-training uses supervised fine-tuning, RLHF and RL against verifiable rewards. Knowledge cutoff approximately late 2025.

Licencia: Proprietary commercial license via OpenAI API and Azure OpenAI.

Pruebas de seguridad: Evaluated under OpenAI's Preparedness Framework with internal and external red-teaming and capability evaluations.

Limitaciones conocidas

  • Below full GPT-5.4 on the hardest agentic and reasoning benchmarks
  • Smaller context window than GPT-5.4 (400K vs 1.05M)
  • No native audio or video input
  • Knowledge cutoff in late 2025
  • Thinking mode adds latency and token cost when enabled
03

Precios

Precios en dólares estadounidenses. El uso se cobra con créditos prepagados.
Entrada0,90 US$ / 1M tokens
Salida5,40 US$ / 1M tokens
  • Se facturan los tokens que cada solicitud realmente utiliza.
  • 1 crédito = 0,01 US$

Calculadora de costes

Calculadora de precios

/ solicitud
/ solicitud

Total

0,36 US$

36 créditos

Por solicitud

0,0036 US$ · 0,36 créditos

Cada solicitud se redondea a 0,01 créditos.

04

API

Llama a GPT-5.4 Mini con tu clave API de Railwail. Usa este ID de modelo en la solicitud:
curl https://railwail.com/api/v1/chat/completions \
  -H "Authorization: Bearer $RAILWAIL_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "gpt-5-4-mini",
    "messages": [
      {
        "role": "user",
        "content": "Explain what a vector database is in two sentences."
      }
    ],
    "max_tokens": 1024
  }'
Establece tu clave como RAILWAIL_API_KEYCrear clave API
05

Especificaciones

ID del modelo
gpt-5-4-mini
Desarrollador
OpenAI
Categoría
Multimodal
Entrada
Texto, Imagen
Salida
Texto
Ventana de contexto
400.000 tokens
Salida máxima
128.000 tokens
Facturación
Por uso (tokens o tiempo de GPU)
Tamaño del modelo
Undisclosed (estimated tens of billions of parameters, likely sparse MoE)
Licencia
Proprietary commercial license via OpenAI API and Azure OpenAI.
Entrada del catálogo actualizada
23 de septiembre de 2026

Parámetros de entrada

Entradas y configuración del esquema de entrada del modelo. El ejemplo en la sección API muestra cuáles de ellas acepta la API.

  • promptObligatorio

    User message

    Tipo: Texto
    Predeterminado: –
    Valores permitidos: Hasta 32.000 caracteres
  • top_p
    Tipo: Número
    Predeterminado: 1
    Valores permitidos: 0 a 1
  • stream
    Tipo: Sí/No
    Predeterminado: false
    Valores permitidos: –
  • image_url

    Optional image URL to analyze

    Tipo: Texto
    Predeterminado: –
    Valores permitidos: –
  • max_tokens
    Tipo: Número entero
    Predeterminado: 4096
    Valores permitidos: 1 a 32.000
  • temperature
    Tipo: Número
    Predeterminado: 1
    Valores permitidos: 0 a 2
  • system_prompt

    Optional system instruction

    Tipo: Texto
    Predeterminado: –
    Valores permitidos: Hasta 8000 caracteres

Etiquetas

  • openai
  • balanced
  • cost-efficient
  • vision
  • subagents
  • tools
06

Casos de uso

Para qué se utiliza

  • Subagent workers under an orchestrator model
  • Production coding assistants and IDE plugins
  • Customer-facing chatbots and triage
  • Large-scale data extraction and classification
  • RAG pipelines with image input
  • Cost-sensitive enterprise APIs
07

Preguntas frecuentes

¿Qué es GPT-5.4 Mini?

GPT-5.4 Mini es un modelo de OpenAI en la categoría Multimodal. En Railwail puedes llamarlo con una clave API a través de la API de Railwail.

¿Cuánto cuesta GPT-5.4 Mini en Railwail?

En Railwail, GPT-5.4 Mini cuesta 0,90 US$ por 1M tokens de entrada y 5,40 US$ por 1M tokens de salida. Se te cobra por lo que cada solicitud realmente consume. El uso se paga con créditos prepagados; 1 crédito equivale a 0,01 US$.

¿Cuál es la ventana de contexto de GPT-5.4 Mini?

La ventana de contexto de GPT-5.4 Mini contiene 400.000 tokens. Una respuesta puede tener hasta 128.000 tokens.

¿Qué velocidad tiene GPT-5.4 Mini?

Aún no hay suficientes ejecuciones medidas de GPT-5.4 Mini en Railwail para indicar un tiempo de ejecución. Depende de la entrada, la configuración y la carga en el proveedor.

¿Es GPT-5.4 Mini mejor que BLIP?

Depende de la tarea. GPT-5.4 Mini (OpenAI) y BLIP (Salesforce) son ambos modelos en la categoría Multimodal. La página de comparación muestra sus precios y especificaciones lado a lado.

Comparar GPT-5.4 Mini y BLIP

¿Puede GPT-5.4 Mini procesar imágenes?

Sí. GPT-5.4 Mini acepta imágenes como entrada además de texto.

¿Cómo uso GPT-5.4 Mini a través de la API?

Crea una clave API de Railwail y envía tu solicitud con el ID de modelo gpt-5-4-mini. Los ejemplos de código para curl, Python y JavaScript están en la sección API de esta página.

08

Modelos comparables

Todos en esta categoría

Usar GPT-5.4 Mini a través de la API

Una clave API para todos los modelos en Railwail. El uso se cobra desde créditos prepagados, 1 crédito = 0,01 US$.