GPT-5.4 Mini

MultimodalNovoDisponível
por OpenAIID do modelo: gpt-5-4-mini

OpenAI's efficient mid-tier model. 2x faster than its predecessor, 400k context, approaches GPT-5.4 quality on SWE-Bench Pro at a fraction of the cost.

Preço · 1M entrada/saída
US$ 0,90 / US$ 5,40
Contexto
400.000 tokens
Saída máxima
128.000 tokens
Entrada → Saída
Texto + Imagem → Texto
Desenvolvedor
OpenAI
Atualizado
23 de setembro de 2026
01

Playground

Experimentar GPT-5.4 Mini

Chat

US$ 0,90/1M entrada
Experimentar GPT-5.4 Mini

Envie uma mensagem. A resposta chega completa assim que o modelo termina (sem streaming).

Prompt do sistema
Comprimento máximo da resposta (tokens)

Esta execução

no máximo US$ 0,0056 · 0,56 créditos reservados

Cobrado pelos tokens realmente utilizados; a parte não utilizada da reserva é reembolsada.

Novo por aqui?

10 créditos grátis (US$ 0,10) ao se inscrever com Google

Utilizável 24 horas após inscrição, até 5 execuções por dia e no máximo 2 créditos por execução. Outros métodos de login começam sem créditos. Suficiente para 17 execuções deste modelo.

02

Sobre GPT-5.4 Mini

ResumoA partir de 23 de setembro de 2026

GPT-5.4 Mini é um modelo de OpenAI na categoria Multimodal. No Railwail, GPT-5.4 Mini custa US$ 0,90 por 1M tokens de entrada e US$ 5,40 por 1M tokens de saída. A janela de contexto contém 400.000 tokens, e uma resposta pode ter até 128.000 tokens.

Released March 17, 2026, GPT-5.4 mini brings the strengths of GPT-5.4 to a smaller, faster model designed for the subagent era. 400K context, vision input, integrated tool use, and 2x faster latency than GPT-5 mini. Significant gains on coding, reasoning, multimodal understanding and tool use; approaches the full GPT-5.4 on SWE-Bench Pro and OSWorld-Verified. Recommended for subagent workflows, customer-facing chat, coding assistants and high-volume API workloads.

Fundo

Sobre OpenAI

Fundado em 2015 · San Francisco, USA

OpenAI was founded in December 2015 as a non-profit AI research organisation and transitioned to a capped-profit structure in 2019. The GPT lineage spans GPT-1 (2018) through GPT-5 (mid-2025) and the GPT-5.x family (2025-2026) which unified the o-series reasoning models with the general-purpose GPT line. GPT-5.4 mini and nano were announced on March 17, 2026 as the small-model tier of the GPT-5.4 generation. OpenAI is backed by Microsoft, Khosla, Andreessen Horowitz, Thrive Capital and Sequoia, with total funding above $60 billion and a 2026 valuation above $300 billion.

Visite OpenAI

Arquitetura

Unified Transformer (mid-tier, with integrated 'Thinking' tier)

GPT-5.4 mini was announced March 17, 2026 alongside GPT-5.4 nano as the small-model tier of the GPT-5.4 generation. It is a smaller variant of the unified GPT-5.4 architecture, retaining native text + image input, an integrated 'Thinking' tier for reasoning on demand, and the full tool-use API, while running more than 2x faster than GPT-5 mini at significantly lower cost. Pretraining used a similar multi-trillion-token mixture as GPT-5.4 with heavier distillation pressure from larger teacher models. Post-training included supervised fine-tuning, RLHF and reinforcement learning against verifiable rewards on coding, reasoning and tool-use trajectories. On evaluations such as SWE-Bench Pro and OSWorld-Verified, GPT-5.4 mini approaches the performance of full GPT-5.4 while costing roughly one-third as much.

Parâmetros
Undisclosed (estimated tens of billions of parameters, likely sparse MoE)
Contexto
400.000 tokens

Capacidades

  • 2x faster than GPT-5 mini at lower cost
  • Approaches full GPT-5.4 on SWE-Bench Pro and OSWorld-Verified
  • 400K token context window
  • Native multimodal input: text and images
  • Integrated 'Thinking' tier activates for harder reasoning
  • Native tool use, function calling and parallel tool calls
  • Designed for the subagent era: works well under an orchestrator
  • Strong coding, classification and extraction performance
  • Available in ChatGPT, Codex CLI and the OpenAI API
  • Regional processing endpoints available with 10% uplift
  • Best for: subagent workflows, customer-facing chat, coding assistants, high-volume API workloads.

Treinamento & licença

Pretrained on a multi-trillion-token mixture of web text, code, scientific papers and licensed data; heavy distillation from larger GPT-5.4 teacher models. Post-training uses supervised fine-tuning, RLHF and RL against verifiable rewards. Knowledge cutoff approximately late 2025.

Licença: Proprietary commercial license via OpenAI API and Azure OpenAI.

Testes de segurança: Evaluated under OpenAI's Preparedness Framework with internal and external red-teaming and capability evaluations.

Limitações conhecidas

  • Below full GPT-5.4 on the hardest agentic and reasoning benchmarks
  • Smaller context window than GPT-5.4 (400K vs 1.05M)
  • No native audio or video input
  • Knowledge cutoff in late 2025
  • Thinking mode adds latency and token cost when enabled
03

Preços

Preços em dólares americanos. O uso é cobrado a partir de créditos pré-pagos.
EntradaUS$ 0,90 / 1M tokens
SaídaUS$ 5,40 / 1M tokens
  • Cobrado pelos tokens que cada solicitação realmente utiliza.
  • 1 crédito = US$ 0,01

Calculadora de custos

Calculadora de preços

/ req.
/ req.

Total

US$ 0,36

36 créditos

Por requisição

US$ 0,0036 · 0,36 créditos

Cada requisição é arredondada para 0,01 créditos.

04

API

Chame GPT-5.4 Mini com sua chave de API Railwail. Use este ID de modelo na solicitação:
curl https://railwail.com/api/v1/chat/completions \
  -H "Authorization: Bearer $RAILWAIL_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "gpt-5-4-mini",
    "messages": [
      {
        "role": "user",
        "content": "Explain what a vector database is in two sentences."
      }
    ],
    "max_tokens": 1024
  }'
Defina sua chave como RAILWAIL_API_KEYCriar chave de API
05

Especificações

ID do modelo
gpt-5-4-mini
Desenvolvedor
OpenAI
Categoria
Multimodal
Entrada
Texto, Imagem
Saída
Texto
Janela de contexto
400.000 tokens
Saída máx.
128.000 tokens
Faturamento
Por uso (tokens ou tempo de GPU)
Tamanho do modelo
Undisclosed (estimated tens of billions of parameters, likely sparse MoE)
Licença
Proprietary commercial license via OpenAI API and Azure OpenAI.
Entrada do catálogo atualizada
23 de setembro de 2026

Parâmetros de entrada

Entradas e configurações do esquema de entrada do modelo. O exemplo na seção API mostra quais delas a API aceita.

  • promptobrigatório

    User message

    Tipo: Texto
    Padrão: –
    Valores permitidos: até 32.000 caracteres
  • top_p
    Tipo: Número
    Padrão: 1
    Valores permitidos: 0 a 1
  • stream
    Tipo: Sim/Não
    Padrão: false
    Valores permitidos: –
  • image_url

    Optional image URL to analyze

    Tipo: Texto
    Padrão: –
    Valores permitidos: –
  • max_tokens
    Tipo: Número inteiro
    Padrão: 4096
    Valores permitidos: 1 a 32.000
  • temperature
    Tipo: Número
    Padrão: 1
    Valores permitidos: 0 a 2
  • system_prompt

    Optional system instruction

    Tipo: Texto
    Padrão: –
    Valores permitidos: até 8.000 caracteres

Etiquetas

  • openai
  • balanced
  • cost-efficient
  • vision
  • subagents
  • tools
06

Casos de uso

Para que é utilizado

  • Subagent workers under an orchestrator model
  • Production coding assistants and IDE plugins
  • Customer-facing chatbots and triage
  • Large-scale data extraction and classification
  • RAG pipelines with image input
  • Cost-sensitive enterprise APIs
07

Perguntas frequentes

O que é GPT-5.4 Mini?

GPT-5.4 Mini é um modelo de OpenAI na categoria Multimodal. No Railwail você pode chamá-lo com uma chave de API através da API Railwail.

Quanto custa GPT-5.4 Mini no Railwail?

No Railwail, GPT-5.4 Mini custa US$ 0,90 por 1M tokens de entrada e US$ 5,40 por 1M tokens de saída. Você é cobrado pelo que cada solicitação realmente usa. O uso é pago com créditos pré-pagos; 1 crédito equivale a US$ 0,01.

Qual é a janela de contexto de GPT-5.4 Mini?

A janela de contexto de GPT-5.4 Mini contém 400.000 tokens. Uma resposta pode ter até 128.000 tokens.

Qual é a velocidade de GPT-5.4 Mini?

Ainda não há execuções medidas suficientes de GPT-5.4 Mini no Railwail para indicar um tempo de execução. Depende da entrada, das configurações e da carga no provedor.

GPT-5.4 Mini é melhor que BLIP?

Depende da tarefa. GPT-5.4 Mini (OpenAI) e BLIP (Salesforce) são ambos modelos na categoria Multimodal. A página de comparação mostra seus preços e especificações lado a lado.

Comparar GPT-5.4 Mini e BLIP

GPT-5.4 Mini pode processar imagens?

Sim. GPT-5.4 Mini aceita imagens como entrada além de texto.

Como uso GPT-5.4 Mini através da API?

Crie uma chave de API Railwail e envie sua solicitação com o ID do modelo gpt-5-4-mini. Exemplos de código para curl, Python e JavaScript estão na seção API desta página.

08

Modelos comparáveis

Todos nesta categoria

Usar GPT-5.4 Mini via API

Uma chave API para todos os modelos no Railwail. O uso é cobrado a partir de créditos pré-pagos, 1 crédito = US$ 0,01.