GPT-5.4 Mini

MultimodalNouveauDisponible
par OpenAIID du modèle: gpt-5-4-mini

OpenAI's efficient mid-tier model. 2x faster than its predecessor, 400k context, approaches GPT-5.4 quality on SWE-Bench Pro at a fraction of the cost.

Prix · 1M entrée/sortie
0,90 $US / 5,40 $US
Contexte
400.000 tokens
Max. sortie
128.000 tokens
Entrée → Sortie
Texte + Image → Texte
Développeur
OpenAI
Mis à jour
23 septembre 2026
01

Playground

Essayer GPT-5.4 Mini

Chat

0,90 $US/1M entrée
Essayer GPT-5.4 Mini

Envoyez un message. La réponse arrive complète une fois que le modèle a terminé (sans streaming).

Prompt système
Longueur max. de la réponse (tokens)

Cette exécution

au maximum 0,0056 $US · 0,56 crédits réservés

Facturation selon les tokens réellement utilisés ; la partie inutilisée de la réservation est remboursée.

Nouveau par ici ?

10 crédits gratuits (0,10 $US) lors de l'inscription avec Google

Utilisable 24 heures après l'inscription, jusqu'à 5 exécutions par jour et au maximum 2 crédits par exécution. Les autres méthodes de connexion commencent sans crédits. Suffisant pour 17 exécutions de ce modèle.

02

À propos de GPT-5.4 Mini

RésuméAu 23 septembre 2026

GPT-5.4 Mini est un modèle de OpenAI dans la catégorie Multimodal. Sur Railwail, GPT-5.4 Mini coûte 0,90 $US par 1M tokens d'entrée et 5,40 $US par 1M tokens de sortie. La fenêtre de contexte contient 400.000 tokens, et une réponse peut faire jusqu'à 128.000 tokens.

Released March 17, 2026, GPT-5.4 mini brings the strengths of GPT-5.4 to a smaller, faster model designed for the subagent era. 400K context, vision input, integrated tool use, and 2x faster latency than GPT-5 mini. Significant gains on coding, reasoning, multimodal understanding and tool use; approaches the full GPT-5.4 on SWE-Bench Pro and OSWorld-Verified. Recommended for subagent workflows, customer-facing chat, coding assistants and high-volume API workloads.

Arrière-plan

À propos de OpenAI

Fondée 2015 · San Francisco, USA

OpenAI was founded in December 2015 as a non-profit AI research organisation and transitioned to a capped-profit structure in 2019. The GPT lineage spans GPT-1 (2018) through GPT-5 (mid-2025) and the GPT-5.x family (2025-2026) which unified the o-series reasoning models with the general-purpose GPT line. GPT-5.4 mini and nano were announced on March 17, 2026 as the small-model tier of the GPT-5.4 generation. OpenAI is backed by Microsoft, Khosla, Andreessen Horowitz, Thrive Capital and Sequoia, with total funding above $60 billion and a 2026 valuation above $300 billion.

Visiter OpenAI

Architecture

Unified Transformer (mid-tier, with integrated 'Thinking' tier)

GPT-5.4 mini was announced March 17, 2026 alongside GPT-5.4 nano as the small-model tier of the GPT-5.4 generation. It is a smaller variant of the unified GPT-5.4 architecture, retaining native text + image input, an integrated 'Thinking' tier for reasoning on demand, and the full tool-use API, while running more than 2x faster than GPT-5 mini at significantly lower cost. Pretraining used a similar multi-trillion-token mixture as GPT-5.4 with heavier distillation pressure from larger teacher models. Post-training included supervised fine-tuning, RLHF and reinforcement learning against verifiable rewards on coding, reasoning and tool-use trajectories. On evaluations such as SWE-Bench Pro and OSWorld-Verified, GPT-5.4 mini approaches the performance of full GPT-5.4 while costing roughly one-third as much.

Paramètres
Undisclosed (estimated tens of billions of parameters, likely sparse MoE)
Contexte
400.000 tokens

Capacités

  • 2x faster than GPT-5 mini at lower cost
  • Approaches full GPT-5.4 on SWE-Bench Pro and OSWorld-Verified
  • 400K token context window
  • Native multimodal input: text and images
  • Integrated 'Thinking' tier activates for harder reasoning
  • Native tool use, function calling and parallel tool calls
  • Designed for the subagent era: works well under an orchestrator
  • Strong coding, classification and extraction performance
  • Available in ChatGPT, Codex CLI and the OpenAI API
  • Regional processing endpoints available with 10% uplift
  • Best for: subagent workflows, customer-facing chat, coding assistants, high-volume API workloads.

Formation & licence

Pretrained on a multi-trillion-token mixture of web text, code, scientific papers and licensed data; heavy distillation from larger GPT-5.4 teacher models. Post-training uses supervised fine-tuning, RLHF and RL against verifiable rewards. Knowledge cutoff approximately late 2025.

Licence: Proprietary commercial license via OpenAI API and Azure OpenAI.

Tests de sécurité: Evaluated under OpenAI's Preparedness Framework with internal and external red-teaming and capability evaluations.

Limitations connues

  • Below full GPT-5.4 on the hardest agentic and reasoning benchmarks
  • Smaller context window than GPT-5.4 (400K vs 1.05M)
  • No native audio or video input
  • Knowledge cutoff in late 2025
  • Thinking mode adds latency and token cost when enabled
03

Tarification

Prix en dollars américains. L'utilisation est facturée à partir de crédits prépayés.
Entrée0,90 $US / 1M tokens
Sortie5,40 $US / 1M tokens
  • Facturé selon les tokens que chaque requête utilise réellement.
  • 1 crédit = 0,01 $US

Calculateur de coûts

Calculatrice de prix

/ req.
/ req.

Total

0,36 $US

36 crédits

Par requête

0,0036 $US · 0,36 crédits

Chaque requête est arrondie à 0,01 crédits.

04

API

Appelez GPT-5.4 Mini avec votre clé API Railwail. Utilisez cet ID de modèle dans la requête :
curl https://railwail.com/api/v1/chat/completions \
  -H "Authorization: Bearer $RAILWAIL_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "gpt-5-4-mini",
    "messages": [
      {
        "role": "user",
        "content": "Explain what a vector database is in two sentences."
      }
    ],
    "max_tokens": 1024
  }'
Définissez votre clé comme RAILWAIL_API_KEYCréer une clé API
05

Spécifications

ID du modèle
gpt-5-4-mini
Développeur
OpenAI
Catégorie
Multimodal
Entrée
Texte, Image
Sortie
Texte
Fenêtre de contexte
400.000 tokens
Sortie max.
128.000 tokens
Facturation
À l'usage (tokens ou temps GPU)
Taille du modèle
Undisclosed (estimated tens of billions of parameters, likely sparse MoE)
Licence
Proprietary commercial license via OpenAI API and Azure OpenAI.
Entrée du catalogue mise à jour
23 septembre 2026

Paramètres d'entrée

Entrées et paramètres du schéma d'entrée du modèle. L'exemple dans la section API montre lesquels l'API accepte.

  • promptObligatoire

    User message

    Type: Texte
    Défaut: –
    Valeurs autorisées: jusqu'à 32.000 caractères
  • top_p
    Type: Nombre
    Défaut: 1
    Valeurs autorisées: 0 à 1
  • stream
    Type: Oui/Non
    Défaut: false
    Valeurs autorisées: –
  • image_url

    Optional image URL to analyze

    Type: Texte
    Défaut: –
    Valeurs autorisées: –
  • max_tokens
    Type: Nombre entier
    Défaut: 4096
    Valeurs autorisées: 1 à 32.000
  • temperature
    Type: Nombre
    Défaut: 1
    Valeurs autorisées: 0 à 2
  • system_prompt

    Optional system instruction

    Type: Texte
    Défaut: –
    Valeurs autorisées: jusqu'à 8.000 caractères

Étiquettes

  • openai
  • balanced
  • cost-efficient
  • vision
  • subagents
  • tools
06

Cas d'usage

À quoi ça sert

  • Subagent workers under an orchestrator model
  • Production coding assistants and IDE plugins
  • Customer-facing chatbots and triage
  • Large-scale data extraction and classification
  • RAG pipelines with image input
  • Cost-sensitive enterprise APIs
07

Questions fréquemment posées

Qu'est-ce que GPT-5.4 Mini ?

GPT-5.4 Mini est un modèle de OpenAI dans la catégorie Multimodal. Sur Railwail, vous pouvez l'appeler avec une clé API via l'API Railwail.

Combien coûte GPT-5.4 Mini sur Railwail ?

Sur Railwail, GPT-5.4 Mini coûte 0,90 $US par 1M tokens d'entrée et 5,40 $US par 1M tokens de sortie. Vous êtes facturé pour ce que chaque requête utilise réellement. L'utilisation est payée à partir de crédits prépayés ; 1 crédit équivaut à 0,01 $US.

Quelle est la fenêtre de contexte de GPT-5.4 Mini ?

La fenêtre de contexte de GPT-5.4 Mini contient 400.000 tokens. Une réponse peut faire jusqu'à 128.000 tokens.

Quelle est la vitesse de GPT-5.4 Mini ?

Il n'y a pas encore assez d'exécutions mesurées de GPT-5.4 Mini sur Railwail pour indiquer un temps d'exécution. Cela dépend de l'entrée, des paramètres et de la charge chez le fournisseur.

GPT-5.4 Mini est-il meilleur que BLIP ?

Cela dépend de la tâche. GPT-5.4 Mini (OpenAI) et BLIP (Salesforce) sont tous deux des modèles de la catégorie Multimodal. La page de comparaison affiche leurs prix et spécifications côte à côte.

Comparer GPT-5.4 Mini et BLIP

GPT-5.4 Mini peut-il traiter des images ?

Oui. GPT-5.4 Mini accepte les images en entrée en plus du texte.

Comment utiliser GPT-5.4 Mini via l'API ?

Créez une clé API Railwail et envoyez votre requête avec l'ID de modèle gpt-5-4-mini. Des exemples de code pour curl, Python et JavaScript se trouvent dans la section API de cette page.

08

Modèles comparables

Tous dans cette catégorie

Utiliser GPT-5.4 Mini via l'API

Une clé API pour tous les modèles sur Railwail. L'utilisation est facturée à partir de crédits prépayés, 1 crédit = 0,01 $US.