GPT-5.4

MultimodalNouveauDisponible
par OpenAIID du modèle: gpt-5-4

OpenAI's unified flagship combining GPT and o-series reasoning into one model. 1M context, multimodal, top SWE-Bench Pro and OSWorld scores.

Prix · 1M entrée/sortie
3,00 $US / 18,00 $US
Contexte
1 050 000 tokens
Max. sortie
128 000 tokens
Entrée → Sortie
Texte + Image → Texte
Développeur
OpenAI
Mis à jour
23 septembre 2026
01

Playground

Essayer GPT-5.4

Chat

3,00 $US/1M entrée
Essayer GPT-5.4

Envoyez un message. La réponse arrive complète une fois que le modèle a terminé (sans streaming).

Prompt système
Longueur max. de la réponse (tokens)

Cette exécution

au maximum 0,0185 $US · 1,85 crédits réservés

Facturation selon les tokens réellement utilisés ; la partie inutilisée de la réservation est remboursée.

Nouveau par ici ?

10 crédits gratuits (0,10 $US) lors de l'inscription avec Google

Utilisable 24 heures après l'inscription, jusqu'à 5 exécutions par jour et au maximum 2 crédits par exécution. Les autres méthodes de connexion commencent sans crédits. Suffisant pour 5 exécutions de ce modèle.

02

À propos de GPT-5.4

RésuméAu 23 septembre 2026

GPT-5.4 est un modèle de OpenAI dans la catégorie Multimodal. Sur Railwail, GPT-5.4 coûte 3,00 $US par 1M tokens d'entrée et 18,00 $US par 1M tokens de sortie. La fenêtre de contexte contient 1 050 000 tokens, et une réponse peut faire jusqu'à 128 000 tokens.

GPT-5.4 is OpenAI's frontier model as of 2026, merging the previously separate GPT and o-series reasoning lines into a single unified architecture. Native multimodal input (text + images), 1.05M-token experimental context window (272K standard), 128K max output, integrated 'Thinking' tier for reasoning on demand. Best for: high-context coding, agentic engineering, multimodal analysis, complex tool-use workflows. The Codex line has been absorbed into this model.

Arrière-plan

À propos de OpenAI

Fondée 2015 · San Francisco, USA

OpenAI was founded in December 2015 by Sam Altman, Elon Musk, Greg Brockman, Ilya Sutskever, Wojciech Zaremba and John Schulman as a non-profit AI research organisation; it transitioned to a 'capped-profit' structure in 2019. OpenAI authored the GPT lineage starting with GPT-1 (2018), GPT-2 (2019), GPT-3 (2020), the ChatGPT launch with GPT-3.5 (November 2022), GPT-4 (March 2023), GPT-4o (May 2024), the o-series reasoning models o1 (December 2024) and o3 (early 2025), then GPT-5 (mid-2025). The GPT-5.x series unified the reasoning o-series with the general-purpose GPT line: GPT-5.2 shipped December 2025, GPT-5.3-Codex February 2026, GPT-5.4 in March 2026 and the GPT-5.5 family later in 2026. OpenAI's investors include Microsoft (~$13B+), Khosla Ventures, Andreessen Horowitz, Thrive Capital and Sequoia, with total funding exceeding $60 billion and a 2026 valuation above $300 billion.

Visiter OpenAI

Architecture

Unified Transformer with integrated reasoning ('Thinking') tier

GPT-5.4 is OpenAI's frontier model as of March 2026 and marks the full convergence of the previously separate o-series reasoning models and general-purpose GPT line into a single unified architecture. The o1, o3, o3-pro and o4-mini reasoning models were retired from ChatGPT on February 13, 2026; their capabilities are now folded into GPT-5.x as a 'Thinking' tier that activates on demand. GPT-5.4 also absorbs the Codex line for agentic coding. Pretraining used a multi-trillion-token mixture of web text, code repositories, scientific papers, books and licensed datasets on OpenAI's most recent supercomputer cluster. Post-training combined supervised fine-tuning, RLHF and large-scale reinforcement learning against verifiable rewards on coding, math and tool-use trajectories. The model supports native text + image input and a 1.05M-token experimental context window (272K standard), 128K max output, integrated tool-use, function calling, structured outputs, and built-in 'Tool Search' for delegating to subagents. Safety training followed OpenAI's Preparedness Framework with red-teaming, capability evaluations and external assessments.

Paramètres
Undisclosed (estimated multi-hundred billion parameters, likely sparse MoE)
Contexte
1 050 000 tokens

Capacités

  • Unified GPT and o-series: integrated 'Thinking' tier activates on demand
  • 1.05M-token experimental context window (272K standard, 128K max output)
  • Native multimodal input: text and images in a single pass
  • Top scores on SWE-Bench Pro and OSWorld-Verified at launch
  • Native tool use, function calling, parallel tool calls and structured outputs
  • Integrated 'Tool Search' for delegating to subagent models
  • Absorbed Codex agentic coding capabilities
  • Strong multilingual performance and instruction following
  • Available via OpenAI API, Azure OpenAI, ChatGPT and Codex CLI
  • Regional processing (data residency) endpoints available with 10% uplift
  • Best for: high-context coding, agentic engineering, multimodal analysis, complex tool-use workflows.

Entraînement et licence

Pretrained on a multi-trillion-token mixture of web text, code, scientific papers, books and licensed datasets. Post-training combines supervised fine-tuning, RLHF and large-scale reinforcement learning against verifiable rewards on coding, math and tool-use tasks. Knowledge cutoff approximately late 2025.

Licence: Proprietary commercial license via OpenAI API and Azure OpenAI. Commercial use permitted under OpenAI's Usage Policies.

Tests de sécurité: Evaluated under OpenAI's Preparedness Framework with internal and external red-teaming, capability evaluations and a public Bug Bounty programme.

Limitations connues

  • 1M context is experimental and must be enabled explicitly (default is 272K)
  • Prompts above 272K input tokens are billed at 2x input / 1.5x output for the full session
  • No native audio or video input in this variant
  • Higher latency and cost than mini/nano tiers, especially with Thinking enabled
  • Knowledge cutoff in late 2025
03

Tarification

Prix en dollars US. L'utilisation est facturée à partir de crédits prépayés.
Entrée3,00 $US / 1M tokens
Sortie18,00 $US / 1M tokens
Entrée (prompts de plus de 272 000 tokens)6,00 $US / 1M tokens
Sortie (prompts de plus de 272 000 tokens)27,00 $US / 1M tokens
  • Facturé selon les tokens que chaque requête utilise réellement.
  • 1 crédit = 0,01 $US

Calculateur de coûts

Calculateur de prix

/ req.
/ req.

Total

1,20 $US

120 crédits

Par requête

0,012 $US · 1,2 crédits

Chaque requête est arrondie à 0,01 crédit.

04

API

Appelez GPT-5.4 avec votre clé API Railwail. Utilisez cet ID de modèle dans la requête :
curl https://railwail.com/api/v1/chat/completions \
  -H "Authorization: Bearer $RAILWAIL_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "gpt-5-4",
    "messages": [
      {
        "role": "user",
        "content": "Explain what a vector database is in two sentences."
      }
    ],
    "max_tokens": 1024
  }'
Définissez votre clé en tant que RAILWAIL_API_KEYCréer une clé API
05

Spécifications

ID du modèle
gpt-5-4
Développeur
OpenAI
Catégorie
Multimodal
Entrée
Texte, Image
Sortie
Texte
Fenêtre de contexte
1 050 000 tokens
Sortie max.
128 000 tokens
Facturation
À l'usage (tokens ou temps GPU)
Taille du modèle
Undisclosed (estimated multi-hundred billion parameters, likely sparse MoE)
Licence
Proprietary commercial license via OpenAI API and Azure OpenAI. Commercial use permitted under OpenAI's Usage Policies.
Entrée du catalogue mise à jour
23 septembre 2026

Paramètres d'entrée

Entrées et paramètres du schéma d'entrée du modèle. L'exemple dans la section API montre lesquels l'API accepte.

  • promptObligatoire

    User message

    Type: Texte
    Défaut: –
    Valeurs autorisées: Jusqu'à 32 000 caractères
  • top_p
    Type: Nombre
    Défaut: 1
    Valeurs autorisées: 0 à 1
  • stream
    Type: Oui/Non
    Défaut: false
    Valeurs autorisées: –
  • image_url

    Optional image URL to analyze

    Type: Texte
    Défaut: –
    Valeurs autorisées: –
  • max_tokens
    Type: Nombre entier
    Défaut: 4096
    Valeurs autorisées: 1 à 32 000
  • temperature
    Type: Nombre
    Défaut: 1
    Valeurs autorisées: 0 à 2
  • system_prompt

    Optional system instruction

    Type: Texte
    Défaut: –
    Valeurs autorisées: Jusqu'à 8 000 caractères

Étiquettes

  • openai
  • flagship
  • reasoning
  • agentic
  • vision
  • thinking
  • long-context
  • 1m-context
06

Cas d'usage

À quoi ça sert

  • Frontier coding agents and IDE copilots
  • Long-context document and codebase analysis
  • Agentic engineering with Tool Search and subagents
  • Scientific and quantitative reasoning
  • Multimodal analysis of diagrams and screenshots
  • Enterprise copilots and customer-facing assistants
07

Questions fréquemment posées

Qu'est-ce que GPT-5.4 ?

GPT-5.4 est un modèle de OpenAI dans la catégorie Multimodal. Sur Railwail, vous pouvez l'appeler avec une clé API via l'API Railwail.

Combien coûte GPT-5.4 sur Railwail ?

Sur Railwail, GPT-5.4 coûte 3,00 $US par 1M tokens d'entrée et 18,00 $US par 1M tokens de sortie. Vous êtes facturé pour ce que chaque requête utilise réellement. L'utilisation est payée à partir de crédits prépayés ; 1 crédit équivaut à 0,01 $US.

Quelle est la fenêtre de contexte de GPT-5.4 ?

La fenêtre de contexte de GPT-5.4 contient 1 050 000 tokens. Une réponse peut faire jusqu'à 128 000 tokens.

Quelle est la vitesse de GPT-5.4 ?

Il n'y a pas encore assez d'exécutions mesurées de GPT-5.4 sur Railwail pour indiquer un temps d'exécution. Cela dépend de l'entrée, des paramètres et de la charge chez le fournisseur.

GPT-5.4 est-il meilleur que BLIP ?

Cela dépend de la tâche. GPT-5.4 (OpenAI) et BLIP (Salesforce) sont tous deux des modèles de la catégorie Multimodal. La page de comparaison affiche leurs prix et spécifications côte à côte.

Comparer GPT-5.4 et BLIP

GPT-5.4 peut-il traiter des images ?

Oui. GPT-5.4 accepte les images en entrée en plus du texte.

Comment utiliser GPT-5.4 via l'API ?

Créez une clé API Railwail et envoyez votre requête avec l'ID de modèle gpt-5-4. Des exemples de code pour curl, Python et JavaScript se trouvent dans la section API de cette page.

08

Modèles comparables

Tous dans cette catégorie
  • Anthropic's April 2026 flagship. 87.6% on SWE-bench Verified, 3x higher image resolution, output self-verification, vision + reasoning.

    6,00 $US/1M entrée

    100 % plus cher par unité

    Comparer GPT-5.4 et Claude Opus 4.7
  • Anthropic's balanced mid-tier model from February 2026. Best price/performance for production workloads: 5x cheaper than Opus, near-flagship quality.

    3,60 $US/1M entrée

    20 % plus cher par unité

    Comparer GPT-5.4 et Claude Sonnet 4.6
  • Gemini 3 FlashGoogle DeepMind

    Google's April 2026 fast multimodal model. Combines Gemini 3 Pro's reasoning with Flash-tier latency and price. Default model in the Gemini app.

    0,60 $US/1M entrée

    80 % moins cher par unité

    Comparer GPT-5.4 et Gemini 3 Flash

Utiliser GPT-5.4 via l'API

Une clé API pour tous les modèles sur Railwail. L'utilisation est facturée à partir de crédits prépayés, 1 crédit = 0,01 $US.