GPT-5.4 Mini

MultimodalneNoweDostępne
od OpenAIID modelu: gpt-5-4-mini

OpenAI's efficient mid-tier model. 2x faster than its predecessor, 400k context, approaches GPT-5.4 quality on SWE-Bench Pro at a fraction of the cost.

Cena · 1M wejścia/wyjścia
0,90 USD / 5,40 USD
Kontekst
400 000 tokenów
Maks. wyjście
128 000 tokenów
Wejście → Wyjście
Tekst + Obraz → Tekst
Deweloper
OpenAI
Zaktualizowano
23 września 2026
01

Playground

Spróbuj GPT-5.4 Mini

Chat

0,90 USD/1M wej.
Spróbuj GPT-5.4 Mini

Wyślij wiadomość. Odpowiedź pojawi się w całości, gdy model będzie gotowy (bez streamingu).

Prompt systemowy
Maks. długość odpowiedzi (tokeny)

To uruchomienie

maksymalnie 0,0056 USD · 0,56 kredytów zarezerwowanych

Rozliczane są rzeczywiście użyte tokeny; niewykorzystana część rezerwacji jest zwracana.

Nowy tutaj?

10 darmowych kredytów (0,10 USD) po zarejestrowaniu się przez Google

Dostępne 24 godzin po rejestracji, do 5 uruchomień dziennie i maksymalnie 2 kredytów na uruchomienie. Inne metody logowania uruchamiają się bez kredytów. Wystarczy na 17 uruchomień tego modelu.

02

O GPT-5.4 Mini

Krótko mówiącStan na 23 września 2026

GPT-5.4 Mini to model opracowany przez OpenAI w kategorii Multimodalne. W serwisie Railwail GPT-5.4 Mini kosztuje 0,90 USD za 1M tokenów wejściowych i 5,40 USD za 1M tokenów wyjściowych. Okno kontekstu zawiera 400 000 tokenów, a jedna odpowiedź może mieć do 128 000 tokenów.

Released March 17, 2026, GPT-5.4 mini brings the strengths of GPT-5.4 to a smaller, faster model designed for the subagent era. 400K context, vision input, integrated tool use, and 2x faster latency than GPT-5 mini. Significant gains on coding, reasoning, multimodal understanding and tool use; approaches the full GPT-5.4 on SWE-Bench Pro and OSWorld-Verified. Recommended for subagent workflows, customer-facing chat, coding assistants and high-volume API workloads.

Tło

O OpenAI

Założona 2015 · San Francisco, USA

OpenAI was founded in December 2015 as a non-profit AI research organisation and transitioned to a capped-profit structure in 2019. The GPT lineage spans GPT-1 (2018) through GPT-5 (mid-2025) and the GPT-5.x family (2025-2026) which unified the o-series reasoning models with the general-purpose GPT line. GPT-5.4 mini and nano were announced on March 17, 2026 as the small-model tier of the GPT-5.4 generation. OpenAI is backed by Microsoft, Khosla, Andreessen Horowitz, Thrive Capital and Sequoia, with total funding above $60 billion and a 2026 valuation above $300 billion.

Odwiedź OpenAI

Architektura

Unified Transformer (mid-tier, with integrated 'Thinking' tier)

GPT-5.4 mini was announced March 17, 2026 alongside GPT-5.4 nano as the small-model tier of the GPT-5.4 generation. It is a smaller variant of the unified GPT-5.4 architecture, retaining native text + image input, an integrated 'Thinking' tier for reasoning on demand, and the full tool-use API, while running more than 2x faster than GPT-5 mini at significantly lower cost. Pretraining used a similar multi-trillion-token mixture as GPT-5.4 with heavier distillation pressure from larger teacher models. Post-training included supervised fine-tuning, RLHF and reinforcement learning against verifiable rewards on coding, reasoning and tool-use trajectories. On evaluations such as SWE-Bench Pro and OSWorld-Verified, GPT-5.4 mini approaches the performance of full GPT-5.4 while costing roughly one-third as much.

Parametry
Undisclosed (estimated tens of billions of parameters, likely sparse MoE)
Kontekst
400 000 tokenów

Możliwości

  • 2x faster than GPT-5 mini at lower cost
  • Approaches full GPT-5.4 on SWE-Bench Pro and OSWorld-Verified
  • 400K token context window
  • Native multimodal input: text and images
  • Integrated 'Thinking' tier activates for harder reasoning
  • Native tool use, function calling and parallel tool calls
  • Designed for the subagent era: works well under an orchestrator
  • Strong coding, classification and extraction performance
  • Available in ChatGPT, Codex CLI and the OpenAI API
  • Regional processing endpoints available with 10% uplift
  • Best for: subagent workflows, customer-facing chat, coding assistants, high-volume API workloads.

Trening i licencja

Pretrained on a multi-trillion-token mixture of web text, code, scientific papers and licensed data; heavy distillation from larger GPT-5.4 teacher models. Post-training uses supervised fine-tuning, RLHF and RL against verifiable rewards. Knowledge cutoff approximately late 2025.

Licencja: Proprietary commercial license via OpenAI API and Azure OpenAI.

Testy bezpieczeństwa: Evaluated under OpenAI's Preparedness Framework with internal and external red-teaming and capability evaluations.

Znane ograniczenia

  • Below full GPT-5.4 on the hardest agentic and reasoning benchmarks
  • Smaller context window than GPT-5.4 (400K vs 1.05M)
  • No native audio or video input
  • Knowledge cutoff in late 2025
  • Thinking mode adds latency and token cost when enabled
03

Ceny

Ceny w dolarach amerykańskich. Użycie jest rozliczane z prepłaconych kredytów.
Wejście0,90 USD / 1M tokenów
Wyjście5,40 USD / 1M tokenów
  • Rozliczane są tokeny, które faktycznie zużywa każde żądanie.
  • 1 kredyt = 0,01 USD

Kalkulator kosztów

Kalkulator cen

/ żądanie
/ żądanie

Razem

0,36 USD

36 kredytów

Za żądanie

0,0036 USD · 0,36 kredytów

Każde żądanie jest zaokrąglane w górę do 0,01 kredytu.

04

API

Wywołaj GPT-5.4 Mini za pomocą klucza API Railwail. Użyj tego ID modelu w żądaniu:
curl https://railwail.com/api/v1/chat/completions \
  -H "Authorization: Bearer $RAILWAIL_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "gpt-5-4-mini",
    "messages": [
      {
        "role": "user",
        "content": "Explain what a vector database is in two sentences."
      }
    ],
    "max_tokens": 1024
  }'
Ustaw klucz jako RAILWAIL_API_KEYUtwórz klucz API
05

Specyfikacje

ID modelu
gpt-5-4-mini
Deweloper
OpenAI
Kategoria
Multimodalne
Wejście
Tekst, Obraz
Wyjście
Tekst
Okno kontekstu
400 000 tokenów
Maks. wyjście
128 000 tokenów
Rozliczenie
Według użycia (tokeny lub czas GPU)
Rozmiar modelu
Undisclosed (estimated tens of billions of parameters, likely sparse MoE)
Licencja
Proprietary commercial license via OpenAI API and Azure OpenAI.
Wpis w katalogu zaktualizowany
23 września 2026

Parametry wejściowe

Dane wejściowe i ustawienia ze schematu wejściowego modelu. Przykład w sekcji API pokazuje, które z nich API akceptuje.

  • promptwymagane

    User message

    Typ: Tekst
    Domyślnie: –
    Dozwolone wartości: do 32 000 znaków
  • top_p
    Typ: Liczba
    Domyślnie: 1
    Dozwolone wartości: 0 do 1
  • stream
    Typ: Tak/Nie
    Domyślnie: false
    Dozwolone wartości: –
  • image_url

    Optional image URL to analyze

    Typ: Tekst
    Domyślnie: –
    Dozwolone wartości: –
  • max_tokens
    Typ: Liczba całkowita
    Domyślnie: 4096
    Dozwolone wartości: 1 do 32 000
  • temperature
    Typ: Liczba
    Domyślnie: 1
    Dozwolone wartości: 0 do 2
  • system_prompt

    Optional system instruction

    Typ: Tekst
    Domyślnie: –
    Dozwolone wartości: do 8000 znaków

Tagi

  • openai
  • balanced
  • cost-efficient
  • vision
  • subagents
  • tools
06

Przypadki użycia

Do czego się go używa

  • Subagent workers under an orchestrator model
  • Production coding assistants and IDE plugins
  • Customer-facing chatbots and triage
  • Large-scale data extraction and classification
  • RAG pipelines with image input
  • Cost-sensitive enterprise APIs
07

Często zadawane pytania

Co to jest GPT-5.4 Mini?

GPT-5.4 Mini to model opracowany przez OpenAI w kategorii Multimodalne. W serwisie Railwail możesz go wywołać za pomocą klucza API poprzez API Railwail.

Ile kosztuje GPT-5.4 Mini w serwisie Railwail?

W serwisie Railwail GPT-5.4 Mini kosztuje 0,90 USD za 1M tokenów wejściowych i 5,40 USD za 1M tokenów wyjściowych. Opłata jest pobierana za to, co faktycznie zużywa każde żądanie. Użycie jest opłacane z przedpłaconych kredytów; 1 kredyt równa się 0,01 USD.

Jakie jest okno kontekstu GPT-5.4 Mini?

Okno kontekstu GPT-5.4 Mini zawiera 400 000 tokenów. Jedna odpowiedź może mieć do 128 000 tokenów.

Jak szybki jest GPT-5.4 Mini?

Dla GPT-5.4 Mini jest jeszcze zbyt mało zmierzonych przebiegów w serwisie Railwail, aby podać czas przebiegu. Zależy to od wejścia, ustawień i obciążenia u dostawcy.

Czy GPT-5.4 Mini jest lepszy niż BLIP?

To zależy od zadania. GPT-5.4 Mini (OpenAI) i BLIP (Salesforce) to oba modele z kategorii Multimodalne. Strona porównania pokazuje ich ceny i specyfikacje obok siebie.

Porównaj GPT-5.4 Mini i BLIP

Czy GPT-5.4 Mini może przetwarzać obrazy?

Tak. GPT-5.4 Mini akceptuje obrazy jako wejście oprócz tekstu.

Jak używać GPT-5.4 Mini przez API?

Utwórz klucz API Railwail i wyślij swoje żądanie z ID modelu gpt-5-4-mini. Przykłady kodu dla curl, Python i JavaScript znajdują się w sekcji API na tej stronie.

08

Porównywalne modele

Wszystkie w tej kategorii

Użyj GPT-5.4 Mini przez API

Jeden klucz API dla każdego modelu na Railwail. Opłaty pobierane są z przedpłaconych kredytów, 1 kredyt = 0,01 USD.