Vibecoding.cz Patrick Zandl o AI vývoji
Reklama
V nabídce OpenRouteru · OpenAI

GPT-5.4

openai/gpt-5.4

Porovnat model ↗

GPT-5.4 od OpenAI nabízí kontext 1 050 000 tokenů. Popis v katalogu jej zaměřuje na programování. OpenRouter u něj uvádí AA Coding Index 71.1; jde o převzatý index s neuvedenou konfigurací, nikoli vlastní test.

Obrazový vstupNástroje
Vstup / 1M tokenů$2,5
Výstup / 1M tokenů$15
Kontext1,05 M

* Základní sazba. U delších vstupů platí cenová pásma uvedená níže.

Čeština

Zatím bez vlastního měření. Obecný jazykový benchmark nepovažujeme za test češtiny.

Čtěte také: Kimi K2.6: model otevřených vah, který mění otázku, jak vybírat mezi AI modely →
Popis z OpenRouteru v původním znění

GPT-5.4 is OpenAI’s latest frontier model, unifying the Codex and GPT lines into a single system. It features a 1M+ token context window (922K input, 128K output) with support for...

OpenRouter ↗

Co ukazují výsledky

Publikovaný index23. z 126 modelů

Publikovaný AA Coding Index

Patří do nejlepších 25 % zveřejněných hodnot AA Coding Indexu v celém načteném katalogu OpenRouteru. Hodnota modelu: 71,1.

GPT-5.4
Nejvyšší indexyVyšší indexyStředNižší indexy

Pořadí publikovaných indexů, nikoli závěr vlastního testu. API neuvádí verzi indexu ani effort; první místo neznamená nejlepší model pro každou programovací úlohu.

Publikované výsledky, nikoli vlastní měření. Každý záznam zachovává svou konfiguraci. Neúplně popsané běhy nezakládají pořadí kvality.

Všechny dostupné výsledky; pořadí je pouze ze zdrojového snapshotu, pokud je uvedeno.
BenchmarkVýsledekPořadíNápověda
AA Coding Indexopenai/gpt-5.471,1—
ⓘ

OpenRouter publikuje tuto hodnotu indexu. Použitou revizi metodiky a konfiguraci zde neuvádí. Popis dostupnosti indexu není výkladem neznámé revize jeho metodiky.

DeepSWEgpt-5-451,77 %—
ⓘ

Výsledek řešení softwarových úloh v jednotném agentním prostředí. Neprokazuje stejný výkon v jiném agentu ani kvalitu češtiny.

MirrorCodegpt-5.4-2026-03-05_high15,56 %6/7
ⓘ

Model znovu implementuje program bez přístupu k jeho původnímu zdrojovému kódu. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.

SWE-bench Verifiedgpt-5.4-2026-03-05_high76,86 %2/7
ⓘ

Řešení reálných softwarových problémů změnou kódu repozitáře. Výsledek závisí na agentu, sadě úloh a konfiguraci.

SciCodegpt-5.4-2026-03-05_xhigh56,6 %3/14
ⓘ

Tvorba kódu pro vědecké výzkumné problémy. Úzká oblast; konkrétní měření AA a obecná definice datasetu mají oddělený původ.

Terminal-Benchgpt-5.4-2026-03-05_unknown81,8 %1/2
ⓘ

Benchmark agentní práce; konkrétní úlohy a verze se musí ověřit u daného běhu. Současná homepage popisuje jinou revizi; nepřiřazuje verzi historickým řádkům.

GPQA Diamondgpt-5.4-2026-03-05_high89,9 %9/26
ⓘ

Výsledky znalostního benchmarku GPQA; nejde o programovací úlohy. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.

GPQA Diamondgpt-5.4-2026-03-05_low84,85 %9/22
ⓘ

Výsledky znalostního benchmarku GPQA; nejde o programovací úlohy. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.

GPQA Diamondgpt-5.4-2026-03-05_medium88,89 %1/12
ⓘ

Výsledky znalostního benchmarku GPQA; nejde o programovací úlohy. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.

GPQA Diamondgpt-5.4-2026-03-05_none74,75 %13/24
ⓘ

Výsledky znalostního benchmarku GPQA; nejde o programovací úlohy. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.

GPQA Diamondgpt-5.4-2026-03-05_xhigh93,3 %4/12
ⓘ

Výsledky znalostního benchmarku GPQA; nejde o programovací úlohy. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.

Humanity’s Last Examgpt-5.4-2026-03-05_xhigh36,24 %2/2
ⓘ

Znalostní test; revize a změny otázek je potřeba vztáhnout ke konkrétnímu měření. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.

ProofBenchgpt-5.4-2026-03-05_xhigh56 %2/5
ⓘ

Význam benchmarku není v registru popsán. Podmínky zdroje je třeba ověřit u konkrétního běhu.

APEX Agentsgpt-5.4-2026-03-05_unknown52,4 %12/22
ⓘ

Význam benchmarku není v registru popsán. Podmínky zdroje je třeba ověřit u konkrétního běhu.

GSOgpt-5.4-2026-03-05_high25,49 %4/9
ⓘ

Význam benchmarku není v registru popsán. Podmínky zdroje je třeba ověřit u konkrétního běhu.

GSOgpt-5.4-2026-03-05_xhigh31,37 %2/2
ⓘ

Význam benchmarku není v registru popsán. Podmínky zdroje je třeba ověřit u konkrétního běhu.

Design Arena · 3dopenai/gpt-5.41 125 Elo—
ⓘ

Hodnocení designu vytvořeného AI komunitou; oddělujeme jednotlivé kategorie. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.

Design Arena · asciiartopenai/gpt-5.41 210 Elo—
ⓘ

Hodnocení designu vytvořeného AI komunitou; oddělujeme jednotlivé kategorie. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.

Design Arena · codecategoriesopenai/gpt-5.41 221 Elo—
ⓘ

Hodnocení designu vytvořeného AI komunitou; oddělujeme jednotlivé kategorie. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.

Design Arena · datavizopenai/gpt-5.41 245 Elo—
ⓘ

Hodnocení designu vytvořeného AI komunitou; oddělujeme jednotlivé kategorie. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.

Design Arena · gamedevopenai/gpt-5.41 256 Elo—
ⓘ

Hodnocení designu vytvořeného AI komunitou; oddělujeme jednotlivé kategorie. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.

Design Arena · svgopenai/gpt-5.41 208 Elo—
ⓘ

Hodnocení designu vytvořeného AI komunitou; oddělujeme jednotlivé kategorie. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.

Design Arena · uicomponentopenai/gpt-5.41 248 Elo—
ⓘ

Hodnocení designu vytvořeného AI komunitou; oddělujeme jednotlivé kategorie. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.

Design Arena · websiteopenai/gpt-5.41 228 Elo—
ⓘ

Hodnocení designu vytvořeného AI komunitou; oddělujeme jednotlivé kategorie. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.

Design Arena · androidnativeopenai/gpt-5.41 046 Elo—
ⓘ

Hodnocení designu vytvořeného AI komunitou; oddělujeme jednotlivé kategorie. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.

Design Arena · fullstackopenai/gpt-5.41 016 Elo—
ⓘ

Hodnocení designu vytvořeného AI komunitou; oddělujeme jednotlivé kategorie. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.

Design Arena · godotgamedevopenai/gpt-5.41 135 Elo—
ⓘ

Hodnocení designu vytvořeného AI komunitou; oddělujeme jednotlivé kategorie. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.

Design Arena · mobileappsopenai/gpt-5.41 115 Elo—
ⓘ

Hodnocení designu vytvořeného AI komunitou; oddělujeme jednotlivé kategorie. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.

Design Arena · webappsopenai/gpt-5.41 063 Elo—
ⓘ

Hodnocení designu vytvořeného AI komunitou; oddělujeme jednotlivé kategorie. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.

Artificial Analysis přes OpenRouter

AA Coding Index

Měřeno: datum neuvedeno

71,1
Vysoký výkon23. z 126 modelůPořadí publikovaných hodnot. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Převzato z OpenRouteru; verze indexu, effort a datum měření nejsou v API uvedeny.

Model ve zdroji
openai/gpt-5.4
Záznam
openrouter.json
Původní hodnota
71.1
Původní zdroj ↗ · Zdroj převzetí ↗
Epoch · vlastní běh

DeepSWE

Agent: mini-swe-agent · Effort: xhigh · Verze: 1.1 · Měřeno: datum neuvedeno

51,77 %

Pořadí ve zdroji není uvedeno.

Podmínky a zdroj výsledku

Datum jednotlivého běhu a číslo verze balíčku agenta zdroj neuvádí. Pořadí závisí na konfiguraci; stejný effort různých dodavatelů není stejný rozpočet.

Model ve zdroji
gpt-5-4
Záznam
deepswe.json
Původní hodnota
0.5176991150442478 · převod × 100
Původní zdroj ↗ · Zdroj převzetí ↗
Epoch · vlastní běh

MirrorCode

Effort: high · Měřeno: 2026-08-10

15,56 %
Malý vzorek — bez výkonové třídy6. z 7 modelůPořadí všech dostupných řádků ve zdrojovém snapshotu. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Verze testu není v exportu jednoznačná Úplná konfigurace běhu není ověřena

Model ve zdroji
gpt-5.4-2026-03-05_high
Záznam
mirrorcode.csv: řádek 7
Původní hodnota
0.15555555555555556 · převod × 100
Původní zdroj ↗ · Zdroj převzetí ↗
Epoch · vlastní běh

SWE-bench Verified

Effort: high · Měřeno: 2026-03-06

76,86 %
Malý vzorek — bez výkonové třídy2. z 7 modelůPořadí všech dostupných řádků ve zdrojovém snapshotu. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Verze testu není v exportu jednoznačná Úplná konfigurace běhu není ověřena

Model ve zdroji
gpt-5.4-2026-03-05_high
Záznam
swe_bench_verified.csv: řádek 12
Původní hodnota
0.768595041322314 · převod × 100
Původní zdroj ↗ · Zdroj převzetí ↗
Epoch · převzatý běh

SciCode

Effort: xhigh · Měřeno: datum neuvedeno

56,6 %
Pořadí ve zdrojovém snapshotu3. z 14 modelůPořadí všech dostupných řádků ve zdrojovém snapshotu. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Datum měření není uvedeno Verze testu není v exportu jednoznačná Úplná konfigurace běhu není ověřena

GPT-5.4 (xhigh)

Model ve zdroji
gpt-5.4-2026-03-05_xhigh
Záznam
scicode_external.csv: řádek 4
Původní hodnota
0.565972222222222 · převod × 100
Původní zdroj ↗ · Zdroj převzetí ↗
Epoch · převzatý běh

Terminal-Bench

Agent: ForgeCode · Verze: 2.0 · Měřeno: 2026-03-12

81,8 %
Malý vzorek — bez výkonové třídy1. z 2 modelůPořadí všech dostupných řádků ve zdrojovém snapshotu. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Effort není doložen Úplná konfigurace běhu není ověřena

GPT-5.4

Model ve zdroji
gpt-5.4-2026-03-05_unknown
Záznam
terminalbench_external.csv: řádek 6
Původní hodnota
0.818 · převod × 100
Původní zdroj ↗ · Zdroj převzetí ↗
Dalších 23 výsledků a konfigurací
Epoch · vlastní běh

GPQA Diamond

Effort: high · Měřeno: 2026-07-15

89,9 %
Pořadí ve zdrojovém snapshotu9. z 26 modelůPořadí všech dostupných řádků ve zdrojovém snapshotu. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Verze testu není v exportu jednoznačná Úplná konfigurace běhu není ověřena

Model ve zdroji
gpt-5.4-2026-03-05_high
Záznam
gpqa_diamond.csv: řádek 136
Původní hodnota
0.898989898989899 · převod × 100
Původní zdroj ↗ · Zdroj převzetí ↗
Epoch · vlastní běh

GPQA Diamond

Effort: low · Měřeno: 2026-07-15

84,85 %
Pořadí ve zdrojovém snapshotu9. z 22 modelůPořadí všech dostupných řádků ve zdrojovém snapshotu. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Verze testu není v exportu jednoznačná Úplná konfigurace běhu není ověřena

Model ve zdroji
gpt-5.4-2026-03-05_low
Záznam
gpqa_diamond.csv: řádek 137
Původní hodnota
0.8484848484848485 · převod × 100
Původní zdroj ↗ · Zdroj převzetí ↗
Epoch · vlastní běh

GPQA Diamond

Effort: medium · Měřeno: 2026-07-15

88,89 %
Nejvyšší publikovaný výsledek1. z 12 modelůPořadí všech dostupných řádků ve zdrojovém snapshotu. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Verze testu není v exportu jednoznačná Úplná konfigurace běhu není ověřena

Model ve zdroji
gpt-5.4-2026-03-05_medium
Záznam
gpqa_diamond.csv: řádek 134
Původní hodnota
0.8888888888888888 · převod × 100
Původní zdroj ↗ · Zdroj převzetí ↗
Epoch · vlastní běh

GPQA Diamond

Effort: none · Měřeno: 2026-07-15

74,75 %
Pořadí ve zdrojovém snapshotu13. z 24 modelůPořadí všech dostupných řádků ve zdrojovém snapshotu. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Verze testu není v exportu jednoznačná Úplná konfigurace běhu není ověřena

Model ve zdroji
gpt-5.4-2026-03-05_none
Záznam
gpqa_diamond.csv: řádek 135
Původní hodnota
0.7474747474747475 · převod × 100
Původní zdroj ↗ · Zdroj převzetí ↗
Epoch · vlastní běh

GPQA Diamond

Effort: xhigh · Měřeno: 2026-03-06

93,3 %
Pořadí ve zdrojovém snapshotu4. z 12 modelůPořadí všech dostupných řádků ve zdrojovém snapshotu. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Verze testu není v exportu jednoznačná Úplná konfigurace běhu není ověřena

Model ve zdroji
gpt-5.4-2026-03-05_xhigh
Záznam
gpqa_diamond.csv: řádek 165
Původní hodnota
0.933 · převod × 100
Původní zdroj ↗ · Zdroj převzetí ↗
Epoch · převzatý běh

Humanity’s Last Exam

Effort: xhigh · Měřeno: datum neuvedeno

36,24 %
Malý vzorek — bez výkonové třídy2. z 2 modelůPořadí všech dostupných řádků ve zdrojovém snapshotu. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Datum měření není uvedeno Verze testu není v exportu jednoznačná Úplná konfigurace běhu není ověřena

gpt-5.4-2026-03-05 (xhigh thinking)

Model ve zdroji
gpt-5.4-2026-03-05_xhigh
Záznam
hle_external.csv: řádek 9
Původní hodnota
0.3624 · převod × 100
Původní zdroj ↗ · Zdroj převzetí ↗
Epoch · převzatý běh

ProofBench

Effort: xhigh · Měřeno: datum neuvedeno

56 %
Malý vzorek — bez výkonové třídy2. z 5 modelůPořadí všech dostupných řádků ve zdrojovém snapshotu. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Datum měření není uvedeno Verze testu není v exportu jednoznačná Úplná konfigurace běhu není ověřena

ProofBench v1.0-era value; model absent from the v1.1 board (vals.ai re-grade 2026-08-14, methodology changed) and not re-run. Not comparable to v1.1 rows. Annotated 2026-08-18.

Model ve zdroji
gpt-5.4-2026-03-05_xhigh
Záznam
proofbench_external.csv: řádek 15
Původní hodnota
0.56 · převod × 100
Původní zdroj ↗ · Zdroj převzetí ↗
Epoch · převzatý běh

APEX Agents

Měřeno: datum neuvedeno

52,4 %
Pořadí ve zdrojovém snapshotu12. z 22 modelůPořadí všech dostupných řádků ve zdrojovém snapshotu. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Datum měření není uvedeno Verze testu není v exportu jednoznačná Effort není doložen Úplná konfigurace běhu není ověřena

GPT-5.4

Model ve zdroji
gpt-5.4-2026-03-05_unknown
Záznam
apex_agents_external.csv: řádek 17
Původní hodnota
0.524 · převod × 100
Původní zdroj ↗ · Zdroj převzetí ↗
Epoch · převzatý běh

GSO

Effort: high · Měřeno: datum neuvedeno

25,49 %
Malý vzorek — bez výkonové třídy4. z 9 modelůPořadí všech dostupných řádků ve zdrojovém snapshotu. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Datum měření není uvedeno Verze testu není v exportu jednoznačná Úplná konfigurace běhu není ověřena

Model ve zdroji
gpt-5.4-2026-03-05_high
Záznam
gso_external.csv: řádek 14
Původní hodnota
0.2549 · převod × 100
Původní zdroj ↗ · Zdroj převzetí ↗
Epoch · převzatý běh

GSO

Effort: xhigh · Měřeno: datum neuvedeno

31,37 %
Malý vzorek — bez výkonové třídy2. z 2 modelůPořadí všech dostupných řádků ve zdrojovém snapshotu. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Datum měření není uvedeno Verze testu není v exportu jednoznačná Úplná konfigurace běhu není ověřena

Model ve zdroji
gpt-5.4-2026-03-05_xhigh
Záznam
gso_external.csv: řádek 10
Původní hodnota
0.31370000000000003 · převod × 100
Původní zdroj ↗ · Zdroj převzetí ↗
Design Arena přes OpenRouter

Design Arena · 3d

Měřeno: datum neuvedeno

1 125 Elo
Střední pásmo66. z 100 modelůPořadí publikovaných hodnot. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Elo preferencí designu; není obecným skóre programování. Datum měření a velikost vzorku API neuvádí.

Model ve zdroji
openai/gpt-5.4
Záznam
openrouter.json
Původní hodnota
1125.0
Původní zdroj ↗ · Zdroj převzetí ↗
Design Arena přes OpenRouter

Design Arena · asciiart

Měřeno: datum neuvedeno

1 210 Elo
Střední pásmo22. z 61 modelůPořadí publikovaných hodnot. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Elo preferencí designu; není obecným skóre programování. Datum měření a velikost vzorku API neuvádí.

Model ve zdroji
openai/gpt-5.4
Záznam
openrouter.json
Původní hodnota
1210.0
Původní zdroj ↗ · Zdroj převzetí ↗
Design Arena přes OpenRouter

Design Arena · codecategories

Měřeno: datum neuvedeno

1 221 Elo
Střední pásmo43. z 108 modelůPořadí publikovaných hodnot. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Elo preferencí designu; není obecným skóre programování. Datum měření a velikost vzorku API neuvádí.

Model ve zdroji
openai/gpt-5.4
Záznam
openrouter.json
Původní hodnota
1221.0
Původní zdroj ↗ · Zdroj převzetí ↗
Design Arena přes OpenRouter

Design Arena · dataviz

Měřeno: datum neuvedeno

1 245 Elo
Střední pásmo31. z 106 modelů · sdílené pořadíPořadí publikovaných hodnot. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Elo preferencí designu; není obecným skóre programování. Datum měření a velikost vzorku API neuvádí.

Model ve zdroji
openai/gpt-5.4
Záznam
openrouter.json
Původní hodnota
1245.0
Původní zdroj ↗ · Zdroj převzetí ↗
Design Arena přes OpenRouter

Design Arena · gamedev

Měřeno: datum neuvedeno

1 256 Elo
Střední pásmo31. z 108 modelůPořadí publikovaných hodnot. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Elo preferencí designu; není obecným skóre programování. Datum měření a velikost vzorku API neuvádí.

Model ve zdroji
openai/gpt-5.4
Záznam
openrouter.json
Původní hodnota
1256.0
Původní zdroj ↗ · Zdroj převzetí ↗
Design Arena přes OpenRouter

Design Arena · svg

Měřeno: datum neuvedeno

1 208 Elo
Střední pásmo22. z 76 modelůPořadí publikovaných hodnot. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Elo preferencí designu; není obecným skóre programování. Datum měření a velikost vzorku API neuvádí.

Model ve zdroji
openai/gpt-5.4
Záznam
openrouter.json
Původní hodnota
1208.0
Původní zdroj ↗ · Zdroj převzetí ↗
Design Arena přes OpenRouter

Design Arena · uicomponent

Měřeno: datum neuvedeno

1 248 Elo
Střední pásmo33. z 104 modelůPořadí publikovaných hodnot. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Elo preferencí designu; není obecným skóre programování. Datum měření a velikost vzorku API neuvádí.

Model ve zdroji
openai/gpt-5.4
Záznam
openrouter.json
Původní hodnota
1248.0
Původní zdroj ↗ · Zdroj převzetí ↗
Design Arena přes OpenRouter

Design Arena · website

Měřeno: datum neuvedeno

1 228 Elo
Střední pásmo45. z 115 modelů · sdílené pořadíPořadí publikovaných hodnot. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Elo preferencí designu; není obecným skóre programování. Datum měření a velikost vzorku API neuvádí.

Model ve zdroji
openai/gpt-5.4
Záznam
openrouter.json
Původní hodnota
1228.0
Původní zdroj ↗ · Zdroj převzetí ↗
Design Arena přes OpenRouter

Design Arena · androidnative

Měřeno: datum neuvedeno

1 046 Elo
Nižší výsledek34. z 35 modelůPořadí publikovaných hodnot. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Elo preferencí designu; není obecným skóre programování. Datum měření a velikost vzorku API neuvádí.

Model ve zdroji
openai/gpt-5.4
Záznam
openrouter.json
Původní hodnota
1046.0
Původní zdroj ↗ · Zdroj převzetí ↗
Design Arena přes OpenRouter

Design Arena · fullstack

Měřeno: datum neuvedeno

1 016 Elo
Nižší výsledek37. z 41 modelůPořadí publikovaných hodnot. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Elo preferencí designu; není obecným skóre programování. Datum měření a velikost vzorku API neuvádí.

Model ve zdroji
openai/gpt-5.4
Záznam
openrouter.json
Původní hodnota
1016.0
Původní zdroj ↗ · Zdroj převzetí ↗
Design Arena přes OpenRouter

Design Arena · godotgamedev

Měřeno: datum neuvedeno

1 135 Elo
Střední pásmo24. z 34 modelůPořadí publikovaných hodnot. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Elo preferencí designu; není obecným skóre programování. Datum měření a velikost vzorku API neuvádí.

Model ve zdroji
openai/gpt-5.4
Záznam
openrouter.json
Původní hodnota
1135.0
Původní zdroj ↗ · Zdroj převzetí ↗
Design Arena přes OpenRouter

Design Arena · mobileapps

Měřeno: datum neuvedeno

1 115 Elo
Nižší výsledek38. z 40 modelůPořadí publikovaných hodnot. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Elo preferencí designu; není obecným skóre programování. Datum měření a velikost vzorku API neuvádí.

Model ve zdroji
openai/gpt-5.4
Záznam
openrouter.json
Původní hodnota
1115.0
Původní zdroj ↗ · Zdroj převzetí ↗
Design Arena přes OpenRouter

Design Arena · webapps

Měřeno: datum neuvedeno

1 063 Elo
Nižší výsledek36. z 40 modelůPořadí publikovaných hodnot. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Elo preferencí designu; není obecným skóre programování. Datum měření a velikost vzorku API neuvádí.

Model ve zdroji
openai/gpt-5.4
Záznam
openrouter.json
Původní hodnota
1063.0
Původní zdroj ↗ · Zdroj převzetí ↗

Kolik stojí používání

Vyšší cena35. z 331 modelů od nejdražšího

5,5 USD za srovnávací koš

6,88× medián · medián 0,8 USD. Srovnání 331 modelů celého katalogu s použitelnou standardní API sazbou a dostatečným kontextem.

GPT-5.4
NejdražšíVyšší cenaStředNízká cena

Nejbližší konkurenti podle ceny koše

100 požadavků, každý s 10 000 vstupními tokeny. Výstup podle zvoleného poměru. Základní textové API včetně případného poplatku za požadavek; nejde o cenu úspěšně vyřešené úlohy.

Co za své peníze získáte jinde

Blízký index = rozdíl nejvýše 3 body. Podobná cena = ±20 % koše. Pokud blízký index levněji chybí, ukazujeme nejbližší nižší index s úsporou. Výběr z celého katalogu; jde o publikovaný AA index s neúplnou metodikou.

USD za milion tokenů. Nabídky a pásma z OpenRouteru; ceny předplatného aplikací zde nejsou.

NabídkaTokenové sazbyČtení cache
Standardní APIopenai/gpt-5.4$2,5$15$0,25
↳ od 272 000 vstupních tokenů$5$22,5$0,5
Batchopenai/gpt-5.4:batch$1,25$7,5$0,125
↳ od 272 000 vstupních tokenů$2,5$11,25$0,25
Vstupní modality
text, image, file
Volání nástrojů
Ano
Do katalogu přidán
2026-03-05
Znalostní cutoff
Neuvedeno
Kanonická verze
openai/gpt-5.4-20260305
Otevřít nabídku na OpenRouteru ↗

Co zvážit vedle tohoto modelu

Blízkost výstupní ceny, publikovaného AA Coding Indexu (kde je) a zaměření v popisu. Kandidáti z aktuálního katalogu se stejnými výstupními modalitami; nejde o pořadí kvality. Cenové rozdíly níže platí pro základní standardní API sazbu.

Další modely od OpenAI

Co jsme o modelu napsali

Hypata · 2026-04-09

Muse Spark: Meta se vrací do hry – ale do jaké? ↗

„Na Terminal-Bench 2.0 (agentní kódování v terminálu) dosahuje 59,0 – GPT-5.4 má 75,1, Gemini 68,5. Na GDPval-AA Elo (kancelářské úlohy v reálném prostředí) má 1 444 – Opus 4.6 dosahuje 1 606, GPT-5.4 má 1 672. Na SWE-Bench Pro (agentní kódování) 52,4 versus 57,7 u GPT-5.4. Na LiveCodeBench Pro (kompetitivní kódování) 80,0 versus 87,5 u GPT-5.4. Na GPQA Diamond (PhD-level reasoning) 89,5 versus 94,3 u Gemini.“
Patrick Zandl · 2026-04-07

GLM-5.1: open-source alternativa k Opusu ↗

„Terminal-Bench 2.0 je měřen dvěma různými harnesu: Z.ai reportuje GLM-5.1 na Claude Code harnesu (66,5 %), GPT-5.4 reportuje svůj výsledek na Codex harnesu (75,1 %). Přímé srovnání těchto čísel je pochybné.“

Charakteristika vznikla automaticky z parametrů a popisu OpenRouteru. Benchmarky jsou převzaté výsledky s uvedenými zdroji; redakční zkušenosti jsou oddělené v analýzách.