Vibecoding.cz Patrick Zandl o AI vývoji
V nabídce OpenRouteru · OpenAI

GPT-5.5

openai/gpt-5.5

Porovnat model ↗

GPT-5.5 od OpenAI nabízí kontext 1 050 000 tokenů. Popis v katalogu jej zaměřuje na analytické úlohy. OpenRouter u něj uvádí AA Coding Index 74.9; jde o převzatý index s neuvedenou konfigurací, nikoli vlastní test.

Obrazový vstupNástroje
Vstup / 1M tokenů$5
Výstup / 1M tokenů$30
Kontext1,05 M

* Základní sazba. U delších vstupů platí cenová pásma uvedená níže.

Čeština

Zatím bez vlastního měření. Obecný jazykový benchmark nepovažujeme za test češtiny.

Čtěte také: Kimi K2.7 Code: levná open-weights odpověď na Fable 5, ale s vlastními benchmarky →
Popis z OpenRouteru v původním znění

GPT-5.5 is OpenAI’s frontier model designed for complex professional workloads, building on GPT-5.4 with stronger reasoning, higher reliability, and improved token efficiency on hard tasks. It features a 1M+ token...

OpenRouter ↗

Co ukazují výsledky

Publikovaný index11. z 126 modelů

Publikovaný AA Coding Index

Patří do nejlepších 10 % zveřejněných hodnot AA Coding Indexu v celém načteném katalogu OpenRouteru. Hodnota modelu: 74,9.

GPT-5.5
Nejvyšší indexyVyšší indexyStředNižší indexy

Nejbližší konkurenti podle Coding Indexu

Pořadí publikovaných indexů, nikoli závěr vlastního testu. API neuvádí verzi indexu ani effort; první místo neznamená nejlepší model pro každou programovací úlohu.

Publikované výsledky, nikoli vlastní měření. Každý záznam zachovává svou konfiguraci. Neúplně popsané běhy nezakládají pořadí kvality.

Všechny dostupné výsledky; pořadí je pouze ze zdrojového snapshotu, pokud je uvedeno.
BenchmarkVýsledekPořadíNápověda
AA Coding Indexopenai/gpt-5.574,9

OpenRouter publikuje tuto hodnotu indexu. Použitou revizi metodiky a konfiguraci zde neuvádí. Popis dostupnosti indexu není výkladem neznámé revize jeho metodiky.

CursorBenchgpt-5.5_high58,4 %10/17

Nejednoznačné úlohy přes více souborů z reálného používání Cursoru. Měří běh v prostředí Cursoru, ne samostatný model v libovolném nástroji.

CursorBenchgpt-5.5_low46,6 %13/14

Nejednoznačné úlohy přes více souborů z reálného používání Cursoru. Měří běh v prostředí Cursoru, ne samostatný model v libovolném nástroji.

CursorBenchgpt-5.5_medium53,8 %9/15

Nejednoznačné úlohy přes více souborů z reálného používání Cursoru. Měří běh v prostředí Cursoru, ne samostatný model v libovolném nástroji.

CursorBenchgpt-5.5_xhigh58,4 %10/11

Nejednoznačné úlohy přes více souborů z reálného používání Cursoru. Měří běh v prostředí Cursoru, ne samostatný model v libovolném nástroji.

DeepSWEgpt-5-567,04 %

Výsledek řešení softwarových úloh v jednotném agentním prostředí. Neprokazuje stejný výkon v jiném agentu ani kvalitu češtiny.

DeepSWEgpt-5-564,38 %

Výsledek řešení softwarových úloh v jednotném agentním prostředí. Neprokazuje stejný výkon v jiném agentu ani kvalitu češtiny.

DeepSWEgpt-5-553,98 %

Výsledek řešení softwarových úloh v jednotném agentním prostředí. Neprokazuje stejný výkon v jiném agentu ani kvalitu češtiny.

DeepSWEgpt-5-526,99 %

Výsledek řešení softwarových úloh v jednotném agentním prostředí. Neprokazuje stejný výkon v jiném agentu ani kvalitu češtiny.

ExploitBenchgpt-5.5_unknown47,4 %1/14

Význam benchmarku není v registru popsán. Podmínky zdroje je třeba ověřit u konkrétního běhu.

ExploitBenchgpt-5.5_unknown41,8 %2/14

Význam benchmarku není v registru popsán. Podmínky zdroje je třeba ověřit u konkrétního běhu.

ExploitBenchgpt-5.5_unknown41,6 %1/2

Význam benchmarku není v registru popsán. Podmínky zdroje je třeba ověřit u konkrétního běhu.

ExploitBenchgpt-5.5_unknown32,6 %2/2

Význam benchmarku není v registru popsán. Podmínky zdroje je třeba ověřit u konkrétního běhu.

FrontierCodegpt-5.5_unknown42,96 %1/2

Hodnotí kvalitu změn kódu pro produkční repozitáře. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.

MirrorCodegpt-5.5_high10 %6/6

Model znovu implementuje program bez přístupu k jeho původnímu zdrojovému kódu. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.

SWE-bench Verifiedgpt-5.5-pre-release_xhigh80,58 %1/1

Řešení reálných softwarových problémů změnou kódu repozitáře. Výsledek závisí na agentu, sadě úloh a konfiguraci.

SciCodegpt-5.5_high55,9 %4/20

Tvorba kódu pro vědecké výzkumné problémy. Úzká oblast; konkrétní měření AA a obecná definice datasetu mají oddělený původ.

SciCodegpt-5.5_low51,62 %6/13

Tvorba kódu pro vědecké výzkumné problémy. Úzká oblast; konkrétní měření AA a obecná definice datasetu mají oddělený původ.

SciCodegpt-5.5_medium53,47 %7/11

Tvorba kódu pro vědecké výzkumné problémy. Úzká oblast; konkrétní měření AA a obecná definice datasetu mají oddělený původ.

SciCodegpt-5.5_none47,34 %2/11

Tvorba kódu pro vědecké výzkumné problémy. Úzká oblast; konkrétní měření AA a obecná definice datasetu mají oddělený původ.

SciCodegpt-5.5_xhigh56,13 %3/13

Tvorba kódu pro vědecké výzkumné problémy. Úzká oblast; konkrétní měření AA a obecná definice datasetu mají oddělený původ.

Terminal-Benchgpt-5.5_unknown83,1 %1/2

Benchmark agentní práce; konkrétní úlohy a verze se musí ověřit u daného běhu. Současná homepage popisuje jinou revizi; nepřiřazuje verzi historickým řádkům.

Terminal-Benchgpt-5.5_unknown82 %1/1

Benchmark agentní práce; konkrétní úlohy a verze se musí ověřit u daného běhu. Současná homepage popisuje jinou revizi; nepřiřazuje verzi historickým řádkům.

Terminal-Benchgpt-5.5_unknown82,2 %1/4

Benchmark agentní práce; konkrétní úlohy a verze se musí ověřit u daného běhu. Současná homepage popisuje jinou revizi; nepřiřazuje verzi historickým řádkům.

Terminal-Benchgpt-5.5_unknown84,7 %1/1

Benchmark agentní práce; konkrétní úlohy a verze se musí ověřit u daného běhu. Současná homepage popisuje jinou revizi; nepřiřazuje verzi historickým řádkům.

Terminal-Benchgpt-5.5_unknown66,1 %1/1

Benchmark agentní práce; konkrétní úlohy a verze se musí ověřit u daného běhu. Současná homepage popisuje jinou revizi; nepřiřazuje verzi historickým řádkům.

GPQA Diamondgpt-5.5-pre-release_xhigh94 %2/11

Výsledky znalostního benchmarku GPQA; nejde o programovací úlohy. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.

GPQA Diamondgpt-5.5_low90,66 %1/22

Výsledky znalostního benchmarku GPQA; nejde o programovací úlohy. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.

GPQA Diamondgpt-5.5_none77,27 %11/24

Výsledky znalostního benchmarku GPQA; nejde o programovací úlohy. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.

ProofBenchgpt-5.5_xhigh50 %3/5

Význam benchmarku není v registru popsán. Podmínky zdroje je třeba ověřit u konkrétního běhu.

AA Agentic Indexopenai/gpt-5.537,5

OpenRouter publikuje tuto hodnotu indexu. Použitou revizi metodiky a konfiguraci zde neuvádí. Popis dostupnosti indexu není výkladem neznámé revize jeho metodiky.

APEX Agentsgpt-5.5_unknown38,5 %6/35

Význam benchmarku není v registru popsán. Podmínky zdroje je třeba ověřit u konkrétního běhu.

APEX Agentsgpt-5.5_xhigh38,5 %1/4

Význam benchmarku není v registru popsán. Podmínky zdroje je třeba ověřit u konkrétního běhu.

GSOgpt-5.5_xhigh40,2 %1/2

Význam benchmarku není v registru popsán. Podmínky zdroje je třeba ověřit u konkrétního běhu.

OSWorld 2gpt-5.5_xhigh13 %2/2

Význam benchmarku není v registru popsán. Podmínky zdroje je třeba ověřit u konkrétního běhu.

Design Arena · agenticgamedevopenai/gpt-5.51 178 Elo

Hodnocení designu vytvořeného AI komunitou; oddělujeme jednotlivé kategorie. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.

Design Arena · agentichtmlslidesopenai/gpt-5.51 084 Elo

Hodnocení designu vytvořeného AI komunitou; oddělujeme jednotlivé kategorie. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.

Design Arena · agenticslidesopenai/gpt-5.51 150 Elo

Hodnocení designu vytvořeného AI komunitou; oddělujeme jednotlivé kategorie. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.

Design Arena · agenticslides(html)openai/gpt-5.51 077 Elo

Hodnocení designu vytvořeného AI komunitou; oddělujeme jednotlivé kategorie. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.

Design Arena · agenticslides(python-pptx)openai/gpt-5.51 155 Elo

Hodnocení designu vytvořeného AI komunitou; oddělujeme jednotlivé kategorie. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.

Design Arena · androidnativeopenai/gpt-5.51 182 Elo

Hodnocení designu vytvořeného AI komunitou; oddělujeme jednotlivé kategorie. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.

Design Arena · fullstackopenai/gpt-5.51 098 Elo

Hodnocení designu vytvořeného AI komunitou; oddělujeme jednotlivé kategorie. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.

Design Arena · godotgamedevopenai/gpt-5.51 212 Elo

Hodnocení designu vytvořeného AI komunitou; oddělujeme jednotlivé kategorie. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.

Design Arena · htmlslidesopenai/gpt-5.51 074 Elo

Hodnocení designu vytvořeného AI komunitou; oddělujeme jednotlivé kategorie. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.

Design Arena · mobileappsopenai/gpt-5.51 179 Elo

Hodnocení designu vytvořeného AI komunitou; oddělujeme jednotlivé kategorie. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.

Design Arena · pptxslidesopenai/gpt-5.51 157 Elo

Hodnocení designu vytvořeného AI komunitou; oddělujeme jednotlivé kategorie. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.

Design Arena · python-pptxslidesopenai/gpt-5.51 152 Elo

Hodnocení designu vytvořeného AI komunitou; oddělujeme jednotlivé kategorie. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.

Design Arena · webappsopenai/gpt-5.51 144 Elo

Hodnocení designu vytvořeného AI komunitou; oddělujeme jednotlivé kategorie. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.

Design Arena · 3dopenai/gpt-5.51 235 Elo

Hodnocení designu vytvořeného AI komunitou; oddělujeme jednotlivé kategorie. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.

Design Arena · asciiartopenai/gpt-5.51 274 Elo

Hodnocení designu vytvořeného AI komunitou; oddělujeme jednotlivé kategorie. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.

Design Arena · codecategoriesopenai/gpt-5.51 276 Elo

Hodnocení designu vytvořeného AI komunitou; oddělujeme jednotlivé kategorie. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.

Design Arena · datavizopenai/gpt-5.51 278 Elo

Hodnocení designu vytvořeného AI komunitou; oddělujeme jednotlivé kategorie. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.

Design Arena · gamedevopenai/gpt-5.51 328 Elo

Hodnocení designu vytvořeného AI komunitou; oddělujeme jednotlivé kategorie. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.

Design Arena · svgopenai/gpt-5.51 270 Elo

Hodnocení designu vytvořeného AI komunitou; oddělujeme jednotlivé kategorie. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.

Design Arena · uicomponentopenai/gpt-5.51 277 Elo

Hodnocení designu vytvořeného AI komunitou; oddělujeme jednotlivé kategorie. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.

Design Arena · websiteopenai/gpt-5.51 269 Elo

Hodnocení designu vytvořeného AI komunitou; oddělujeme jednotlivé kategorie. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.

Artificial Analysis přes OpenRouter

AA Coding Index

Měřeno: datum neuvedeno

74,9
Špička11. z 126 modelůPořadí publikovaných hodnot. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Převzato z OpenRouteru; verze indexu, effort a datum měření nejsou v API uvedeny.

Model ve zdroji
openai/gpt-5.5
Záznam
openrouter.json
Původní hodnota
74.9
Původní zdroj ↗ · Zdroj převzetí ↗
Epoch · převzatý běh

CursorBench

Agent: Cursor · Effort: high · Měřeno: datum neuvedeno

58,4 %
Pořadí ve zdrojovém snapshotu10. z 17 modelůPořadí všech dostupných řádků ve zdrojovém snapshotu. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Datum měření není uvedeno Verze testu není v exportu jednoznačná Úplná konfigurace běhu není ověřena

GPT-5.5 High

Model ve zdroji
gpt-5.5_high
Záznam
cursorbench_external.csv: řádek 8
Původní hodnota
0.584 · převod × 100
Původní zdroj ↗ · Zdroj převzetí ↗
Epoch · převzatý běh

CursorBench

Agent: Cursor · Effort: low · Měřeno: datum neuvedeno

46,6 %
Pořadí ve zdrojovém snapshotu13. z 14 modelůPořadí všech dostupných řádků ve zdrojovém snapshotu. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Datum měření není uvedeno Verze testu není v exportu jednoznačná Úplná konfigurace běhu není ověřena

GPT-5.5 Low

Model ve zdroji
gpt-5.5_low
Záznam
cursorbench_external.csv: řádek 21
Původní hodnota
0.466 · převod × 100
Původní zdroj ↗ · Zdroj převzetí ↗
Epoch · převzatý běh

CursorBench

Agent: Cursor · Effort: medium · Měřeno: datum neuvedeno

53,8 %
Pořadí ve zdrojovém snapshotu9. z 15 modelůPořadí všech dostupných řádků ve zdrojovém snapshotu. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Datum měření není uvedeno Verze testu není v exportu jednoznačná Úplná konfigurace běhu není ověřena

GPT-5.5 Medium

Model ve zdroji
gpt-5.5_medium
Záznam
cursorbench_external.csv: řádek 12
Původní hodnota
0.538 · převod × 100
Původní zdroj ↗ · Zdroj převzetí ↗
Epoch · převzatý běh

CursorBench

Agent: Cursor · Effort: xhigh · Měřeno: datum neuvedeno

58,4 %
Pořadí ve zdrojovém snapshotu10. z 11 modelůPořadí všech dostupných řádků ve zdrojovém snapshotu. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Datum měření není uvedeno Verze testu není v exportu jednoznačná Úplná konfigurace běhu není ověřena

GPT-5.5 Extra High

Model ve zdroji
gpt-5.5_xhigh
Záznam
cursorbench_external.csv: řádek 6
Původní hodnota
0.584 · převod × 100
Původní zdroj ↗ · Zdroj převzetí ↗
Epoch · vlastní běh

DeepSWE

Agent: mini-swe-agent · Effort: xhigh · Verze: 1.1 · Měřeno: datum neuvedeno

67,04 %

Pořadí ve zdroji není uvedeno.

Podmínky a zdroj výsledku

Datum jednotlivého běhu a číslo verze balíčku agenta zdroj neuvádí. Pořadí závisí na konfiguraci; stejný effort různých dodavatelů není stejný rozpočet.

Model ve zdroji
gpt-5-5
Záznam
deepswe.json
Původní hodnota
0.6703539823008849 · převod × 100
Původní zdroj ↗ · Zdroj převzetí ↗
Dalších 50 výsledků a konfigurací
Epoch · vlastní běh

DeepSWE

Agent: mini-swe-agent · Effort: high · Verze: 1.1 · Měřeno: datum neuvedeno

64,38 %

Pořadí ve zdroji není uvedeno.

Podmínky a zdroj výsledku

Datum jednotlivého běhu a číslo verze balíčku agenta zdroj neuvádí. Pořadí závisí na konfiguraci; stejný effort různých dodavatelů není stejný rozpočet.

Model ve zdroji
gpt-5-5
Záznam
deepswe.json
Původní hodnota
0.6438053097345132 · převod × 100
Původní zdroj ↗ · Zdroj převzetí ↗
Epoch · vlastní běh

DeepSWE

Agent: mini-swe-agent · Effort: medium · Verze: 1.1 · Měřeno: datum neuvedeno

53,98 %

Pořadí ve zdroji není uvedeno.

Podmínky a zdroj výsledku

Datum jednotlivého běhu a číslo verze balíčku agenta zdroj neuvádí. Pořadí závisí na konfiguraci; stejný effort různých dodavatelů není stejný rozpočet.

Model ve zdroji
gpt-5-5
Záznam
deepswe.json
Původní hodnota
0.5398230088495575 · převod × 100
Původní zdroj ↗ · Zdroj převzetí ↗
Epoch · vlastní běh

DeepSWE

Agent: mini-swe-agent · Effort: low · Verze: 1.1 · Měřeno: datum neuvedeno

26,99 %

Pořadí ve zdroji není uvedeno.

Podmínky a zdroj výsledku

Datum jednotlivého běhu a číslo verze balíčku agenta zdroj neuvádí. Pořadí závisí na konfiguraci; stejný effort různých dodavatelů není stejný rozpočet.

Model ve zdroji
gpt-5-5
Záznam
deepswe.json
Původní hodnota
0.26991150442477874 · převod × 100
Původní zdroj ↗ · Zdroj převzetí ↗
Epoch · převzatý běh

ExploitBench

Měřeno: datum neuvedeno

47,4 %
Nejvyšší publikovaný výsledek1. z 14 modelůPořadí všech dostupných řádků ve zdrojovém snapshotu. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Datum měření není uvedeno Verze testu není v exportu jednoznačná Effort není doložen Úplná konfigurace běhu není ověřena

GPT 5.5 (AutoNudge)

Model ve zdroji
gpt-5.5_unknown
Záznam
exploitbench_external.csv: řádek 4
Původní hodnota
0.474 · převod × 100
Původní zdroj ↗ · Zdroj převzetí ↗
Epoch · převzatý běh

ExploitBench

Měřeno: datum neuvedeno

41,8 %
Pořadí ve zdrojovém snapshotu2. z 14 modelůPořadí všech dostupných řádků ve zdrojovém snapshotu. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Datum měření není uvedeno Verze testu není v exportu jednoznačná Effort není doložen Úplná konfigurace běhu není ověřena

GPT 5.5

Model ve zdroji
gpt-5.5_unknown
Záznam
exploitbench_external.csv: řádek 5
Původní hodnota
0.418 · převod × 100
Původní zdroj ↗ · Zdroj převzetí ↗
Epoch · převzatý běh

ExploitBench

Agent: Codex · Měřeno: datum neuvedeno

41,6 %
Malý vzorek — bez výkonové třídy1. z 2 modelůPořadí všech dostupných řádků ve zdrojovém snapshotu. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Datum měření není uvedeno Verze testu není v exportu jednoznačná Effort není doložen Úplná konfigurace běhu není ověřena

GPT 5.5 (Codex) (AutoNudge)

Model ve zdroji
gpt-5.5_unknown
Záznam
exploitbench_external.csv: řádek 6
Původní hodnota
0.41600000000000004 · převod × 100
Původní zdroj ↗ · Zdroj převzetí ↗
Epoch · převzatý běh

ExploitBench

Agent: Codex · Měřeno: datum neuvedeno

32,6 %
Malý vzorek — bez výkonové třídy2. z 2 modelůPořadí všech dostupných řádků ve zdrojovém snapshotu. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Datum měření není uvedeno Verze testu není v exportu jednoznačná Effort není doložen Úplná konfigurace běhu není ověřena

GPT 5.5 (Codex)

Model ve zdroji
gpt-5.5_unknown
Záznam
exploitbench_external.csv: řádek 7
Původní hodnota
0.326 · převod × 100
Původní zdroj ↗ · Zdroj převzetí ↗
Epoch · převzatý běh

FrontierCode

Agent: codex · Effort: xhigh · Měřeno: datum neuvedeno

42,96 %
Malý vzorek — bez výkonové třídy1. z 2 modelůPořadí všech dostupných řádků ve zdrojovém snapshotu. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Datum měření není uvedeno Verze testu není v exportu jednoznačná Úplná konfigurace běhu není ověřena

GPT-5.5

Model ve zdroji
gpt-5.5_unknown
Záznam
frontiercode_external.csv: řádek 11
Původní hodnota
0.42960000000000004 · převod × 100
Původní zdroj ↗ · Zdroj převzetí ↗
Epoch · vlastní běh

MirrorCode

Effort: high · Měřeno: 2026-08-10

10 %
Malý vzorek — bez výkonové třídy6. z 6 modelůPořadí všech dostupných řádků ve zdrojovém snapshotu. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Verze testu není v exportu jednoznačná Úplná konfigurace běhu není ověřena

Model ve zdroji
gpt-5.5_high
Záznam
mirrorcode.csv: řádek 5
Původní hodnota
0.1 · převod × 100
Původní zdroj ↗ · Zdroj převzetí ↗
Epoch · vlastní běh

SWE-bench Verified

Effort: xhigh · Měřeno: 2026-04-24

80,58 %
Malý vzorek — bez výkonové třídy1. z 1 modelůPořadí všech dostupných řádků ve zdrojovém snapshotu. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Verze testu není v exportu jednoznačná Úplná konfigurace běhu není ověřena

Model ve zdroji
gpt-5.5-pre-release_xhigh
Záznam
swe_bench_verified.csv: řádek 10
Původní hodnota
0.8057851239669421 · převod × 100
Původní zdroj ↗ · Zdroj převzetí ↗
Epoch · převzatý běh

SciCode

Effort: high · Měřeno: datum neuvedeno

55,9 %
Pořadí ve zdrojovém snapshotu4. z 20 modelůPořadí všech dostupných řádků ve zdrojovém snapshotu. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Datum měření není uvedeno Verze testu není v exportu jednoznačná Úplná konfigurace běhu není ověřena

GPT-5.5 (high)

Model ve zdroji
gpt-5.5_high
Záznam
scicode_external.csv: řádek 6
Původní hodnota
0.559027777777778 · převod × 100
Původní zdroj ↗ · Zdroj převzetí ↗
Epoch · převzatý běh

SciCode

Effort: low · Měřeno: datum neuvedeno

51,62 %
Pořadí ve zdrojovém snapshotu6. z 13 modelůPořadí všech dostupných řádků ve zdrojovém snapshotu. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Datum měření není uvedeno Verze testu není v exportu jednoznačná Úplná konfigurace běhu není ověřena

GPT-5.5 (low)

Model ve zdroji
gpt-5.5_low
Záznam
scicode_external.csv: řádek 12
Původní hodnota
0.516203703703704 · převod × 100
Původní zdroj ↗ · Zdroj převzetí ↗
Epoch · převzatý běh

SciCode

Effort: medium · Měřeno: datum neuvedeno

53,47 %
Pořadí ve zdrojovém snapshotu7. z 11 modelůPořadí všech dostupných řádků ve zdrojovém snapshotu. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Datum měření není uvedeno Verze testu není v exportu jednoznačná Úplná konfigurace běhu není ověřena

GPT-5.5 (medium)

Model ve zdroji
gpt-5.5_medium
Záznam
scicode_external.csv: řádek 8
Původní hodnota
0.534722222222222 · převod × 100
Původní zdroj ↗ · Zdroj převzetí ↗
Epoch · převzatý běh

SciCode

Effort: none · Měřeno: datum neuvedeno

47,34 %
Pořadí ve zdrojovém snapshotu2. z 11 modelůPořadí všech dostupných řádků ve zdrojovém snapshotu. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Datum měření není uvedeno Verze testu není v exportu jednoznačná Úplná konfigurace běhu není ověřena

GPT-5.5 (Non-reasoning)

Model ve zdroji
gpt-5.5_none
Záznam
scicode_external.csv: řádek 20
Původní hodnota
0.47337962962963 · převod × 100
Původní zdroj ↗ · Zdroj převzetí ↗
Epoch · převzatý běh

SciCode

Effort: xhigh · Měřeno: datum neuvedeno

56,13 %
Pořadí ve zdrojovém snapshotu3. z 13 modelůPořadí všech dostupných řádků ve zdrojovém snapshotu. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Datum měření není uvedeno Verze testu není v exportu jednoznačná Úplná konfigurace běhu není ověřena

GPT-5.5 (xhigh)

Model ve zdroji
gpt-5.5_xhigh
Záznam
scicode_external.csv: řádek 5
Původní hodnota
0.561342592592593 · převod × 100
Původní zdroj ↗ · Zdroj převzetí ↗
Epoch · převzatý běh

Terminal-Bench

Agent: Capy · Verze: 2.0 · Měřeno: 2026-05-14

83,1 %
Malý vzorek — bez výkonové třídy1. z 2 modelůPořadí všech dostupných řádků ve zdrojovém snapshotu. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Effort není doložen Úplná konfigurace běhu není ověřena

GPT-5.5

Model ve zdroji
gpt-5.5_unknown
Záznam
terminalbench_external.csv: řádek 3
Původní hodnota
0.831 · převod × 100
Původní zdroj ↗ · Zdroj převzetí ↗
Epoch · převzatý běh

Terminal-Bench

Agent: Codex · Verze: 2.0 · Měřeno: 2026-04-23

82 %
Malý vzorek — bez výkonové třídy1. z 1 modelůPořadí všech dostupných řádků ve zdrojovém snapshotu. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Effort není doložen Úplná konfigurace běhu není ověřena

GPT-5.5

Model ve zdroji
gpt-5.5_unknown
Záznam
terminalbench_external.csv: řádek 5
Původní hodnota
0.8200000000000001 · převod × 100
Původní zdroj ↗ · Zdroj převzetí ↗
Epoch · převzatý běh

Terminal-Bench

Agent: Codex CLI · Verze: 2.0 · Měřeno: 2026-04-23

82,2 %
Malý vzorek — bez výkonové třídy1. z 4 modelůPořadí všech dostupných řádků ve zdrojovém snapshotu. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Effort není doložen Úplná konfigurace běhu není ověřena

GPT-5.5

Model ve zdroji
gpt-5.5_unknown
Záznam
terminalbench_external.csv: řádek 4
Původní hodnota
0.8220000000000001 · převod × 100
Původní zdroj ↗ · Zdroj převzetí ↗
Epoch · převzatý běh

Terminal-Bench

Agent: NexAU-AHE · Verze: 2.0 · Měřeno: 2026-05-14

84,7 %
Malý vzorek — bez výkonové třídy1. z 1 modelůPořadí všech dostupných řádků ve zdrojovém snapshotu. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Effort není doložen Úplná konfigurace běhu není ověřena

GPT-5.5

Model ve zdroji
gpt-5.5_unknown
Záznam
terminalbench_external.csv: řádek 2
Původní hodnota
0.8470000000000001 · převod × 100
Původní zdroj ↗ · Zdroj převzetí ↗
Epoch · převzatý běh

Terminal-Bench

Agent: clnkr · Verze: 2.0 · Měřeno: 2026-05-14

66,1 %
Malý vzorek — bez výkonové třídy1. z 1 modelůPořadí všech dostupných řádků ve zdrojovém snapshotu. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Effort není doložen Úplná konfigurace běhu není ověřena

GPT-5.5

Model ve zdroji
gpt-5.5_unknown
Záznam
terminalbench_external.csv: řádek 33
Původní hodnota
0.6609999999999999 · převod × 100
Původní zdroj ↗ · Zdroj převzetí ↗
Epoch · vlastní běh

GPQA Diamond

Effort: xhigh · Měřeno: 2026-04-24

94 %
Pořadí ve zdrojovém snapshotu2. z 11 modelůPořadí všech dostupných řádků ve zdrojovém snapshotu. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Verze testu není v exportu jednoznačná Úplná konfigurace běhu není ověřena

Model ve zdroji
gpt-5.5-pre-release_xhigh
Záznam
gpqa_diamond.csv: řádek 157
Původní hodnota
0.9400252525252525 · převod × 100
Původní zdroj ↗ · Zdroj převzetí ↗
Epoch · vlastní běh

GPQA Diamond

Effort: low · Měřeno: 2026-05-05

90,66 %
Nejvyšší publikovaný výsledek1. z 22 modelůPořadí všech dostupných řádků ve zdrojovém snapshotu. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Verze testu není v exportu jednoznačná Úplná konfigurace běhu není ověřena

Model ve zdroji
gpt-5.5_low
Záznam
gpqa_diamond.csv: řádek 154
Původní hodnota
0.9065656565656566 · převod × 100
Původní zdroj ↗ · Zdroj převzetí ↗
Epoch · vlastní běh

GPQA Diamond

Effort: none · Měřeno: 2026-08-07

77,27 %
Pořadí ve zdrojovém snapshotu11. z 24 modelůPořadí všech dostupných řádků ve zdrojovém snapshotu. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Verze testu není v exportu jednoznačná Úplná konfigurace běhu není ověřena

Model ve zdroji
gpt-5.5_none
Záznam
gpqa_diamond.csv: řádek 60
Původní hodnota
0.7727272727272727 · převod × 100
Původní zdroj ↗ · Zdroj převzetí ↗
Epoch · převzatý běh

ProofBench

Effort: xhigh · Měřeno: datum neuvedeno

50 %
Malý vzorek — bez výkonové třídy3. z 5 modelůPořadí všech dostupných řádků ve zdrojovém snapshotu. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Datum měření není uvedeno Verze testu není v exportu jednoznačná Úplná konfigurace běhu není ověřena

ProofBench v1.0-era value; model absent from the v1.1 board (vals.ai re-grade 2026-08-14, methodology changed) and not re-run. Not comparable to v1.1 rows. Annotated 2026-08-18.

Model ve zdroji
gpt-5.5_xhigh
Záznam
proofbench_external.csv: řádek 18
Původní hodnota
0.5 · převod × 100
Původní zdroj ↗ · Zdroj převzetí ↗
Artificial Analysis přes OpenRouter

AA Agentic Index

Měřeno: datum neuvedeno

37,5
Střední pásmo24. z 60 modelůPořadí publikovaných hodnot. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Převzato z OpenRouteru; verze indexu, effort a datum měření nejsou v API uvedeny.

Model ve zdroji
openai/gpt-5.5
Záznam
openrouter.json
Původní hodnota
37.5
Původní zdroj ↗ · Zdroj převzetí ↗
Epoch · převzatý běh

APEX Agents

Měřeno: datum neuvedeno

38,5 %
Pořadí ve zdrojovém snapshotu6. z 35 modelůPořadí všech dostupných řádků ve zdrojovém snapshotu. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Datum měření není uvedeno Verze testu není v exportu jednoznačná Effort není doložen Úplná konfigurace běhu není ověřena

GPT-5.5

Model ve zdroji
gpt-5.5_unknown
Záznam
apex_agents_external.csv: řádek 14
Původní hodnota
0.385 · převod × 100
Původní zdroj ↗ · Zdroj převzetí ↗
Epoch · převzatý běh

APEX Agents

Effort: xhigh · Měřeno: datum neuvedeno

38,5 %
Malý vzorek — bez výkonové třídy1. z 4 modelůPořadí všech dostupných řádků ve zdrojovém snapshotu. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Datum měření není uvedeno Verze testu není v exportu jednoznačná Úplná konfigurace běhu není ověřena

GPT 5.5

Model ve zdroji
gpt-5.5_xhigh
Záznam
apex_agents_external.csv: řádek 13
Původní hodnota
0.385 · převod × 100
Původní zdroj ↗ · Zdroj převzetí ↗
Epoch · převzatý běh

GSO

Effort: xhigh · Měřeno: datum neuvedeno

40,2 %
Malý vzorek — bez výkonové třídy1. z 2 modelůPořadí všech dostupných řádků ve zdrojovém snapshotu. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Datum měření není uvedeno Verze testu není v exportu jednoznačná Úplná konfigurace běhu není ověřena

Model ve zdroji
gpt-5.5_xhigh
Záznam
gso_external.csv: řádek 6
Původní hodnota
0.402 · převod × 100
Původní zdroj ↗ · Zdroj převzetí ↗
Epoch · převzatý běh

OSWorld 2

Effort: xhigh · Měřeno: datum neuvedeno

13 %
Malý vzorek — bez výkonové třídy2. z 2 modelůPořadí všech dostupných řádků ve zdrojovém snapshotu. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Datum měření není uvedeno Verze testu není v exportu jednoznačná Úplná konfigurace běhu není ověřena

GPT-5.5 (xhigh)

Model ve zdroji
gpt-5.5_xhigh
Záznam
osworld_2_external.csv: řádek 8
Původní hodnota
0.13 · převod × 100
Původní zdroj ↗ · Zdroj převzetí ↗
Design Arena přes OpenRouter

Design Arena · agenticgamedev

Měřeno: datum neuvedeno

1 178 Elo
Střední pásmo14. z 23 modelůPořadí publikovaných hodnot. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Elo preferencí designu; není obecným skóre programování. Datum měření a velikost vzorku API neuvádí.

Model ve zdroji
openai/gpt-5.5
Záznam
openrouter.json
Původní hodnota
1178.0
Původní zdroj ↗ · Zdroj převzetí ↗
Design Arena přes OpenRouter

Design Arena · agentichtmlslides

Měřeno: datum neuvedeno

1 084 Elo
Malý vzorek — bez výkonové třídy8. z 9 modelůPořadí publikovaných hodnot. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Elo preferencí designu; není obecným skóre programování. Datum měření a velikost vzorku API neuvádí.

Model ve zdroji
openai/gpt-5.5
Záznam
openrouter.json
Původní hodnota
1084.0
Původní zdroj ↗ · Zdroj převzetí ↗
Design Arena přes OpenRouter

Design Arena · agenticslides

Měřeno: datum neuvedeno

1 150 Elo
Malý vzorek — bez výkonové třídy6. z 9 modelůPořadí publikovaných hodnot. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Elo preferencí designu; není obecným skóre programování. Datum měření a velikost vzorku API neuvádí.

Model ve zdroji
openai/gpt-5.5
Záznam
openrouter.json
Původní hodnota
1150.0
Původní zdroj ↗ · Zdroj převzetí ↗
Design Arena přes OpenRouter

Design Arena · agenticslides(html)

Měřeno: datum neuvedeno

1 077 Elo
Malý vzorek — bez výkonové třídy8. z 9 modelůPořadí publikovaných hodnot. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Elo preferencí designu; není obecným skóre programování. Datum měření a velikost vzorku API neuvádí.

Model ve zdroji
openai/gpt-5.5
Záznam
openrouter.json
Původní hodnota
1077.0
Původní zdroj ↗ · Zdroj převzetí ↗
Design Arena přes OpenRouter

Design Arena · agenticslides(python-pptx)

Měřeno: datum neuvedeno

1 155 Elo
Malý vzorek — bez výkonové třídy6. z 9 modelůPořadí publikovaných hodnot. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Elo preferencí designu; není obecným skóre programování. Datum měření a velikost vzorku API neuvádí.

Model ve zdroji
openai/gpt-5.5
Záznam
openrouter.json
Původní hodnota
1155.0
Původní zdroj ↗ · Zdroj převzetí ↗
Design Arena přes OpenRouter

Design Arena · androidnative

Měřeno: datum neuvedeno

1 182 Elo
Střední pásmo19. z 35 modelůPořadí publikovaných hodnot. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Elo preferencí designu; není obecným skóre programování. Datum měření a velikost vzorku API neuvádí.

Model ve zdroji
openai/gpt-5.5
Záznam
openrouter.json
Původní hodnota
1182.0
Původní zdroj ↗ · Zdroj převzetí ↗
Design Arena přes OpenRouter

Design Arena · fullstack

Měřeno: datum neuvedeno

1 098 Elo
Střední pásmo25. z 38 modelůPořadí publikovaných hodnot. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Elo preferencí designu; není obecným skóre programování. Datum měření a velikost vzorku API neuvádí.

Model ve zdroji
openai/gpt-5.5
Záznam
openrouter.json
Původní hodnota
1098.0
Původní zdroj ↗ · Zdroj převzetí ↗
Design Arena přes OpenRouter

Design Arena · godotgamedev

Měřeno: datum neuvedeno

1 212 Elo
Střední pásmo9. z 28 modelůPořadí publikovaných hodnot. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Elo preferencí designu; není obecným skóre programování. Datum měření a velikost vzorku API neuvádí.

Model ve zdroji
openai/gpt-5.5
Záznam
openrouter.json
Původní hodnota
1212.0
Původní zdroj ↗ · Zdroj převzetí ↗
Design Arena přes OpenRouter

Design Arena · htmlslides

Měřeno: datum neuvedeno

1 074 Elo
Nižší výsledek21. z 22 modelůPořadí publikovaných hodnot. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Elo preferencí designu; není obecným skóre programování. Datum měření a velikost vzorku API neuvádí.

Model ve zdroji
openai/gpt-5.5
Záznam
openrouter.json
Původní hodnota
1074.0
Původní zdroj ↗ · Zdroj převzetí ↗
Design Arena přes OpenRouter

Design Arena · mobileapps

Měřeno: datum neuvedeno

1 179 Elo
Střední pásmo24. z 37 modelůPořadí publikovaných hodnot. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Elo preferencí designu; není obecným skóre programování. Datum měření a velikost vzorku API neuvádí.

Model ve zdroji
openai/gpt-5.5
Záznam
openrouter.json
Původní hodnota
1179.0
Původní zdroj ↗ · Zdroj převzetí ↗
Design Arena přes OpenRouter

Design Arena · pptxslides

Měřeno: datum neuvedeno

1 157 Elo
Malý vzorek — bez výkonové třídy6. z 8 modelůPořadí publikovaných hodnot. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Elo preferencí designu; není obecným skóre programování. Datum měření a velikost vzorku API neuvádí.

Model ve zdroji
openai/gpt-5.5
Záznam
openrouter.json
Původní hodnota
1157.0
Původní zdroj ↗ · Zdroj převzetí ↗
Design Arena přes OpenRouter

Design Arena · python-pptxslides

Měřeno: datum neuvedeno

1 152 Elo
Nižší výsledek19. z 22 modelůPořadí publikovaných hodnot. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Elo preferencí designu; není obecným skóre programování. Datum měření a velikost vzorku API neuvádí.

Model ve zdroji
openai/gpt-5.5
Záznam
openrouter.json
Původní hodnota
1152.0
Původní zdroj ↗ · Zdroj převzetí ↗
Design Arena přes OpenRouter

Design Arena · webapps

Měřeno: datum neuvedeno

1 144 Elo
Nižší výsledek27. z 35 modelůPořadí publikovaných hodnot. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Elo preferencí designu; není obecným skóre programování. Datum měření a velikost vzorku API neuvádí.

Model ve zdroji
openai/gpt-5.5
Záznam
openrouter.json
Původní hodnota
1144.0
Původní zdroj ↗ · Zdroj převzetí ↗
Design Arena přes OpenRouter

Design Arena · 3d

Měřeno: datum neuvedeno

1 235 Elo
Střední pásmo36. z 98 modelůPořadí publikovaných hodnot. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Elo preferencí designu; není obecným skóre programování. Datum měření a velikost vzorku API neuvádí.

Model ve zdroji
openai/gpt-5.5
Záznam
openrouter.json
Původní hodnota
1235.0
Původní zdroj ↗ · Zdroj převzetí ↗
Design Arena přes OpenRouter

Design Arena · asciiart

Měřeno: datum neuvedeno

1 274 Elo
Vysoký výkon12. z 57 modelůPořadí publikovaných hodnot. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Elo preferencí designu; není obecným skóre programování. Datum měření a velikost vzorku API neuvádí.

Model ve zdroji
openai/gpt-5.5
Záznam
openrouter.json
Původní hodnota
1274.0
Původní zdroj ↗ · Zdroj převzetí ↗
Design Arena přes OpenRouter

Design Arena · codecategories

Měřeno: datum neuvedeno

1 276 Elo
Vysoký výkon24. z 106 modelůPořadí publikovaných hodnot. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Elo preferencí designu; není obecným skóre programování. Datum měření a velikost vzorku API neuvádí.

Model ve zdroji
openai/gpt-5.5
Záznam
openrouter.json
Původní hodnota
1276.0
Původní zdroj ↗ · Zdroj převzetí ↗
Design Arena přes OpenRouter

Design Arena · dataviz

Měřeno: datum neuvedeno

1 278 Elo
Vysoký výkon19. z 104 modelůPořadí publikovaných hodnot. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Elo preferencí designu; není obecným skóre programování. Datum měření a velikost vzorku API neuvádí.

Model ve zdroji
openai/gpt-5.5
Záznam
openrouter.json
Původní hodnota
1278.0
Původní zdroj ↗ · Zdroj převzetí ↗
Design Arena přes OpenRouter

Design Arena · gamedev

Měřeno: datum neuvedeno

1 328 Elo
Špička9. z 105 modelůPořadí publikovaných hodnot. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Elo preferencí designu; není obecným skóre programování. Datum měření a velikost vzorku API neuvádí.

Model ve zdroji
openai/gpt-5.5
Záznam
openrouter.json
Původní hodnota
1328.0
Původní zdroj ↗ · Zdroj převzetí ↗
Design Arena přes OpenRouter

Design Arena · svg

Měřeno: datum neuvedeno

1 270 Elo
Vysoký výkon9. z 75 modelůPořadí publikovaných hodnot. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Elo preferencí designu; není obecným skóre programování. Datum měření a velikost vzorku API neuvádí.

Model ve zdroji
openai/gpt-5.5
Záznam
openrouter.json
Původní hodnota
1270.0
Původní zdroj ↗ · Zdroj převzetí ↗
Design Arena přes OpenRouter

Design Arena · uicomponent

Měřeno: datum neuvedeno

1 277 Elo
Vysoký výkon25. z 102 modelůPořadí publikovaných hodnot. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Elo preferencí designu; není obecným skóre programování. Datum měření a velikost vzorku API neuvádí.

Model ve zdroji
openai/gpt-5.5
Záznam
openrouter.json
Původní hodnota
1277.0
Původní zdroj ↗ · Zdroj převzetí ↗
Design Arena přes OpenRouter

Design Arena · website

Měřeno: datum neuvedeno

1 269 Elo
Vysoký výkon26. z 112 modelůPořadí publikovaných hodnot. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Elo preferencí designu; není obecným skóre programování. Datum měření a velikost vzorku API neuvádí.

Model ve zdroji
openai/gpt-5.5
Záznam
openrouter.json
Původní hodnota
1269.0
Původní zdroj ↗ · Zdroj převzetí ↗

Kolik stojí používání

Jeden z nejdražších17. z 311 modelů · sdílené pořadí od nejdražšího

11 USD za srovnávací koš

13,75× medián · medián 0,8 USD. Srovnání 311 modelů celého katalogu s použitelnou standardní API sazbou a dostatečným kontextem.

GPT-5.5
NejdražšíVyšší cenaStředNízká cena

Nejbližší konkurenti podle ceny koše

100 požadavků, každý s 10 000 vstupními tokeny. Výstup podle zvoleného poměru. Základní textové API včetně případného poplatku za požadavek; nejde o cenu úspěšně vyřešené úlohy.

Co za své peníze získáte jinde

Blízký index = rozdíl nejvýše 3 body. Podobná cena = ±20 % koše. Pokud blízký index levněji chybí, ukazujeme nejbližší nižší index s úsporou. Výběr z celého katalogu; jde o publikovaný AA index s neúplnou metodikou.

USD za milion tokenů. Nabídky a pásma z OpenRouteru; ceny předplatného aplikací zde nejsou.

NabídkaTokenové sazbyČtení cache
Standardní APIopenai/gpt-5.5$5$30$0,5
↳ od 272 000 vstupních tokenů$10$45$1
Batchopenai/gpt-5.5:batch$2,5$15$0,25
↳ od 272 000 vstupních tokenů$5$22,5$0,5
Vstupní modality
file, image, text
Volání nástrojů
Ano
Do katalogu přidán
2026-04-24
Znalostní cutoff
2025-12-01
Kanonická verze
openai/gpt-5.5-20260423
Otevřít nabídku na OpenRouteru ↗

Co zvážit vedle tohoto modelu

Blízkost výstupní ceny, publikovaného AA Coding Indexu (kde je) a zaměření v popisu. Kandidáti z aktuálního katalogu se stejnými výstupními modalitami; nejde o pořadí kvality. Cenové rozdíly níže platí pro základní standardní API sazbu.

Další modely od OpenAI

Co jsme o modelu napsali

Hypata · 2026-06-13

Kimi K2.7 Code: levná open-weights odpověď na Fable 5, ale s vlastními benchmarky ↗

„Publikování zlepšení jako delt proti vlastní předchozí verzi je marketingově chytré - plus 21,8 procenta na Kimi Code Bench v2 vypadá jako velký skok. Neříká to ale, kde model stojí absolutně proti GPT-5.5 nebo Fable 5. Podle některých srovnání se gap k GPT-5.5 na Kimi Code Bench v2 zúžil z osmnácti bodů v éře K2.6 na sedm, ale i to je srovnání na domácím benchmarku Moonshotu.“
Patrick Zandl · 2026-05-28

Claude Opus 4.8 - Anthropic sází na chování modelu, ne na benchmarky ↗

„Strategicky je Fast Mode tlak na cenovou válku. Rychlejší a levnější varianta frontier modelu je přímá odpověď na cenovou pozici GPT-5.5 a na nástup levných čínských modelů jako DeepSeek V4-Flash. Anthropic drží katalogovou cenu Opus 4.8 na úrovni 4.7, ale Fast Mode otevírá levnější vstupní bod bez nutnosti sáhnout po slabším modelu.“
Patrick Zandl · 2026-04-24

GPT-5.5: první model OpenAI zamýšlený primárně pro agenty ↗

„Kde naopak GPT-5.5 pochválit nemůžu, je čeština. Je kostrbatá, časté je vyšinutí z vazby. Zatímco Opus, když už má problémy, tak v tom, že všude cpe anglické výrazy, i když existují ustálené české, GPT-5.5 je prostě kostrbatý. Proti předchozím modelům v češtině ztrácí.“

Charakteristika vznikla automaticky z parametrů a popisu OpenRouteru. Benchmarky jsou převzaté výsledky s uvedenými zdroji; redakční zkušenosti jsou oddělené v analýzách.