Vibecoding.cz Patrick Zandl o AI vývoji
Reklama
V nabídce OpenRouteru · OpenAI

gpt-oss-120b

openai/gpt-oss-120b

Porovnat model ↗

gpt-oss-120b od OpenAI nabízí kontext 131 072 tokenů. Popis v katalogu jej zaměřuje na práce s nástroji a agenty, analytické úlohy. OpenRouter u něj uvádí AA Coding Index 30.4; jde o převzatý index s neuvedenou konfigurací, nikoli vlastní test.

NástrojeHF repozitář
Vstup / 1M tokenů$0,15
Výstup / 1M tokenů$0,6
Kontext131,1 k
Čeština

Zatím bez vlastního měření. Obecný jazykový benchmark nepovažujeme za test češtiny.

Popis z OpenRouteru v původním znění

gpt-oss-120b is an open-weight, 117B-parameter Mixture-of-Experts (MoE) language model from OpenAI designed for high-reasoning, agentic, and general-purpose production use cases. It activates 5.1B parameters per forward pass and is optimized...

OpenRouter ↗

Co ukazují výsledky

Publikovaný index85. z 126 modelů

Publikovaný AA Coding Index

Leží ve středních 50 % zveřejněných hodnot AA Coding Indexu v celém načteném katalogu OpenRouteru. Hodnota modelu: 30,4.

gpt-oss-120b
Nejvyšší indexyVyšší indexyStředNižší indexy

Nejbližší konkurenti podle Coding Indexu

Pořadí publikovaných indexů, nikoli závěr vlastního testu. API neuvádí verzi indexu ani effort; první místo neznamená nejlepší model pro každou programovací úlohu.

Publikované výsledky, nikoli vlastní měření. Každý záznam zachovává svou konfiguraci. Neúplně popsané běhy nezakládají pořadí kvality.

Všechny dostupné výsledky; pořadí je pouze ze zdrojového snapshotu, pokud je uvedeno.
BenchmarkVýsledekPořadíNápověda
AA Coding Indexopenai/gpt-oss-120b30,4—
ⓘ

OpenRouter publikuje tuto hodnotu indexu. Použitou revizi metodiky a konfiguraci zde neuvádí. Popis dostupnosti indexu není výkladem neznámé revize jeho metodiky.

Aider Polyglotgpt-oss-120b_high41,8 %7/8
ⓘ

Kódové úlohy v několika programovacích jazycích řešené nástrojem Aider. Není to test přirozených jazyků; záleží na nastavení editace a pokusech.

Aider Polyglotopenai/gpt-oss-120b_high41,8 %7/8
ⓘ

Kódové úlohy v několika programovacích jazycích řešené nástrojem Aider. Není to test přirozených jazyků; záleží na nastavení editace a pokusech.

SciCodeopenai/gpt-oss-120b_high34,03 %20/20
ⓘ

Tvorba kódu pro vědecké výzkumné problémy. Úzká oblast; konkrétní měření AA a obecná definice datasetu mají oddělený původ.

SciCodeopenai/gpt-oss-120b_low36 %13/13
ⓘ

Tvorba kódu pro vědecké výzkumné problémy. Úzká oblast; konkrétní měření AA a obecná definice datasetu mají oddělený původ.

Terminal-Benchgpt-oss-120b14,2 %9/13
ⓘ

Benchmark agentní práce; konkrétní úlohy a verze se musí ověřit u daného běhu. Současná homepage popisuje jinou revizi; nepřiřazuje verzi historickým řádkům.

Terminal-Benchgpt-oss-120b18,7 %29/33
ⓘ

Benchmark agentní práce; konkrétní úlohy a verze se musí ověřit u daného běhu. Současná homepage popisuje jinou revizi; nepřiřazuje verzi historickým řádkům.

Terminal-Benchgpt-oss-120b_unknown14,16 %10/13
ⓘ

Benchmark agentní práce; konkrétní úlohy a verze se musí ověřit u daného běhu. Současná homepage popisuje jinou revizi; nepřiřazuje verzi historickým řádkům.

Terminal-Benchgpt-oss-120b_unknown18,69 %30/33
ⓘ

Benchmark agentní práce; konkrétní úlohy a verze se musí ověřit u daného běhu. Současná homepage popisuje jinou revizi; nepřiřazuje verzi historickým řádkům.

AA Intelligence Indexopenai/gpt-oss-120b11,6—
ⓘ

Soubor především textových úloh v angličtině; není testem češtiny. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.

GPQA Diamondopenai/gpt-oss-120b_high75,76 %23/26
ⓘ

Výsledky znalostního benchmarku GPQA; nejde o programovací úlohy. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.

AA Agentic Indexopenai/gpt-oss-120b3,7—
ⓘ

OpenRouter publikuje tuto hodnotu indexu. Použitou revizi metodiky a konfiguraci zde neuvádí. Popis dostupnosti indexu není výkladem neznámé revize jeho metodiky.

APEX Agentsgpt-oss-120b4,4 %22/22
ⓘ

Význam benchmarku není v registru popsán. Podmínky zdroje je třeba ověřit u konkrétního běhu.

Design Arena · 3dopenai/gpt-oss-120b924 Elo—
ⓘ

Hodnocení designu vytvořeného AI komunitou; oddělujeme jednotlivé kategorie. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.

Design Arena · codecategoriesopenai/gpt-oss-120b972 Elo—
ⓘ

Hodnocení designu vytvořeného AI komunitou; oddělujeme jednotlivé kategorie. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.

Design Arena · datavizopenai/gpt-oss-120b997 Elo—
ⓘ

Hodnocení designu vytvořeného AI komunitou; oddělujeme jednotlivé kategorie. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.

Design Arena · gamedevopenai/gpt-oss-120b1 008 Elo—
ⓘ

Hodnocení designu vytvořeného AI komunitou; oddělujeme jednotlivé kategorie. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.

Design Arena · uicomponentopenai/gpt-oss-120b935 Elo—
ⓘ

Hodnocení designu vytvořeného AI komunitou; oddělujeme jednotlivé kategorie. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.

Design Arena · websiteopenai/gpt-oss-120b976 Elo—
ⓘ

Hodnocení designu vytvořeného AI komunitou; oddělujeme jednotlivé kategorie. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.

Artificial Analysis přes OpenRouter

AA Coding Index

Měřeno: datum neuvedeno

30,4
Střední pásmo85. z 126 modelůPořadí publikovaných hodnot. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Převzato z OpenRouteru; verze indexu, effort a datum měření nejsou v API uvedeny.

Model ve zdroji
openai/gpt-oss-120b
Záznam
openrouter.json
Původní hodnota
30.4
Původní zdroj ↗ · Zdroj převzetí ↗
Epoch · převzatý běh

Aider Polyglot

Effort: high · Měřeno: datum neuvedeno

41,8 %
Malý vzorek — bez výkonové třídy7. z 8 modelůPořadí všech dostupných řádků ve zdrojovém snapshotu. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Datum měření není uvedeno Verze testu není v exportu jednoznačná Úplná konfigurace běhu není ověřena

Model ve zdroji
gpt-oss-120b_high
Záznam
aider_polyglot_external.csv: řádek 2
Původní hodnota
41.8
Původní zdroj ↗ · Zdroj převzetí ↗
Epoch · převzatý běh

Aider Polyglot

Effort: high · Měřeno: 2025-08-06

41,8 %
Malý vzorek — bez výkonové třídy7. z 8 modelůPořadí všech dostupných řádků ve zdrojovém snapshotu. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Verze testu není v exportu jednoznačná Úplná konfigurace běhu není ověřena

Model ve zdroji
openai/gpt-oss-120b_high
Záznam
aider_polyglot_external.csv: řádek 76
Původní hodnota
41.8
Původní zdroj ↗ · Zdroj převzetí ↗
Epoch · převzatý běh

SciCode

Effort: high · Měřeno: datum neuvedeno

34,03 %
Pořadí ve zdrojovém snapshotu20. z 20 modelůPořadí všech dostupných řádků ve zdrojovém snapshotu. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Datum měření není uvedeno Verze testu není v exportu jednoznačná Úplná konfigurace běhu není ověřena

gpt-oss-120b (high)

Model ve zdroji
openai/gpt-oss-120b_high
Záznam
scicode_external.csv: řádek 34
Původní hodnota
0.340277777777778 · převod × 100
Původní zdroj ↗ · Zdroj převzetí ↗
Epoch · převzatý běh

SciCode

Effort: low · Měřeno: datum neuvedeno

36 %
Pořadí ve zdrojovém snapshotu13. z 13 modelůPořadí všech dostupných řádků ve zdrojovém snapshotu. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Datum měření není uvedeno Verze testu není v exportu jednoznačná Úplná konfigurace běhu není ověřena

gpt-oss-120b (low)

Model ve zdroji
openai/gpt-oss-120b_low
Záznam
scicode_external.csv: řádek 130
Původní hodnota
0.35995370370370405 · převod × 100
Původní zdroj ↗ · Zdroj převzetí ↗
Epoch · převzatý běh

Terminal-Bench

Agent: Mini-SWE-Agent · Verze: 2.0 · Měřeno: 2025-11-03

14,2 %
Pořadí ve zdrojovém snapshotu9. z 13 modelůPořadí všech dostupných řádků ve zdrojovém snapshotu. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Effort není doložen Úplná konfigurace běhu není ověřena

Model ve zdroji
gpt-oss-120b
Záznam
terminalbench_external.csv: řádek 188
Původní hodnota
0.142 · převod × 100
Původní zdroj ↗ · Zdroj převzetí ↗
Dalších 13 výsledků a konfigurací
Epoch · převzatý běh

Terminal-Bench

Agent: Terminus 2 · Verze: 2.0 · Měřeno: 2025-11-01

18,7 %
Pořadí ve zdrojovém snapshotu29. z 33 modelůPořadí všech dostupných řádků ve zdrojovém snapshotu. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Effort není doložen Úplná konfigurace běhu není ověřena

Model ve zdroji
gpt-oss-120b
Záznam
terminalbench_external.csv: řádek 175
Původní hodnota
0.187 · převod × 100
Původní zdroj ↗ · Zdroj převzetí ↗
Epoch · převzatý běh

Terminal-Bench

Agent: Mini-SWE-Agent · Verze: 2.0 · Měřeno: 2025-08-05

14,16 %
Pořadí ve zdrojovém snapshotu10. z 13 modelůPořadí všech dostupných řádků ve zdrojovém snapshotu. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Effort není doložen Úplná konfigurace běhu není ověřena

GPT-OSS-120B

Model ve zdroji
gpt-oss-120b_unknown
Záznam
terminalbench_external.csv: řádek 189
Původní hodnota
0.141573033708 · převod × 100
Původní zdroj ↗ · Zdroj převzetí ↗
Epoch · převzatý běh

Terminal-Bench

Agent: Terminus 2 · Verze: 2.0 · Měřeno: 2025-08-05

18,69 %
Pořadí ve zdrojovém snapshotu30. z 33 modelůPořadí všech dostupných řádků ve zdrojovém snapshotu. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Effort není doložen Úplná konfigurace běhu není ověřena

GPT-OSS-120B

Model ve zdroji
gpt-oss-120b_unknown
Záznam
terminalbench_external.csv: řádek 176
Původní hodnota
0.18689138576800002 · převod × 100
Původní zdroj ↗ · Zdroj převzetí ↗
Artificial Analysis přes OpenRouter

AA Intelligence Index

Měřeno: datum neuvedeno

11,6
Nižší výsledek72. z 92 modelůPořadí publikovaných hodnot. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Převzato z OpenRouteru; verze indexu, effort a datum měření nejsou v API uvedeny.

Model ve zdroji
openai/gpt-oss-120b
Záznam
openrouter.json
Původní hodnota
11.6
Původní zdroj ↗ · Zdroj převzetí ↗
Epoch · vlastní běh

GPQA Diamond

Effort: high · Měřeno: 2025-12-11

75,76 %
Pořadí ve zdrojovém snapshotu23. z 26 modelůPořadí všech dostupných řádků ve zdrojovém snapshotu. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Verze testu není v exportu jednoznačná Úplná konfigurace běhu není ověřena

Model ve zdroji
openai/gpt-oss-120b_high
Záznam
gpqa_diamond.csv: řádek 177
Původní hodnota
0.7575757575757576 · převod × 100
Původní zdroj ↗ · Zdroj převzetí ↗
Artificial Analysis přes OpenRouter

AA Agentic Index

Měřeno: datum neuvedeno

3,7
Střední pásmo62. z 94 modelůPořadí publikovaných hodnot. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Převzato z OpenRouteru; verze indexu, effort a datum měření nejsou v API uvedeny.

Model ve zdroji
openai/gpt-oss-120b
Záznam
openrouter.json
Původní hodnota
3.7
Původní zdroj ↗ · Zdroj převzetí ↗
Epoch · převzatý běh

APEX Agents

Měřeno: datum neuvedeno

4,4 %
Pořadí ve zdrojovém snapshotu22. z 22 modelůPořadí všech dostupných řádků ve zdrojovém snapshotu. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Datum měření není uvedeno Verze testu není v exportu jednoznačná Effort není doložen Úplná konfigurace běhu není ověřena

GPT-OSS-120B

Model ve zdroji
gpt-oss-120b
Záznam
apex_agents_external.csv: řádek 34
Původní hodnota
0.044000000000000004 · převod × 100
Původní zdroj ↗ · Zdroj převzetí ↗
Design Arena přes OpenRouter

Design Arena · 3d

Měřeno: datum neuvedeno

924 Elo
Nižší výsledek94. z 100 modelů · sdílené pořadíPořadí publikovaných hodnot. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Elo preferencí designu; není obecným skóre programování. Datum měření a velikost vzorku API neuvádí.

Model ve zdroji
openai/gpt-oss-120b
Záznam
openrouter.json
Původní hodnota
924.0
Původní zdroj ↗ · Zdroj převzetí ↗
Design Arena přes OpenRouter

Design Arena · codecategories

Měřeno: datum neuvedeno

972 Elo
Nižší výsledek102. z 108 modelů · sdílené pořadíPořadí publikovaných hodnot. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Elo preferencí designu; není obecným skóre programování. Datum měření a velikost vzorku API neuvádí.

Model ve zdroji
openai/gpt-oss-120b
Záznam
openrouter.json
Původní hodnota
972.0
Původní zdroj ↗ · Zdroj převzetí ↗
Design Arena přes OpenRouter

Design Arena · dataviz

Měřeno: datum neuvedeno

997 Elo
Nižší výsledek97. z 106 modelůPořadí publikovaných hodnot. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Elo preferencí designu; není obecným skóre programování. Datum měření a velikost vzorku API neuvádí.

Model ve zdroji
openai/gpt-oss-120b
Záznam
openrouter.json
Původní hodnota
997.0
Původní zdroj ↗ · Zdroj převzetí ↗
Design Arena přes OpenRouter

Design Arena · gamedev

Měřeno: datum neuvedeno

1 008 Elo
Nižší výsledek94. z 108 modelůPořadí publikovaných hodnot. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Elo preferencí designu; není obecným skóre programování. Datum měření a velikost vzorku API neuvádí.

Model ve zdroji
openai/gpt-oss-120b
Záznam
openrouter.json
Původní hodnota
1008.0
Původní zdroj ↗ · Zdroj převzetí ↗
Design Arena přes OpenRouter

Design Arena · uicomponent

Měřeno: datum neuvedeno

935 Elo
Nižší výsledek99. z 104 modelůPořadí publikovaných hodnot. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Elo preferencí designu; není obecným skóre programování. Datum měření a velikost vzorku API neuvádí.

Model ve zdroji
openai/gpt-oss-120b
Záznam
openrouter.json
Původní hodnota
935.0
Původní zdroj ↗ · Zdroj převzetí ↗
Design Arena přes OpenRouter

Design Arena · website

Měřeno: datum neuvedeno

976 Elo
Nižší výsledek106. z 115 modelůPořadí publikovaných hodnot. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Elo preferencí designu; není obecným skóre programování. Datum měření a velikost vzorku API neuvádí.

Model ve zdroji
openai/gpt-oss-120b
Záznam
openrouter.json
Původní hodnota
976.0
Původní zdroj ↗ · Zdroj převzetí ↗

Kolik stojí používání

Střední cenové pásmo245. z 331 modelů · sdílené pořadí od nejdražšího

0,27 USD za srovnávací koš

0,34× medián · medián 0,8 USD. Srovnání 331 modelů celého katalogu s použitelnou standardní API sazbou a dostatečným kontextem.

gpt-oss-120b
NejdražšíVyšší cenaStředNízká cena

100 požadavků, každý s 10 000 vstupními tokeny. Výstup podle zvoleného poměru. Základní textové API včetně případného poplatku za požadavek; nejde o cenu úspěšně vyřešené úlohy.

Co za své peníze získáte jinde

Blízký index = rozdíl nejvýše 3 body. Podobná cena = ±20 % koše. Pokud blízký index levněji chybí, ukazujeme nejbližší nižší index s úsporou. Výběr z celého katalogu; jde o publikovaný AA index s neúplnou metodikou.

Vyšší index za podobnou cenu

Hy3 preview

Příplatek 0,03 USD za koš · Coding Index 58,8 (+28,4 bodu proti tomuto modelu).

Karta modelu →

USD za milion tokenů. Nabídky a pásma z OpenRouteru; ceny předplatného aplikací zde nejsou.

NabídkaTokenové sazbyČtení cache
Standardní APIopenai/gpt-oss-120b$0,15$0,6$0,075
Batchopenai/gpt-oss-120b:batch$0,0296$0,136—
Vstupní modality
text
Volání nástrojů
Ano
Do katalogu přidán
2025-08-05
Znalostní cutoff
2024-06-30
Kanonická verze
openai/gpt-oss-120b
Otevřít nabídku na OpenRouteru ↗

Co zvážit vedle tohoto modelu

Blízkost výstupní ceny, publikovaného AA Coding Indexu (kde je) a zaměření v popisu. Kandidáti z aktuálního katalogu se stejnými výstupními modalitami; nejde o pořadí kvality. Cenové rozdíly níže platí pro základní standardní API sazbu.

Další modely od OpenAI

Co jsme o modelu napsali

K tomuto modelu zatím nemáme spárovanou redakční analýzu. Karta vznikla nezávisle na článcích.

Charakteristika vznikla automaticky z parametrů a popisu OpenRouteru. Benchmarky jsou převzaté výsledky s uvedenými zdroji; redakční zkušenosti jsou oddělené v analýzách.