Vibecoding.cz Patrick Zandl o AI vývoji
Reklama
V nabídce OpenRouteru · OpenAI

gpt-oss-20b

openai/gpt-oss-20b

Porovnat model ↗

gpt-oss-20b od OpenAI nabízí kontext 131 072 tokenů. OpenRouter u něj uvádí AA Coding Index 20.7; jde o převzatý index s neuvedenou konfigurací, nikoli vlastní test.

NástrojeHF repozitář
Vstup / 1M tokenů$0,018
Výstup / 1M tokenů$0,09
Kontext131,1 k
Čeština

Zatím bez vlastního měření. Obecný jazykový benchmark nepovažujeme za test češtiny.

Popis z OpenRouteru v původním znění

gpt-oss-20b is an open-weight 21B parameter model released by OpenAI under the Apache 2.0 license. It uses a Mixture-of-Experts (MoE) architecture with 3.6B active parameters per forward pass, optimized for...

OpenRouter ↗

Co ukazují výsledky

Publikovaný index99. z 126 modelů

Publikovaný AA Coding Index

Leží ve spodních 25 % zveřejněných hodnot AA Coding Indexu v celém načteném katalogu OpenRouteru. Hodnota modelu: 20,7.

gpt-oss-20b
Nejvyšší indexyVyšší indexyStředNižší indexy

Pořadí publikovaných indexů, nikoli závěr vlastního testu. API neuvádí verzi indexu ani effort; první místo neznamená nejlepší model pro každou programovací úlohu.

Publikované výsledky, nikoli vlastní měření. Každý záznam zachovává svou konfiguraci. Neúplně popsané běhy nezakládají pořadí kvality.

Všechny dostupné výsledky; pořadí je pouze ze zdrojového snapshotu, pokud je uvedeno.
BenchmarkVýsledekPořadíNápověda
AA Coding Indexopenai/gpt-oss-20b20,7—
ⓘ

OpenRouter publikuje tuto hodnotu indexu. Použitou revizi metodiky a konfiguraci zde neuvádí. Popis dostupnosti indexu není výkladem neznámé revize jeho metodiky.

SciCodegpt-oss-20b_high34,38 %19/20
ⓘ

Tvorba kódu pro vědecké výzkumné problémy. Úzká oblast; konkrétní měření AA a obecná definice datasetu mají oddělený původ.

Terminal-Benchgpt-oss-20b3,4 %12/13
ⓘ

Benchmark agentní práce; konkrétní úlohy a verze se musí ověřit u daného běhu. Současná homepage popisuje jinou revizi; nepřiřazuje verzi historickým řádkům.

Terminal-Benchgpt-oss-20b3,1 %32/33
ⓘ

Benchmark agentní práce; konkrétní úlohy a verze se musí ověřit u daného běhu. Současná homepage popisuje jinou revizi; nepřiřazuje verzi historickým řádkům.

Terminal-Benchgpt-oss-20b_unknown3,37 %13/13
ⓘ

Benchmark agentní práce; konkrétní úlohy a verze se musí ověřit u daného běhu. Současná homepage popisuje jinou revizi; nepřiřazuje verzi historickým řádkům.

Terminal-Benchgpt-oss-20b_unknown3,07 %33/33
ⓘ

Benchmark agentní práce; konkrétní úlohy a verze se musí ověřit u daného běhu. Současná homepage popisuje jinou revizi; nepřiřazuje verzi historickým řádkům.

AA Intelligence Indexopenai/gpt-oss-20b9—
ⓘ

Soubor především textových úloh v angličtině; není testem češtiny. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.

GPQA Diamondgpt-oss-20b_high45,96 %26/26
ⓘ

Výsledky znalostního benchmarku GPQA; nejde o programovací úlohy. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.

GPQA Diamondgpt-oss-20b_low53,16 %22/22
ⓘ

Výsledky znalostního benchmarku GPQA; nejde o programovací úlohy. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.

GPQA Diamondgpt-oss-20b_medium60,8 %12/12
ⓘ

Výsledky znalostního benchmarku GPQA; nejde o programovací úlohy. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.

AA Agentic Indexopenai/gpt-oss-20b1,2—
ⓘ

OpenRouter publikuje tuto hodnotu indexu. Použitou revizi metodiky a konfiguraci zde neuvádí. Popis dostupnosti indexu není výkladem neznámé revize jeho metodiky.

Design Arena · datavizopenai/gpt-oss-20b942 Elo—
ⓘ

Hodnocení designu vytvořeného AI komunitou; oddělujeme jednotlivé kategorie. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.

Design Arena · websiteopenai/gpt-oss-20b860 Elo—
ⓘ

Hodnocení designu vytvořeného AI komunitou; oddělujeme jednotlivé kategorie. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.

Artificial Analysis přes OpenRouter

AA Coding Index

Měřeno: datum neuvedeno

20,7
Nižší výsledek99. z 126 modelůPořadí publikovaných hodnot. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Převzato z OpenRouteru; verze indexu, effort a datum měření nejsou v API uvedeny.

Model ve zdroji
openai/gpt-oss-20b
Záznam
openrouter.json
Původní hodnota
20.7
Původní zdroj ↗ · Zdroj převzetí ↗
Epoch · převzatý běh

SciCode

Effort: high · Měřeno: datum neuvedeno

34,38 %
Pořadí ve zdrojovém snapshotu19. z 20 modelůPořadí všech dostupných řádků ve zdrojovém snapshotu. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Datum měření není uvedeno Verze testu není v exportu jednoznačná Úplná konfigurace běhu není ověřena

gpt-oss-20B (high)

Model ve zdroji
gpt-oss-20b_high
Záznam
scicode_external.csv: řádek 36
Původní hodnota
0.34375 · převod × 100
Původní zdroj ↗ · Zdroj převzetí ↗
Epoch · převzatý běh

Terminal-Bench

Agent: Mini-SWE-Agent · Verze: 2.0 · Měřeno: 2025-11-03

3,4 %
Pořadí ve zdrojovém snapshotu12. z 13 modelůPořadí všech dostupných řádků ve zdrojovém snapshotu. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Effort není doložen Úplná konfigurace běhu není ověřena

Model ve zdroji
gpt-oss-20b
Záznam
terminalbench_external.csv: řádek 202
Původní hodnota
0.034 · převod × 100
Původní zdroj ↗ · Zdroj převzetí ↗
Epoch · převzatý běh

Terminal-Bench

Agent: Terminus 2 · Verze: 2.0 · Měřeno: 2025-11-01

3,1 %
Pořadí ve zdrojovém snapshotu32. z 33 modelůPořadí všech dostupných řádků ve zdrojovém snapshotu. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Effort není doložen Úplná konfigurace běhu není ověřena

Model ve zdroji
gpt-oss-20b
Záznam
terminalbench_external.csv: řádek 204
Původní hodnota
0.031 · převod × 100
Původní zdroj ↗ · Zdroj převzetí ↗
Epoch · převzatý běh

Terminal-Bench

Agent: Mini-SWE-Agent · Verze: 2.0 · Měřeno: 2025-08-05

3,37 %
Pořadí ve zdrojovém snapshotu13. z 13 modelůPořadí všech dostupných řádků ve zdrojovém snapshotu. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Effort není doložen Úplná konfigurace běhu není ověřena

GPT-OSS-20B

Model ve zdroji
gpt-oss-20b_unknown
Záznam
terminalbench_external.csv: řádek 203
Původní hodnota
0.033707865169 · převod × 100
Původní zdroj ↗ · Zdroj převzetí ↗
Epoch · převzatý běh

Terminal-Bench

Agent: Terminus 2 · Verze: 2.0 · Měřeno: 2025-08-05

3,07 %
Pořadí ve zdrojovém snapshotu33. z 33 modelůPořadí všech dostupných řádků ve zdrojovém snapshotu. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Effort není doložen Úplná konfigurace běhu není ověřena

GPT-OSS-20B

Model ve zdroji
gpt-oss-20b_unknown
Záznam
terminalbench_external.csv: řádek 205
Původní hodnota
0.030711610487 · převod × 100
Původní zdroj ↗ · Zdroj převzetí ↗
Dalších 7 výsledků a konfigurací
Artificial Analysis přes OpenRouter

AA Intelligence Index

Měřeno: datum neuvedeno

9
Nižší výsledek84. z 92 modelůPořadí publikovaných hodnot. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Převzato z OpenRouteru; verze indexu, effort a datum měření nejsou v API uvedeny.

Model ve zdroji
openai/gpt-oss-20b
Záznam
openrouter.json
Původní hodnota
9.0
Původní zdroj ↗ · Zdroj převzetí ↗
Epoch · vlastní běh

GPQA Diamond

Effort: high · Měřeno: 2026-08-06

45,96 %
Pořadí ve zdrojovém snapshotu26. z 26 modelůPořadí všech dostupných řádků ve zdrojovém snapshotu. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Verze testu není v exportu jednoznačná Úplná konfigurace běhu není ověřena

Model ve zdroji
gpt-oss-20b_high
Záznam
gpqa_diamond.csv: řádek 100
Původní hodnota
0.4595959595959596 · převod × 100
Původní zdroj ↗ · Zdroj převzetí ↗
Epoch · vlastní běh

GPQA Diamond

Effort: low · Měřeno: 2026-08-27

53,16 %
Pořadí ve zdrojovém snapshotu22. z 22 modelůPořadí všech dostupných řádků ve zdrojovém snapshotu. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Verze testu není v exportu jednoznačná Úplná konfigurace běhu není ověřena

Model ve zdroji
gpt-oss-20b_low
Záznam
gpqa_diamond.csv: řádek 46
Původní hodnota
0.5315656565656566 · převod × 100
Původní zdroj ↗ · Zdroj převzetí ↗
Epoch · vlastní běh

GPQA Diamond

Effort: medium · Měřeno: 2026-08-27

60,8 %
Pořadí ve zdrojovém snapshotu12. z 12 modelůPořadí všech dostupných řádků ve zdrojovém snapshotu. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Verze testu není v exportu jednoznačná Úplná konfigurace běhu není ověřena

Model ve zdroji
gpt-oss-20b_medium
Záznam
gpqa_diamond.csv: řádek 45
Původní hodnota
0.6079545454545454 · převod × 100
Původní zdroj ↗ · Zdroj převzetí ↗
Artificial Analysis přes OpenRouter

AA Agentic Index

Měřeno: datum neuvedeno

1,2
Nižší výsledek73. z 94 modelůPořadí publikovaných hodnot. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Převzato z OpenRouteru; verze indexu, effort a datum měření nejsou v API uvedeny.

Model ve zdroji
openai/gpt-oss-20b
Záznam
openrouter.json
Původní hodnota
1.2
Původní zdroj ↗ · Zdroj převzetí ↗
Design Arena přes OpenRouter

Design Arena · dataviz

Měřeno: datum neuvedeno

942 Elo
Nižší výsledek100. z 106 modelůPořadí publikovaných hodnot. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Elo preferencí designu; není obecným skóre programování. Datum měření a velikost vzorku API neuvádí.

Model ve zdroji
openai/gpt-oss-20b
Záznam
openrouter.json
Původní hodnota
942.0
Původní zdroj ↗ · Zdroj převzetí ↗
Design Arena přes OpenRouter

Design Arena · website

Měřeno: datum neuvedeno

860 Elo
Nižší výsledek112. z 116 modelůPořadí publikovaných hodnot. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Elo preferencí designu; není obecným skóre programování. Datum měření a velikost vzorku API neuvádí.

Model ve zdroji
openai/gpt-oss-20b
Záznam
openrouter.json
Původní hodnota
860.0
Původní zdroj ↗ · Zdroj převzetí ↗

Kolik stojí používání

Nízká cena325. z 331 modelů od nejdražšího

0,04 USD za srovnávací koš

0,04× medián · medián 0,8 USD. Srovnání 331 modelů celého katalogu s použitelnou standardní API sazbou a dostatečným kontextem.

gpt-oss-20b
NejdražšíVyšší cenaStředNízká cena

100 požadavků, každý s 10 000 vstupními tokeny. Výstup podle zvoleného poměru. Základní textové API včetně případného poplatku za požadavek; nejde o cenu úspěšně vyřešené úlohy.

Co za své peníze získáte jinde

Blízký index = rozdíl nejvýše 3 body. Podobná cena = ±20 % koše. Pokud blízký index levněji chybí, ukazujeme nejbližší nižší index s úsporou. Výběr z celého katalogu; jde o publikovaný AA index s neúplnou metodikou.

USD za milion tokenů. Nabídky a pásma z OpenRouteru; ceny předplatného aplikací zde nejsou.

NabídkaTokenové sazbyČtení cache
Standardní APIopenai/gpt-oss-20b$0,018$0,09—
Batchopenai/gpt-oss-20b:batch$0,024$0,112—
Vstupní modality
text
Volání nástrojů
Ano
Do katalogu přidán
2025-08-05
Znalostní cutoff
2024-06-30
Kanonická verze
openai/gpt-oss-20b
Otevřít nabídku na OpenRouteru ↗

Co zvážit vedle tohoto modelu

Blízkost výstupní ceny, publikovaného AA Coding Indexu (kde je) a zaměření v popisu. Kandidáti z aktuálního katalogu se stejnými výstupními modalitami; nejde o pořadí kvality. Cenové rozdíly níže platí pro základní standardní API sazbu.

Další modely od OpenAI

Co jsme o modelu napsali

K tomuto modelu zatím nemáme spárovanou redakční analýzu. Karta vznikla nezávisle na článcích.

Charakteristika vznikla automaticky z parametrů a popisu OpenRouteru. Benchmarky jsou převzaté výsledky s uvedenými zdroji; redakční zkušenosti jsou oddělené v analýzách.