Vibecoding.cz Patrick Zandl o AI vývoji
V nabídce OpenRouteru · Anthropic

Claude Opus 5

anthropic/claude-opus-5

Porovnat model ↗

Claude Opus 5 od Anthropic nabízí kontext 1 000 000 tokenů. Popis v katalogu jej zaměřuje na programování, práce s nástroji a agenty, analytické úlohy. OpenRouter u něj uvádí AA Coding Index 78; jde o převzatý index s neuvedenou konfigurací, nikoli vlastní test.

Obrazový vstupNástroje
Vstup / 1M tokenů$5
Výstup / 1M tokenů$25
Kontext1 M
Čeština

Zatím bez vlastního měření. Obecný jazykový benchmark nepovažujeme za test češtiny.

Čtěte také: Claude Opus 5: nejchytřejší model co si nejvíc vymýšlí →
Popis z OpenRouteru v původním znění

Claude Opus 5 is Anthropic’s flagship model for demanding reasoning, coding, and long-horizon agentic work. It is particularly strong at end-to-end software tasks, code review and bug finding, visual analysis...

OpenRouter ↗

Co ukazují výsledky

Publikovaný index2. z 126 modelů

Publikovaný AA Coding Index

Patří do nejlepších 10 % zveřejněných hodnot AA Coding Indexu v celém načteném katalogu OpenRouteru. Hodnota modelu: 78.

Claude Opus 5
Nejvyšší indexyVyšší indexyStředNižší indexy

Nejbližší konkurenti podle Coding Indexu

Pořadí publikovaných indexů, nikoli závěr vlastního testu. API neuvádí verzi indexu ani effort; první místo neznamená nejlepší model pro každou programovací úlohu.

Publikované výsledky, nikoli vlastní měření. Každý záznam zachovává svou konfiguraci. Neúplně popsané běhy nezakládají pořadí kvality.

Všechny dostupné výsledky; pořadí je pouze ze zdrojového snapshotu, pokud je uvedeno.
BenchmarkVýsledekPořadíNápověda
AA Coding Indexanthropic/claude-opus-578

OpenRouter publikuje tuto hodnotu indexu. Použitou revizi metodiky a konfiguraci zde neuvádí. Popis dostupnosti indexu není výkladem neznámé revize jeho metodiky.

CursorBenchclaude-opus-5_high66,7 %4/17

Nejednoznačné úlohy přes více souborů z reálného používání Cursoru. Měří běh v prostředí Cursoru, ne samostatný model v libovolném nástroji.

CursorBenchclaude-opus-5_low62,8 %2/14

Nejednoznačné úlohy přes více souborů z reálného používání Cursoru. Měří běh v prostředí Cursoru, ne samostatný model v libovolném nástroji.

CursorBenchclaude-opus-5_max70 %3/12

Nejednoznačné úlohy přes více souborů z reálného používání Cursoru. Měří běh v prostředí Cursoru, ne samostatný model v libovolném nástroji.

CursorBenchclaude-opus-5_medium64,3 %5/15

Nejednoznačné úlohy přes více souborů z reálného používání Cursoru. Měří běh v prostředí Cursoru, ne samostatný model v libovolném nástroji.

CursorBenchclaude-opus-5_xhigh69,3 %3/11

Nejednoznačné úlohy přes více souborů z reálného používání Cursoru. Měří běh v prostředí Cursoru, ne samostatný model v libovolném nástroji.

DeepSWEclaude-opus-573,65 %

Výsledek řešení softwarových úloh v jednotném agentním prostředí. Neprokazuje stejný výkon v jiném agentu ani kvalitu češtiny.

DeepSWEclaude-opus-573,15 %

Výsledek řešení softwarových úloh v jednotném agentním prostředí. Neprokazuje stejný výkon v jiném agentu ani kvalitu češtiny.

DeepSWEclaude-opus-572,83 %

Výsledek řešení softwarových úloh v jednotném agentním prostředí. Neprokazuje stejný výkon v jiném agentu ani kvalitu češtiny.

DeepSWEclaude-opus-568,9 %

Výsledek řešení softwarových úloh v jednotném agentním prostředí. Neprokazuje stejný výkon v jiném agentu ani kvalitu češtiny.

DeepSWEclaude-opus-558,13 %

Výsledek řešení softwarových úloh v jednotném agentním prostředí. Neprokazuje stejný výkon v jiném agentu ani kvalitu češtiny.

FrontierCodeclaude-opus-5_max53,38 %1/2

Hodnotí kvalitu změn kódu pro produkční repozitáře. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.

SciCodeclaude-opus-5_high54,28 %6/20

Tvorba kódu pro vědecké výzkumné problémy. Úzká oblast; konkrétní měření AA a obecná definice datasetu mají oddělený původ.

SciCodeclaude-opus-5_low48,03 %10/13

Tvorba kódu pro vědecké výzkumné problémy. Úzká oblast; konkrétní měření AA a obecná definice datasetu mají oddělený původ.

SciCodeclaude-opus-5_max55,67 %7/20

Tvorba kódu pro vědecké výzkumné problémy. Úzká oblast; konkrétní měření AA a obecná definice datasetu mají oddělený původ.

SciCodeclaude-opus-5_medium50,69 %8/11

Tvorba kódu pro vědecké výzkumné problémy. Úzká oblast; konkrétní měření AA a obecná definice datasetu mají oddělený původ.

SciCodeclaude-opus-5_xhigh54,98 %6/13

Tvorba kódu pro vědecké výzkumné problémy. Úzká oblast; konkrétní měření AA a obecná definice datasetu mají oddělený původ.

AA Intelligence Indexanthropic/claude-opus-550,7

Soubor především textových úloh v angličtině; není testem češtiny. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.

GPQA Diamondclaude-opus-592,93 %1/69

Výsledky znalostního benchmarku GPQA; nejde o programovací úlohy. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.

GPQA Diamondclaude-opus-5_low87,88 %5/22

Výsledky znalostního benchmarku GPQA; nejde o programovací úlohy. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.

GPQA Diamondclaude-opus-5_max93,88 %2/18

Výsledky znalostního benchmarku GPQA; nejde o programovací úlohy. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.

ProofBenchclaude-opus-5_max99 %2/14

Význam benchmarku není v registru popsán. Podmínky zdroje je třeba ověřit u konkrétního běhu.

AA Agentic Indexanthropic/claude-opus-556,2

OpenRouter publikuje tuto hodnotu indexu. Použitou revizi metodiky a konfiguraci zde neuvádí. Popis dostupnosti indexu není výkladem neznámé revize jeho metodiky.

APEX Agentsclaude-opus-5_max43,5 %1/5

Význam benchmarku není v registru popsán. Podmínky zdroje je třeba ověřit u konkrétního běhu.

OSWorld 2claude-opus-5_high28,98 %1/1

Význam benchmarku není v registru popsán. Podmínky zdroje je třeba ověřit u konkrétního běhu.

OSWorld 2claude-opus-5_low22,32 %1/1

Význam benchmarku není v registru popsán. Podmínky zdroje je třeba ověřit u konkrétního běhu.

OSWorld 2claude-opus-5_max31,43 %1/7

Význam benchmarku není v registru popsán. Podmínky zdroje je třeba ověřit u konkrétního běhu.

OSWorld 2claude-opus-5_medium25,33 %1/2

Význam benchmarku není v registru popsán. Podmínky zdroje je třeba ověřit u konkrétního běhu.

OSWorld 2claude-opus-5_xhigh30,21 %1/2

Význam benchmarku není v registru popsán. Podmínky zdroje je třeba ověřit u konkrétního běhu.

Design Arena · Frontend Web AppClaude Opus 51 284 Elo4/40

Hodnocení designu vytvořeného AI komunitou; oddělujeme jednotlivé kategorie. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.

Design Arena · agenticgamedevanthropic/claude-opus-51 266 Elo

Hodnocení designu vytvořeného AI komunitou; oddělujeme jednotlivé kategorie. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.

Design Arena · androidnativeanthropic/claude-opus-51 271 Elo

Hodnocení designu vytvořeného AI komunitou; oddělujeme jednotlivé kategorie. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.

Design Arena · fullstackanthropic/claude-opus-51 352 Elo

Hodnocení designu vytvořeného AI komunitou; oddělujeme jednotlivé kategorie. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.

Design Arena · mobileappsanthropic/claude-opus-51 348 Elo

Hodnocení designu vytvořeného AI komunitou; oddělujeme jednotlivé kategorie. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.

Design Arena · python-pptxslidesanthropic/claude-opus-51 261 Elo

Hodnocení designu vytvořeného AI komunitou; oddělujeme jednotlivé kategorie. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.

Design Arena · webappsanthropic/claude-opus-51 282 Elo

Hodnocení designu vytvořeného AI komunitou; oddělujeme jednotlivé kategorie. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.

Design Arena · 3danthropic/claude-opus-51 368 Elo

Hodnocení designu vytvořeného AI komunitou; oddělujeme jednotlivé kategorie. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.

Design Arena · asciiartanthropic/claude-opus-51 380 Elo

Hodnocení designu vytvořeného AI komunitou; oddělujeme jednotlivé kategorie. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.

Design Arena · codecategoriesanthropic/claude-opus-51 341 Elo

Hodnocení designu vytvořeného AI komunitou; oddělujeme jednotlivé kategorie. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.

Design Arena · datavizanthropic/claude-opus-51 355 Elo

Hodnocení designu vytvořeného AI komunitou; oddělujeme jednotlivé kategorie. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.

Design Arena · gamedevanthropic/claude-opus-51 366 Elo

Hodnocení designu vytvořeného AI komunitou; oddělujeme jednotlivé kategorie. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.

Design Arena · svganthropic/claude-opus-51 351 Elo

Hodnocení designu vytvořeného AI komunitou; oddělujeme jednotlivé kategorie. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.

Design Arena · uicomponentanthropic/claude-opus-51 366 Elo

Hodnocení designu vytvořeného AI komunitou; oddělujeme jednotlivé kategorie. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.

Design Arena · websiteanthropic/claude-opus-51 322 Elo

Hodnocení designu vytvořeného AI komunitou; oddělujeme jednotlivé kategorie. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.

Artificial Analysis přes OpenRouter

AA Coding Index

Měřeno: datum neuvedeno

78
Špička2. z 126 modelůPořadí publikovaných hodnot. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Převzato z OpenRouteru; verze indexu, effort a datum měření nejsou v API uvedeny.

Model ve zdroji
anthropic/claude-opus-5
Záznam
openrouter.json
Původní hodnota
78.0
Původní zdroj ↗ · Zdroj převzetí ↗
Epoch · převzatý běh

CursorBench

Agent: Cursor · Effort: high · Měřeno: datum neuvedeno

66,7 %
Pořadí ve zdrojovém snapshotu4. z 17 modelůPořadí všech dostupných řádků ve zdrojovém snapshotu. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Datum měření není uvedeno Verze testu není v exportu jednoznačná Úplná konfigurace běhu není ověřena

Opus 5 High

Model ve zdroji
claude-opus-5_high
Záznam
cursorbench_external.csv: řádek 32
Původní hodnota
0.667 · převod × 100
Původní zdroj ↗ · Zdroj převzetí ↗
Epoch · převzatý běh

CursorBench

Agent: Cursor · Effort: low · Měřeno: datum neuvedeno

62,8 %
Pořadí ve zdrojovém snapshotu2. z 14 modelůPořadí všech dostupných řádků ve zdrojovém snapshotu. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Datum měření není uvedeno Verze testu není v exportu jednoznačná Úplná konfigurace běhu není ověřena

Opus 5 Low

Model ve zdroji
claude-opus-5_low
Záznam
cursorbench_external.csv: řádek 41
Původní hodnota
0.628 · převod × 100
Původní zdroj ↗ · Zdroj převzetí ↗
Epoch · převzatý běh

CursorBench

Agent: Cursor · Effort: max · Měřeno: datum neuvedeno

70 %
Pořadí ve zdrojovém snapshotu3. z 12 modelůPořadí všech dostupných řádků ve zdrojovém snapshotu. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Datum měření není uvedeno Verze testu není v exportu jednoznačná Úplná konfigurace běhu není ověřena

Opus 5 Max

Model ve zdroji
claude-opus-5_max
Záznam
cursorbench_external.csv: řádek 30
Původní hodnota
0.7000000000000001 · převod × 100
Původní zdroj ↗ · Zdroj převzetí ↗
Epoch · převzatý běh

CursorBench

Agent: Cursor · Effort: medium · Měřeno: datum neuvedeno

64,3 %
Pořadí ve zdrojovém snapshotu5. z 15 modelůPořadí všech dostupných řádků ve zdrojovém snapshotu. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Datum měření není uvedeno Verze testu není v exportu jednoznačná Úplná konfigurace běhu není ověřena

Opus 5 Medium

Model ve zdroji
claude-opus-5_medium
Záznam
cursorbench_external.csv: řádek 39
Původní hodnota
0.643 · převod × 100
Původní zdroj ↗ · Zdroj převzetí ↗
Epoch · převzatý běh

CursorBench

Agent: Cursor · Effort: xhigh · Měřeno: datum neuvedeno

69,3 %
Pořadí ve zdrojovém snapshotu3. z 11 modelůPořadí všech dostupných řádků ve zdrojovém snapshotu. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Datum měření není uvedeno Verze testu není v exportu jednoznačná Úplná konfigurace běhu není ověřena

Opus 5 Extra High

Model ve zdroji
claude-opus-5_xhigh
Záznam
cursorbench_external.csv: řádek 31
Původní hodnota
0.693 · převod × 100
Původní zdroj ↗ · Zdroj převzetí ↗
Dalších 38 výsledků a konfigurací
Epoch · vlastní běh

DeepSWE

Agent: mini-swe-agent · Effort: max · Verze: 1.1 · Měřeno: datum neuvedeno

73,65 %

Pořadí ve zdroji není uvedeno.

Podmínky a zdroj výsledku

Datum jednotlivého běhu a číslo verze balíčku agenta zdroj neuvádí. Pořadí závisí na konfiguraci; stejný effort různých dodavatelů není stejný rozpočet.

Model ve zdroji
claude-opus-5
Záznam
deepswe.json
Původní hodnota
0.7364864864864865 · převod × 100
Původní zdroj ↗ · Zdroj převzetí ↗
Epoch · vlastní běh

DeepSWE

Agent: mini-swe-agent · Effort: xhigh · Verze: 1.1 · Měřeno: datum neuvedeno

73,15 %

Pořadí ve zdroji není uvedeno.

Podmínky a zdroj výsledku

Datum jednotlivého běhu a číslo verze balíčku agenta zdroj neuvádí. Pořadí závisí na konfiguraci; stejný effort různých dodavatelů není stejný rozpočet.

Model ve zdroji
claude-opus-5
Záznam
deepswe.json
Původní hodnota
0.7315436241610739 · převod × 100
Původní zdroj ↗ · Zdroj převzetí ↗
Epoch · vlastní běh

DeepSWE

Agent: mini-swe-agent · Effort: high · Verze: 1.1 · Měřeno: datum neuvedeno

72,83 %

Pořadí ve zdroji není uvedeno.

Podmínky a zdroj výsledku

Datum jednotlivého běhu a číslo verze balíčku agenta zdroj neuvádí. Pořadí závisí na konfiguraci; stejný effort různých dodavatelů není stejný rozpočet.

Model ve zdroji
claude-opus-5
Záznam
deepswe.json
Původní hodnota
0.7282850779510023 · převod × 100
Původní zdroj ↗ · Zdroj převzetí ↗
Epoch · vlastní běh

DeepSWE

Agent: mini-swe-agent · Effort: medium · Verze: 1.1 · Měřeno: datum neuvedeno

68,9 %

Pořadí ve zdroji není uvedeno.

Podmínky a zdroj výsledku

Datum jednotlivého běhu a číslo verze balíčku agenta zdroj neuvádí. Pořadí závisí na konfiguraci; stejný effort různých dodavatelů není stejný rozpočet.

Model ve zdroji
claude-opus-5
Záznam
deepswe.json
Původní hodnota
0.6890380313199105 · převod × 100
Původní zdroj ↗ · Zdroj převzetí ↗
Epoch · vlastní běh

DeepSWE

Agent: mini-swe-agent · Effort: low · Verze: 1.1 · Měřeno: datum neuvedeno

58,13 %

Pořadí ve zdroji není uvedeno.

Podmínky a zdroj výsledku

Datum jednotlivého běhu a číslo verze balíčku agenta zdroj neuvádí. Pořadí závisí na konfiguraci; stejný effort různých dodavatelů není stejný rozpočet.

Model ve zdroji
claude-opus-5
Záznam
deepswe.json
Původní hodnota
0.5812917594654788 · převod × 100
Původní zdroj ↗ · Zdroj převzetí ↗
Epoch · převzatý běh

FrontierCode

Agent: claude-code · Effort: medium · Měřeno: datum neuvedeno

53,38 %
Malý vzorek — bez výkonové třídy1. z 2 modelůPořadí všech dostupných řádků ve zdrojovém snapshotu. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Datum měření není uvedeno Verze testu není v exportu jednoznačná Rozpor ve zdroji: effort přebíráme ze sloupce Reasoning effort; sufix názvu modelu uvádí jinou hodnotu. Úplná konfigurace běhu není ověřena

Claude Opus 5

Model ve zdroji
claude-opus-5_max
Záznam
frontiercode_external.csv: řádek 3
Původní hodnota
0.5338 · převod × 100
Původní zdroj ↗ · Zdroj převzetí ↗
Epoch · převzatý běh

SciCode

Effort: high · Měřeno: datum neuvedeno

54,28 %
Pořadí ve zdrojovém snapshotu6. z 20 modelůPořadí všech dostupných řádků ve zdrojovém snapshotu. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Datum měření není uvedeno Verze testu není v exportu jednoznačná Úplná konfigurace běhu není ověřena

Claude Opus 5 (Adaptive Reasoning, High Effort)

Model ve zdroji
claude-opus-5_high
Záznam
scicode_external.csv: řádek 74
Původní hodnota
0.542824074074074 · převod × 100
Původní zdroj ↗ · Zdroj převzetí ↗
Epoch · převzatý běh

SciCode

Effort: low · Měřeno: datum neuvedeno

48,03 %
Pořadí ve zdrojovém snapshotu10. z 13 modelůPořadí všech dostupných řádků ve zdrojovém snapshotu. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Datum měření není uvedeno Verze testu není v exportu jednoznačná Úplná konfigurace běhu není ověřena

Claude Opus 5 (Adaptive Reasoning, Low Effort)

Model ve zdroji
claude-opus-5_low
Záznam
scicode_external.csv: řádek 76
Původní hodnota
0.48032407407407407 · převod × 100
Původní zdroj ↗ · Zdroj převzetí ↗
Epoch · převzatý běh

SciCode

Effort: max · Měřeno: datum neuvedeno

55,67 %
Pořadí ve zdrojovém snapshotu7. z 20 modelůPořadí všech dostupných řádků ve zdrojovém snapshotu. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Datum měření není uvedeno Verze testu není v exportu jednoznačná Úplná konfigurace běhu není ověřena

Claude Opus 5 (Adaptive Reasoning, Max Effort)

Model ve zdroji
claude-opus-5_max
Záznam
scicode_external.csv: řádek 72
Původní hodnota
0.556712962962963 · převod × 100
Původní zdroj ↗ · Zdroj převzetí ↗
Epoch · převzatý běh

SciCode

Effort: medium · Měřeno: datum neuvedeno

50,69 %
Pořadí ve zdrojovém snapshotu8. z 11 modelůPořadí všech dostupných řádků ve zdrojovém snapshotu. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Datum měření není uvedeno Verze testu není v exportu jednoznačná Úplná konfigurace běhu není ověřena

Claude Opus 5 (Adaptive Reasoning, Medium Effort)

Model ve zdroji
claude-opus-5_medium
Záznam
scicode_external.csv: řádek 75
Původní hodnota
0.506944444444444 · převod × 100
Původní zdroj ↗ · Zdroj převzetí ↗
Epoch · převzatý běh

SciCode

Effort: xhigh · Měřeno: datum neuvedeno

54,98 %
Pořadí ve zdrojovém snapshotu6. z 13 modelůPořadí všech dostupných řádků ve zdrojovém snapshotu. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Datum měření není uvedeno Verze testu není v exportu jednoznačná Úplná konfigurace běhu není ověřena

Claude Opus 5 (Adaptive Reasoning, Xhigh Effort)

Model ve zdroji
claude-opus-5_xhigh
Záznam
scicode_external.csv: řádek 73
Původní hodnota
0.549768518518518 · převod × 100
Původní zdroj ↗ · Zdroj převzetí ↗
Artificial Analysis přes OpenRouter

AA Intelligence Index

Měřeno: datum neuvedeno

50,7
Špička3. z 85 modelůPořadí publikovaných hodnot. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Převzato z OpenRouteru; verze indexu, effort a datum měření nejsou v API uvedeny.

Model ve zdroji
anthropic/claude-opus-5
Záznam
openrouter.json
Původní hodnota
50.7
Původní zdroj ↗ · Zdroj převzetí ↗
Epoch · vlastní běh

GPQA Diamond

Měřeno: 2026-08-06

92,93 %
Nejvyšší publikovaný výsledek1. z 69 modelůPořadí všech dostupných řádků ve zdrojovém snapshotu. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Verze testu není v exportu jednoznačná Effort není doložen Úplná konfigurace běhu není ověřena

Model ve zdroji
claude-opus-5
Záznam
gpqa_diamond.csv: řádek 111
Původní hodnota
0.9292929292929293 · převod × 100
Původní zdroj ↗ · Zdroj převzetí ↗
Epoch · vlastní běh

GPQA Diamond

Effort: low · Měřeno: 2026-08-06

87,88 %
Pořadí ve zdrojovém snapshotu5. z 22 modelůPořadí všech dostupných řádků ve zdrojovém snapshotu. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Verze testu není v exportu jednoznačná Úplná konfigurace běhu není ověřena

Model ve zdroji
claude-opus-5_low
Záznam
gpqa_diamond.csv: řádek 112
Původní hodnota
0.8787878787878788 · převod × 100
Původní zdroj ↗ · Zdroj převzetí ↗
Epoch · vlastní běh

GPQA Diamond

Effort: max · Měřeno: 2026-07-24

93,88 %
Pořadí ve zdrojovém snapshotu2. z 18 modelůPořadí všech dostupných řádků ve zdrojovém snapshotu. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Verze testu není v exportu jednoznačná Úplná konfigurace běhu není ověřena

Model ve zdroji
claude-opus-5_max
Záznam
gpqa_diamond.csv: řádek 125
Původní hodnota
0.9387626262626263 · převod × 100
Původní zdroj ↗ · Zdroj převzetí ↗
Epoch · převzatý běh

ProofBench

Effort: max · Měřeno: datum neuvedeno

99 %
Pořadí ve zdrojovém snapshotu2. z 14 modelůPořadí všech dostupných řádků ve zdrojovém snapshotu. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Datum měření není uvedeno Verze testu není v exportu jednoznačná Úplná konfigurace běhu není ověřena

ProofBench v1.1 re-grade (vals.ai, 2026-08-14): corrected Lean formalizations + hardened grader (rejects sorry/admit shortcuts, larger elaboration budgets). Not comparable to v1.0-era values. Updated 2026-08-18 after multi-agent verification.

Model ve zdroji
claude-opus-5_max
Záznam
proofbench_external.csv: řádek 3
Původní hodnota
0.99 · převod × 100
Původní zdroj ↗ · Zdroj převzetí ↗
Artificial Analysis přes OpenRouter

AA Agentic Index

Měřeno: datum neuvedeno

56,2
Špička2. z 94 modelůPořadí publikovaných hodnot. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Převzato z OpenRouteru; verze indexu, effort a datum měření nejsou v API uvedeny.

Model ve zdroji
anthropic/claude-opus-5
Záznam
openrouter.json
Původní hodnota
56.2
Původní zdroj ↗ · Zdroj převzetí ↗
Epoch · převzatý běh

APEX Agents

Effort: max · Měřeno: datum neuvedeno

43,5 %
Malý vzorek — bez výkonové třídy1. z 5 modelůPořadí všech dostupných řádků ve zdrojovém snapshotu. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Datum měření není uvedeno Verze testu není v exportu jednoznačná Úplná konfigurace běhu není ověřena

Opus 5

Model ve zdroji
claude-opus-5_max
Záznam
apex_agents_external.csv: řádek 6
Původní hodnota
0.435 · převod × 100
Původní zdroj ↗ · Zdroj převzetí ↗
Epoch · převzatý běh

OSWorld 2

Effort: high · Měřeno: datum neuvedeno

28,98 %
Malý vzorek — bez výkonové třídy1. z 1 modelůPořadí všech dostupných řádků ve zdrojovém snapshotu. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Datum měření není uvedeno Verze testu není v exportu jednoznačná Úplná konfigurace běhu není ověřena

Claude Opus 5 (high)

Model ve zdroji
claude-opus-5_high
Záznam
osworld_2_external.csv: řádek 14
Původní hodnota
0.2898 · převod × 100
Původní zdroj ↗ · Zdroj převzetí ↗
Epoch · převzatý běh

OSWorld 2

Effort: low · Měřeno: datum neuvedeno

22,32 %
Malý vzorek — bez výkonové třídy1. z 1 modelůPořadí všech dostupných řádků ve zdrojovém snapshotu. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Datum měření není uvedeno Verze testu není v exportu jednoznačná Úplná konfigurace běhu není ověřena

Claude Opus 5 (low)

Model ve zdroji
claude-opus-5_low
Záznam
osworld_2_external.csv: řádek 12
Původní hodnota
0.2232 · převod × 100
Původní zdroj ↗ · Zdroj převzetí ↗
Epoch · převzatý běh

OSWorld 2

Effort: max · Měřeno: datum neuvedeno

31,43 %
Malý vzorek — bez výkonové třídy1. z 7 modelůPořadí všech dostupných řádků ve zdrojovém snapshotu. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Datum měření není uvedeno Verze testu není v exportu jednoznačná Úplná konfigurace běhu není ověřena

Claude Opus 5 (max)

Model ve zdroji
claude-opus-5_max
Záznam
osworld_2_external.csv: řádek 16
Původní hodnota
0.3143 · převod × 100
Původní zdroj ↗ · Zdroj převzetí ↗
Epoch · převzatý běh

OSWorld 2

Effort: medium · Měřeno: datum neuvedeno

25,33 %
Malý vzorek — bez výkonové třídy1. z 2 modelůPořadí všech dostupných řádků ve zdrojovém snapshotu. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Datum měření není uvedeno Verze testu není v exportu jednoznačná Úplná konfigurace běhu není ověřena

Claude Opus 5 (medium)

Model ve zdroji
claude-opus-5_medium
Záznam
osworld_2_external.csv: řádek 13
Původní hodnota
0.25329999999999997 · převod × 100
Původní zdroj ↗ · Zdroj převzetí ↗
Epoch · převzatý běh

OSWorld 2

Effort: xhigh · Měřeno: datum neuvedeno

30,21 %
Malý vzorek — bez výkonové třídy1. z 2 modelůPořadí všech dostupných řádků ve zdrojovém snapshotu. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Datum měření není uvedeno Verze testu není v exportu jednoznačná Úplná konfigurace běhu není ověřena

Claude Opus 5 (xhigh)

Model ve zdroji
claude-opus-5_xhigh
Záznam
osworld_2_external.csv: řádek 15
Původní hodnota
0.30210000000000004 · převod × 100
Původní zdroj ↗ · Zdroj převzetí ↗
Epoch · vlastní běh

Design Arena · Frontend Web App

Verze: 2026-09-02T18:07:24.032+00:00 · Měřeno: 2026-09-02

1 284 Elo
Pořadí ve zdrojovém snapshotu4. z 40 modelůPořadí všech dostupných řádků ve zdrojovém snapshotu. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Statický snapshot veřejného leaderboardu; Arena se průběžně mění. Elo je preference kvality AI generovaného frontendu, nikoli obecný test programování.

Model ve zdroji
Claude Opus 5
Záznam
designarena-frontend.json: řádek 5
Původní hodnota
1284.0
Původní zdroj ↗ · Zdroj převzetí ↗
Design Arena přes OpenRouter

Design Arena · agenticgamedev

Měřeno: datum neuvedeno

1 266 Elo
Špička2. z 24 modelůPořadí publikovaných hodnot. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Elo preferencí designu; není obecným skóre programování. Datum měření a velikost vzorku API neuvádí.

Model ve zdroji
anthropic/claude-opus-5
Záznam
openrouter.json
Původní hodnota
1266.0
Původní zdroj ↗ · Zdroj převzetí ↗
Design Arena přes OpenRouter

Design Arena · androidnative

Měřeno: datum neuvedeno

1 271 Elo
Špička3. z 35 modelůPořadí publikovaných hodnot. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Elo preferencí designu; není obecným skóre programování. Datum měření a velikost vzorku API neuvádí.

Model ve zdroji
anthropic/claude-opus-5
Záznam
openrouter.json
Původní hodnota
1271.0
Původní zdroj ↗ · Zdroj převzetí ↗
Design Arena přes OpenRouter

Design Arena · fullstack

Měřeno: datum neuvedeno

1 352 Elo
Nejvyšší publikovaný výsledek1. z 38 modelůPořadí publikovaných hodnot. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Elo preferencí designu; není obecným skóre programování. Datum měření a velikost vzorku API neuvádí.

Model ve zdroji
anthropic/claude-opus-5
Záznam
openrouter.json
Původní hodnota
1352.0
Původní zdroj ↗ · Zdroj převzetí ↗
Design Arena přes OpenRouter

Design Arena · mobileapps

Měřeno: datum neuvedeno

1 348 Elo
Nejvyšší publikovaný výsledek1. z 37 modelůPořadí publikovaných hodnot. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Elo preferencí designu; není obecným skóre programování. Datum měření a velikost vzorku API neuvádí.

Model ve zdroji
anthropic/claude-opus-5
Záznam
openrouter.json
Původní hodnota
1348.0
Původní zdroj ↗ · Zdroj převzetí ↗
Design Arena přes OpenRouter

Design Arena · python-pptxslides

Měřeno: datum neuvedeno

1 261 Elo
Vysoký výkon4. z 23 modelůPořadí publikovaných hodnot. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Elo preferencí designu; není obecným skóre programování. Datum měření a velikost vzorku API neuvádí.

Model ve zdroji
anthropic/claude-opus-5
Záznam
openrouter.json
Původní hodnota
1261.0
Původní zdroj ↗ · Zdroj převzetí ↗
Design Arena přes OpenRouter

Design Arena · webapps

Měřeno: datum neuvedeno

1 282 Elo
Špička3. z 35 modelůPořadí publikovaných hodnot. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Elo preferencí designu; není obecným skóre programování. Datum měření a velikost vzorku API neuvádí.

Model ve zdroji
anthropic/claude-opus-5
Záznam
openrouter.json
Původní hodnota
1282.0
Původní zdroj ↗ · Zdroj převzetí ↗
Design Arena přes OpenRouter

Design Arena · 3d

Měřeno: datum neuvedeno

1 368 Elo
Špička3. z 98 modelůPořadí publikovaných hodnot. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Elo preferencí designu; není obecným skóre programování. Datum měření a velikost vzorku API neuvádí.

Model ve zdroji
anthropic/claude-opus-5
Záznam
openrouter.json
Původní hodnota
1368.0
Původní zdroj ↗ · Zdroj převzetí ↗
Design Arena přes OpenRouter

Design Arena · asciiart

Měřeno: datum neuvedeno

1 380 Elo
Nejvyšší publikovaný výsledek1. z 59 modelůPořadí publikovaných hodnot. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Elo preferencí designu; není obecným skóre programování. Datum měření a velikost vzorku API neuvádí.

Model ve zdroji
anthropic/claude-opus-5
Záznam
openrouter.json
Původní hodnota
1380.0
Původní zdroj ↗ · Zdroj převzetí ↗
Design Arena přes OpenRouter

Design Arena · codecategories

Měřeno: datum neuvedeno

1 341 Elo
Špička3. z 106 modelůPořadí publikovaných hodnot. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Elo preferencí designu; není obecným skóre programování. Datum měření a velikost vzorku API neuvádí.

Model ve zdroji
anthropic/claude-opus-5
Záznam
openrouter.json
Původní hodnota
1341.0
Původní zdroj ↗ · Zdroj převzetí ↗
Design Arena přes OpenRouter

Design Arena · dataviz

Měřeno: datum neuvedeno

1 355 Elo
Špička4. z 104 modelůPořadí publikovaných hodnot. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Elo preferencí designu; není obecným skóre programování. Datum měření a velikost vzorku API neuvádí.

Model ve zdroji
anthropic/claude-opus-5
Záznam
openrouter.json
Původní hodnota
1355.0
Původní zdroj ↗ · Zdroj převzetí ↗
Design Arena přes OpenRouter

Design Arena · gamedev

Měřeno: datum neuvedeno

1 366 Elo
Špička3. z 105 modelůPořadí publikovaných hodnot. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Elo preferencí designu; není obecným skóre programování. Datum měření a velikost vzorku API neuvádí.

Model ve zdroji
anthropic/claude-opus-5
Záznam
openrouter.json
Původní hodnota
1366.0
Původní zdroj ↗ · Zdroj převzetí ↗
Design Arena přes OpenRouter

Design Arena · svg

Měřeno: datum neuvedeno

1 351 Elo
Nejvyšší publikovaný výsledek1. z 75 modelůPořadí publikovaných hodnot. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Elo preferencí designu; není obecným skóre programování. Datum měření a velikost vzorku API neuvádí.

Model ve zdroji
anthropic/claude-opus-5
Záznam
openrouter.json
Původní hodnota
1351.0
Původní zdroj ↗ · Zdroj převzetí ↗
Design Arena přes OpenRouter

Design Arena · uicomponent

Měřeno: datum neuvedeno

1 366 Elo
Špička2. z 102 modelůPořadí publikovaných hodnot. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Elo preferencí designu; není obecným skóre programování. Datum měření a velikost vzorku API neuvádí.

Model ve zdroji
anthropic/claude-opus-5
Záznam
openrouter.json
Původní hodnota
1366.0
Původní zdroj ↗ · Zdroj převzetí ↗
Design Arena přes OpenRouter

Design Arena · website

Měřeno: datum neuvedeno

1 322 Elo
Špička4. z 112 modelůPořadí publikovaných hodnot. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Elo preferencí designu; není obecným skóre programování. Datum měření a velikost vzorku API neuvádí.

Model ve zdroji
anthropic/claude-opus-5
Záznam
openrouter.json
Původní hodnota
1322.0
Původní zdroj ↗ · Zdroj převzetí ↗

Kolik stojí používání

Jeden z nejdražších20. z 311 modelů · sdílené pořadí od nejdražšího

10 USD za srovnávací koš

12,5× medián · medián 0,8 USD. Srovnání 311 modelů celého katalogu s použitelnou standardní API sazbou a dostatečným kontextem.

Claude Opus 5
NejdražšíVyšší cenaStředNízká cena

Nejbližší konkurenti podle ceny koše

100 požadavků, každý s 10 000 vstupními tokeny. Výstup podle zvoleného poměru. Základní textové API včetně případného poplatku za požadavek; nejde o cenu úspěšně vyřešené úlohy.

Co za své peníze získáte jinde

Blízký index = rozdíl nejvýše 3 body. Podobná cena = ±20 % koše. Pokud blízký index levněji chybí, ukazujeme nejbližší nižší index s úsporou. Výběr z celého katalogu; jde o publikovaný AA index s neúplnou metodikou.

USD za milion tokenů. Nabídky a pásma z OpenRouteru; ceny předplatného aplikací zde nejsou.

NabídkaTokenové sazbyČtení cache
Standardní APIanthropic/claude-opus-5$5$25$0,5
Batchanthropic/claude-opus-5:batch$2,5$12,5$0,25
Vstupní modality
text, image, file
Volání nástrojů
Ano
Do katalogu přidán
2026-07-24
Znalostní cutoff
Neuvedeno
Kanonická verze
anthropic/claude-opus-5-20260723
Otevřít nabídku na OpenRouteru ↗

Co zvážit vedle tohoto modelu

Blízkost výstupní ceny, publikovaného AA Coding Indexu (kde je) a zaměření v popisu. Kandidáti z aktuálního katalogu se stejnými výstupními modalitami; nejde o pořadí kvality. Cenové rozdíly níže platí pro základní standardní API sazbu.

Další modely od Anthropic

Co jsme o modelu napsali

Patrick Zandl · 2026-07-25

Claude Opus 5: nejchytřejší model co si nejvíc vymýšlí ↗

„Opus 5 je nejsilnější běžně dostupný model, jaký dnes seženete, a je to podložené nezávislým měřením i slepým testem. Ten titul má ale menší dopad, než se zdá. Vyhrát o bod na indexu, kde je pět modelů v rozpětí čtyř bodů, znamená čím dál míň, a Anthropic to zjevně ví. Jinak by celé oznámení nestavěl na ekonomice provozu.“

Charakteristika vznikla automaticky z parametrů a popisu OpenRouteru. Benchmarky jsou převzaté výsledky s uvedenými zdroji; redakční zkušenosti jsou oddělené v analýzách.