AA Coding Index
Měřeno: datum neuvedeno
Podmínky a zdroj výsledku
Převzato z OpenRouteru; verze indexu, effort a datum měření nejsou v API uvedeny.
- Model ve zdroji
- anthropic/claude-opus-5
- Záznam
- openrouter.json
- Původní hodnota
- 78.0
anthropic/claude-opus-5
Claude Opus 5 od Anthropic nabízí kontext 1 000 000 tokenů. Popis v katalogu jej zaměřuje na programování, práce s nástroji a agenty, analytické úlohy. OpenRouter u něj uvádí AA Coding Index 78; jde o převzatý index s neuvedenou konfigurací, nikoli vlastní test.
Zatím bez vlastního měření. Obecný jazykový benchmark nepovažujeme za test češtiny.
Claude Opus 5 is Anthropic’s flagship model for demanding reasoning, coding, and long-horizon agentic work. It is particularly strong at end-to-end software tasks, code review and bug finding, visual analysis...
OpenRouter ↗Patří do nejlepších 10 % zveřejněných hodnot AA Coding Indexu v celém načteném katalogu OpenRouteru. Hodnota modelu: 78.
Nejbližší konkurenti podle Coding Indexu
Pořadí publikovaných indexů, nikoli závěr vlastního testu. API neuvádí verzi indexu ani effort; první místo neznamená nejlepší model pro každou programovací úlohu.
Publikované výsledky, nikoli vlastní měření. Každý záznam zachovává svou konfiguraci. Neúplně popsané běhy nezakládají pořadí kvality.
| Benchmark | Výsledek | Pořadí | Nápověda |
|---|---|---|---|
| AA Coding Indexanthropic/claude-opus-5 | 78 | — | ⓘOpenRouter publikuje tuto hodnotu indexu. Použitou revizi metodiky a konfiguraci zde neuvádí. Popis dostupnosti indexu není výkladem neznámé revize jeho metodiky. |
| CursorBenchclaude-opus-5_high | 66,7 % | 4/17 | ⓘNejednoznačné úlohy přes více souborů z reálného používání Cursoru. Měří běh v prostředí Cursoru, ne samostatný model v libovolném nástroji. |
| CursorBenchclaude-opus-5_low | 62,8 % | 2/14 | ⓘNejednoznačné úlohy přes více souborů z reálného používání Cursoru. Měří běh v prostředí Cursoru, ne samostatný model v libovolném nástroji. |
| CursorBenchclaude-opus-5_max | 70 % | 3/12 | ⓘNejednoznačné úlohy přes více souborů z reálného používání Cursoru. Měří běh v prostředí Cursoru, ne samostatný model v libovolném nástroji. |
| CursorBenchclaude-opus-5_medium | 64,3 % | 5/15 | ⓘNejednoznačné úlohy přes více souborů z reálného používání Cursoru. Měří běh v prostředí Cursoru, ne samostatný model v libovolném nástroji. |
| CursorBenchclaude-opus-5_xhigh | 69,3 % | 3/11 | ⓘNejednoznačné úlohy přes více souborů z reálného používání Cursoru. Měří běh v prostředí Cursoru, ne samostatný model v libovolném nástroji. |
| DeepSWEclaude-opus-5 | 73,65 % | — | ⓘVýsledek řešení softwarových úloh v jednotném agentním prostředí. Neprokazuje stejný výkon v jiném agentu ani kvalitu češtiny. |
| DeepSWEclaude-opus-5 | 73,15 % | — | ⓘVýsledek řešení softwarových úloh v jednotném agentním prostředí. Neprokazuje stejný výkon v jiném agentu ani kvalitu češtiny. |
| DeepSWEclaude-opus-5 | 72,83 % | — | ⓘVýsledek řešení softwarových úloh v jednotném agentním prostředí. Neprokazuje stejný výkon v jiném agentu ani kvalitu češtiny. |
| DeepSWEclaude-opus-5 | 68,9 % | — | ⓘVýsledek řešení softwarových úloh v jednotném agentním prostředí. Neprokazuje stejný výkon v jiném agentu ani kvalitu češtiny. |
| DeepSWEclaude-opus-5 | 58,13 % | — | ⓘVýsledek řešení softwarových úloh v jednotném agentním prostředí. Neprokazuje stejný výkon v jiném agentu ani kvalitu češtiny. |
| FrontierCodeclaude-opus-5_max | 53,38 % | 1/2 | ⓘHodnotí kvalitu změn kódu pro produkční repozitáře. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání. |
| SciCodeclaude-opus-5_high | 54,28 % | 6/20 | ⓘTvorba kódu pro vědecké výzkumné problémy. Úzká oblast; konkrétní měření AA a obecná definice datasetu mají oddělený původ. |
| SciCodeclaude-opus-5_low | 48,03 % | 10/13 | ⓘTvorba kódu pro vědecké výzkumné problémy. Úzká oblast; konkrétní měření AA a obecná definice datasetu mají oddělený původ. |
| SciCodeclaude-opus-5_max | 55,67 % | 7/20 | ⓘTvorba kódu pro vědecké výzkumné problémy. Úzká oblast; konkrétní měření AA a obecná definice datasetu mají oddělený původ. |
| SciCodeclaude-opus-5_medium | 50,69 % | 8/11 | ⓘTvorba kódu pro vědecké výzkumné problémy. Úzká oblast; konkrétní měření AA a obecná definice datasetu mají oddělený původ. |
| SciCodeclaude-opus-5_xhigh | 54,98 % | 6/13 | ⓘTvorba kódu pro vědecké výzkumné problémy. Úzká oblast; konkrétní měření AA a obecná definice datasetu mají oddělený původ. |
| AA Intelligence Indexanthropic/claude-opus-5 | 50,7 | — | ⓘSoubor především textových úloh v angličtině; není testem češtiny. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání. |
| GPQA Diamondclaude-opus-5 | 92,93 % | 1/69 | ⓘVýsledky znalostního benchmarku GPQA; nejde o programovací úlohy. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání. |
| GPQA Diamondclaude-opus-5_low | 87,88 % | 5/22 | ⓘVýsledky znalostního benchmarku GPQA; nejde o programovací úlohy. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání. |
| GPQA Diamondclaude-opus-5_max | 93,88 % | 2/18 | ⓘVýsledky znalostního benchmarku GPQA; nejde o programovací úlohy. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání. |
| ProofBenchclaude-opus-5_max | 99 % | 2/14 | ⓘVýznam benchmarku není v registru popsán. Podmínky zdroje je třeba ověřit u konkrétního běhu. |
| AA Agentic Indexanthropic/claude-opus-5 | 56,2 | — | ⓘOpenRouter publikuje tuto hodnotu indexu. Použitou revizi metodiky a konfiguraci zde neuvádí. Popis dostupnosti indexu není výkladem neznámé revize jeho metodiky. |
| APEX Agentsclaude-opus-5_max | 43,5 % | 1/5 | ⓘVýznam benchmarku není v registru popsán. Podmínky zdroje je třeba ověřit u konkrétního běhu. |
| OSWorld 2claude-opus-5_high | 28,98 % | 1/1 | ⓘVýznam benchmarku není v registru popsán. Podmínky zdroje je třeba ověřit u konkrétního běhu. |
| OSWorld 2claude-opus-5_low | 22,32 % | 1/1 | ⓘVýznam benchmarku není v registru popsán. Podmínky zdroje je třeba ověřit u konkrétního běhu. |
| OSWorld 2claude-opus-5_max | 31,43 % | 1/7 | ⓘVýznam benchmarku není v registru popsán. Podmínky zdroje je třeba ověřit u konkrétního běhu. |
| OSWorld 2claude-opus-5_medium | 25,33 % | 1/2 | ⓘVýznam benchmarku není v registru popsán. Podmínky zdroje je třeba ověřit u konkrétního běhu. |
| OSWorld 2claude-opus-5_xhigh | 30,21 % | 1/2 | ⓘVýznam benchmarku není v registru popsán. Podmínky zdroje je třeba ověřit u konkrétního běhu. |
| Design Arena · Frontend Web AppClaude Opus 5 | 1 284 Elo | 4/40 | ⓘHodnocení designu vytvořeného AI komunitou; oddělujeme jednotlivé kategorie. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání. |
| Design Arena · agenticgamedevanthropic/claude-opus-5 | 1 266 Elo | — | ⓘHodnocení designu vytvořeného AI komunitou; oddělujeme jednotlivé kategorie. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání. |
| Design Arena · androidnativeanthropic/claude-opus-5 | 1 271 Elo | — | ⓘHodnocení designu vytvořeného AI komunitou; oddělujeme jednotlivé kategorie. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání. |
| Design Arena · fullstackanthropic/claude-opus-5 | 1 352 Elo | — | ⓘHodnocení designu vytvořeného AI komunitou; oddělujeme jednotlivé kategorie. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání. |
| Design Arena · mobileappsanthropic/claude-opus-5 | 1 348 Elo | — | ⓘHodnocení designu vytvořeného AI komunitou; oddělujeme jednotlivé kategorie. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání. |
| Design Arena · python-pptxslidesanthropic/claude-opus-5 | 1 261 Elo | — | ⓘHodnocení designu vytvořeného AI komunitou; oddělujeme jednotlivé kategorie. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání. |
| Design Arena · webappsanthropic/claude-opus-5 | 1 282 Elo | — | ⓘHodnocení designu vytvořeného AI komunitou; oddělujeme jednotlivé kategorie. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání. |
| Design Arena · 3danthropic/claude-opus-5 | 1 368 Elo | — | ⓘHodnocení designu vytvořeného AI komunitou; oddělujeme jednotlivé kategorie. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání. |
| Design Arena · asciiartanthropic/claude-opus-5 | 1 380 Elo | — | ⓘHodnocení designu vytvořeného AI komunitou; oddělujeme jednotlivé kategorie. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání. |
| Design Arena · codecategoriesanthropic/claude-opus-5 | 1 341 Elo | — | ⓘHodnocení designu vytvořeného AI komunitou; oddělujeme jednotlivé kategorie. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání. |
| Design Arena · datavizanthropic/claude-opus-5 | 1 355 Elo | — | ⓘHodnocení designu vytvořeného AI komunitou; oddělujeme jednotlivé kategorie. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání. |
| Design Arena · gamedevanthropic/claude-opus-5 | 1 366 Elo | — | ⓘHodnocení designu vytvořeného AI komunitou; oddělujeme jednotlivé kategorie. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání. |
| Design Arena · svganthropic/claude-opus-5 | 1 351 Elo | — | ⓘHodnocení designu vytvořeného AI komunitou; oddělujeme jednotlivé kategorie. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání. |
| Design Arena · uicomponentanthropic/claude-opus-5 | 1 366 Elo | — | ⓘHodnocení designu vytvořeného AI komunitou; oddělujeme jednotlivé kategorie. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání. |
| Design Arena · websiteanthropic/claude-opus-5 | 1 322 Elo | — | ⓘHodnocení designu vytvořeného AI komunitou; oddělujeme jednotlivé kategorie. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání. |
Měřeno: datum neuvedeno
Převzato z OpenRouteru; verze indexu, effort a datum měření nejsou v API uvedeny.
Agent: Cursor · Effort: high · Měřeno: datum neuvedeno
Datum měření není uvedeno Verze testu není v exportu jednoznačná Úplná konfigurace běhu není ověřena
Opus 5 High
Agent: Cursor · Effort: low · Měřeno: datum neuvedeno
Datum měření není uvedeno Verze testu není v exportu jednoznačná Úplná konfigurace běhu není ověřena
Opus 5 Low
Agent: Cursor · Effort: max · Měřeno: datum neuvedeno
Datum měření není uvedeno Verze testu není v exportu jednoznačná Úplná konfigurace běhu není ověřena
Opus 5 Max
Agent: Cursor · Effort: medium · Měřeno: datum neuvedeno
Datum měření není uvedeno Verze testu není v exportu jednoznačná Úplná konfigurace běhu není ověřena
Opus 5 Medium
Agent: Cursor · Effort: xhigh · Měřeno: datum neuvedeno
Datum měření není uvedeno Verze testu není v exportu jednoznačná Úplná konfigurace běhu není ověřena
Opus 5 Extra High
Agent: mini-swe-agent · Effort: max · Verze: 1.1 · Měřeno: datum neuvedeno
Pořadí ve zdroji není uvedeno.
Datum jednotlivého běhu a číslo verze balíčku agenta zdroj neuvádí. Pořadí závisí na konfiguraci; stejný effort různých dodavatelů není stejný rozpočet.
Agent: mini-swe-agent · Effort: xhigh · Verze: 1.1 · Měřeno: datum neuvedeno
Pořadí ve zdroji není uvedeno.
Datum jednotlivého běhu a číslo verze balíčku agenta zdroj neuvádí. Pořadí závisí na konfiguraci; stejný effort různých dodavatelů není stejný rozpočet.
Agent: mini-swe-agent · Effort: high · Verze: 1.1 · Měřeno: datum neuvedeno
Pořadí ve zdroji není uvedeno.
Datum jednotlivého běhu a číslo verze balíčku agenta zdroj neuvádí. Pořadí závisí na konfiguraci; stejný effort různých dodavatelů není stejný rozpočet.
Agent: mini-swe-agent · Effort: medium · Verze: 1.1 · Měřeno: datum neuvedeno
Pořadí ve zdroji není uvedeno.
Datum jednotlivého běhu a číslo verze balíčku agenta zdroj neuvádí. Pořadí závisí na konfiguraci; stejný effort různých dodavatelů není stejný rozpočet.
Agent: mini-swe-agent · Effort: low · Verze: 1.1 · Měřeno: datum neuvedeno
Pořadí ve zdroji není uvedeno.
Datum jednotlivého běhu a číslo verze balíčku agenta zdroj neuvádí. Pořadí závisí na konfiguraci; stejný effort různých dodavatelů není stejný rozpočet.
Agent: claude-code · Effort: medium · Měřeno: datum neuvedeno
Datum měření není uvedeno Verze testu není v exportu jednoznačná Rozpor ve zdroji: effort přebíráme ze sloupce Reasoning effort; sufix názvu modelu uvádí jinou hodnotu. Úplná konfigurace běhu není ověřena
Claude Opus 5
Effort: high · Měřeno: datum neuvedeno
Datum měření není uvedeno Verze testu není v exportu jednoznačná Úplná konfigurace běhu není ověřena
Claude Opus 5 (Adaptive Reasoning, High Effort)
Effort: low · Měřeno: datum neuvedeno
Datum měření není uvedeno Verze testu není v exportu jednoznačná Úplná konfigurace běhu není ověřena
Claude Opus 5 (Adaptive Reasoning, Low Effort)
Effort: max · Měřeno: datum neuvedeno
Datum měření není uvedeno Verze testu není v exportu jednoznačná Úplná konfigurace běhu není ověřena
Claude Opus 5 (Adaptive Reasoning, Max Effort)
Effort: medium · Měřeno: datum neuvedeno
Datum měření není uvedeno Verze testu není v exportu jednoznačná Úplná konfigurace běhu není ověřena
Claude Opus 5 (Adaptive Reasoning, Medium Effort)
Effort: xhigh · Měřeno: datum neuvedeno
Datum měření není uvedeno Verze testu není v exportu jednoznačná Úplná konfigurace běhu není ověřena
Claude Opus 5 (Adaptive Reasoning, Xhigh Effort)
Měřeno: datum neuvedeno
Převzato z OpenRouteru; verze indexu, effort a datum měření nejsou v API uvedeny.
Měřeno: 2026-08-06
Verze testu není v exportu jednoznačná Effort není doložen Úplná konfigurace běhu není ověřena
Effort: low · Měřeno: 2026-08-06
Verze testu není v exportu jednoznačná Úplná konfigurace běhu není ověřena
Effort: max · Měřeno: 2026-07-24
Verze testu není v exportu jednoznačná Úplná konfigurace běhu není ověřena
Effort: max · Měřeno: datum neuvedeno
Datum měření není uvedeno Verze testu není v exportu jednoznačná Úplná konfigurace běhu není ověřena
ProofBench v1.1 re-grade (vals.ai, 2026-08-14): corrected Lean formalizations + hardened grader (rejects sorry/admit shortcuts, larger elaboration budgets). Not comparable to v1.0-era values. Updated 2026-08-18 after multi-agent verification.
Měřeno: datum neuvedeno
Převzato z OpenRouteru; verze indexu, effort a datum měření nejsou v API uvedeny.
Effort: max · Měřeno: datum neuvedeno
Datum měření není uvedeno Verze testu není v exportu jednoznačná Úplná konfigurace běhu není ověřena
Opus 5
Effort: high · Měřeno: datum neuvedeno
Datum měření není uvedeno Verze testu není v exportu jednoznačná Úplná konfigurace běhu není ověřena
Claude Opus 5 (high)
Effort: low · Měřeno: datum neuvedeno
Datum měření není uvedeno Verze testu není v exportu jednoznačná Úplná konfigurace běhu není ověřena
Claude Opus 5 (low)
Effort: max · Měřeno: datum neuvedeno
Datum měření není uvedeno Verze testu není v exportu jednoznačná Úplná konfigurace běhu není ověřena
Claude Opus 5 (max)
Effort: medium · Měřeno: datum neuvedeno
Datum měření není uvedeno Verze testu není v exportu jednoznačná Úplná konfigurace běhu není ověřena
Claude Opus 5 (medium)
Effort: xhigh · Měřeno: datum neuvedeno
Datum měření není uvedeno Verze testu není v exportu jednoznačná Úplná konfigurace běhu není ověřena
Claude Opus 5 (xhigh)
Verze: 2026-09-02T18:07:24.032+00:00 · Měřeno: 2026-09-02
Statický snapshot veřejného leaderboardu; Arena se průběžně mění. Elo je preference kvality AI generovaného frontendu, nikoli obecný test programování.
Měřeno: datum neuvedeno
Elo preferencí designu; není obecným skóre programování. Datum měření a velikost vzorku API neuvádí.
Měřeno: datum neuvedeno
Elo preferencí designu; není obecným skóre programování. Datum měření a velikost vzorku API neuvádí.
Měřeno: datum neuvedeno
Elo preferencí designu; není obecným skóre programování. Datum měření a velikost vzorku API neuvádí.
Měřeno: datum neuvedeno
Elo preferencí designu; není obecným skóre programování. Datum měření a velikost vzorku API neuvádí.
Měřeno: datum neuvedeno
Elo preferencí designu; není obecným skóre programování. Datum měření a velikost vzorku API neuvádí.
Měřeno: datum neuvedeno
Elo preferencí designu; není obecným skóre programování. Datum měření a velikost vzorku API neuvádí.
Měřeno: datum neuvedeno
Elo preferencí designu; není obecným skóre programování. Datum měření a velikost vzorku API neuvádí.
Měřeno: datum neuvedeno
Elo preferencí designu; není obecným skóre programování. Datum měření a velikost vzorku API neuvádí.
Měřeno: datum neuvedeno
Elo preferencí designu; není obecným skóre programování. Datum měření a velikost vzorku API neuvádí.
Měřeno: datum neuvedeno
Elo preferencí designu; není obecným skóre programování. Datum měření a velikost vzorku API neuvádí.
Měřeno: datum neuvedeno
Elo preferencí designu; není obecným skóre programování. Datum měření a velikost vzorku API neuvádí.
Měřeno: datum neuvedeno
Elo preferencí designu; není obecným skóre programování. Datum měření a velikost vzorku API neuvádí.
Měřeno: datum neuvedeno
Elo preferencí designu; není obecným skóre programování. Datum měření a velikost vzorku API neuvádí.
Měřeno: datum neuvedeno
Elo preferencí designu; není obecným skóre programování. Datum měření a velikost vzorku API neuvádí.
12,5× medián · medián 0,8 USD. Srovnání 311 modelů celého katalogu s použitelnou standardní API sazbou a dostatečným kontextem.
100 požadavků, každý s 10 000 vstupními tokeny. Výstup podle zvoleného poměru. Základní textové API včetně případného poplatku za požadavek; nejde o cenu úspěšně vyřešené úlohy.
Blízký index = rozdíl nejvýše 3 body. Podobná cena = ±20 % koše. Pokud blízký index levněji chybí, ukazujeme nejbližší nižší index s úsporou. Výběr z celého katalogu; jde o publikovaný AA index s neúplnou metodikou.
Úspora 8,5 USD za koš · Coding Index 76,3 (-1,7 bodu proti tomuto modelu).
Karta modelu →Příplatek 10 USD za koš · Coding Index 81,6 (+3,6 bodu proti tomuto modelu).
Karta modelu →USD za milion tokenů. Nabídky a pásma z OpenRouteru; ceny předplatného aplikací zde nejsou.
| Nabídka | Tokenové sazby | Čtení cache | |
|---|---|---|---|
| Standardní APIanthropic/claude-opus-5 | $5 | $25 | $0,5 |
| Batchanthropic/claude-opus-5:batch | $2,5 | $12,5 | $0,25 |
Blízkost výstupní ceny, publikovaného AA Coding Indexu (kde je) a zaměření v popisu. Kandidáti z aktuálního katalogu se stejnými výstupními modalitami; nejde o pořadí kvality. Cenové rozdíly níže platí pro základní standardní API sazbu.
Výstup je o 40 % levnější.
Výstup je o 52 % levnější.
Výstup je o 60 % levnější.
Stejná základní cena výstupu.
Výstup je o 100 % dražší.
„Opus 5 je nejsilnější běžně dostupný model, jaký dnes seženete, a je to podložené nezávislým měřením i slepým testem. Ten titul má ale menší dopad, než se zdá. Vyhrát o bod na indexu, kde je pět modelů v rozpětí čtyř bodů, znamená čím dál míň, a Anthropic to zjevně ví. Jinak by celé oznámení nestavěl na ekonomice provozu.“
Charakteristika vznikla automaticky z parametrů a popisu OpenRouteru. Benchmarky jsou převzaté výsledky s uvedenými zdroji; redakční zkušenosti jsou oddělené v analýzách.