Grok 4.7 od xAI nabízí kontext 500 000 tokenů. Popis v katalogu jej zaměřuje na programování, práce s nástroji a agenty. K dispozici jsou převzaté výsledky programovacích testů; jednotlivé běhy a jejich podmínky najdete níže.
Obrazový vstupNástroje
Vstup / 1M tokenů$1,6
Výstup / 1M tokenů$4,8
Kontext500 k
* Základní sazba. U delších vstupů platí cenová pásma uvedená níže.
Čeština
Zatím bez vlastního měření. Obecný jazykový benchmark nepovažujeme za test češtiny.
Grok 4.7 is SpaceXAI's flagship model for coding, agentic tasks, and knowledge work, succeeding Grok 4.6. It is particularly strong at long-running software engineering tasks, verifying its own work, and...
AA Coding Index v katalogu chybí. Jednotlivé testy níže hodnotíme samostatně, bez odhadu celkového výkonu.
Publikované výsledky, nikoli vlastní měření. Každý záznam zachovává svou konfiguraci. Neúplně popsané běhy nezakládají pořadí kvality.
Všechny dostupné výsledky; pořadí je pouze ze zdrojového snapshotu, pokud je uvedeno.
Benchmark
Výsledek
Pořadí
Nápověda
CursorBenchgrok-4.7_high
43,9 %
3/9
ⓘ
Nejednoznačné úlohy přes více souborů z reálného používání Cursoru. Měří běh v prostředí Cursoru, ne samostatný model v libovolném nástroji.
CursorBenchgrok-4.7_low
33,1 %
4/8
ⓘ
Nejednoznačné úlohy přes více souborů z reálného používání Cursoru. Měří běh v prostředí Cursoru, ne samostatný model v libovolném nástroji.
CursorBenchgrok-4.7_medium
41,6 %
3/9
ⓘ
Nejednoznačné úlohy přes více souborů z reálného používání Cursoru. Měří běh v prostředí Cursoru, ne samostatný model v libovolném nástroji.
CursorBenchgrok-4.7_xhigh
46,3 %
2/8
ⓘ
Nejednoznačné úlohy přes více souborů z reálného používání Cursoru. Měří běh v prostředí Cursoru, ne samostatný model v libovolném nástroji.
SciCodegrok-4.7_xhigh
57,41 %
2/14
ⓘ
Tvorba kódu pro vědecké výzkumné problémy. Úzká oblast; konkrétní měření AA a obecná definice datasetu mají oddělený původ.
AA Intelligence Indexx-ai/grok-4.7
46,4
—
ⓘ
Soubor především textových úloh v angličtině; není testem češtiny. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.
ProofBenchgrok-4.7_unknown
34 %
9/22
ⓘ
Význam benchmarku není v registru popsán. Podmínky zdroje je třeba ověřit u konkrétního běhu.
Epoch · převzatý běh
CursorBench
Agent: Cursor · Effort: high · Měřeno: datum neuvedeno
43,9 %
Malý vzorek — bez výkonové třídy3. z 9 modelůPořadí všech dostupných řádků ve zdrojovém snapshotu. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku
Datum měření není uvedeno Verze testu není v exportu jednoznačná Úplná konfigurace běhu není ověřena
100 požadavků, každý s 10 000 vstupními tokeny. Výstup podle zvoleného poměru. Základní textové API včetně případného poplatku za požadavek; nejde o cenu úspěšně vyřešené úlohy.
Co za své peníze získáte jinde
Blízký index = rozdíl nejvýše 3 body. Podobná cena = ±20 % koše. Pokud blízký index levněji chybí, ukazujeme nejbližší nižší index s úsporou. Výběr z celého katalogu; jde o publikovaný AA index s neúplnou metodikou.
Pro tento koš nemáme alternativu splňující cenové a indexové podmínky. Chybějící doporučení nedoplňujeme odhadem.
USD za milion tokenů. Nabídky a pásma z OpenRouteru; ceny předplatného aplikací zde nejsou.
Blízkost výstupní ceny, publikovaného AA Coding Indexu (kde je) a zaměření v popisu. Kandidáti z aktuálního katalogu se stejnými výstupními modalitami; nejde o pořadí kvality. Cenové rozdíly níže platí pro základní standardní API sazbu.
„Za mě je Grok 4.7 poctivý posun o jeden stupeň, ne o tři, které Musk sliboval. SpaceXAI sama v oznámení mluví střízlivěji o modelu vysoce konkurenceschopném ve své třídě a měření jí v tom dává za pravdu.“
Charakteristika vznikla automaticky z parametrů a popisu OpenRouteru. Benchmarky jsou převzaté výsledky s uvedenými zdroji; redakční zkušenosti jsou oddělené v analýzách.