Model za 2 USD za milion vstupních a 6 USD za milion výstupních tokenů, o kterém Elon Musk tvrdil, že překoná všechny existující modely. Kdyby to platilo, šlo by o nejlevnější špičku na trhu. Nezávislé měření ukazuje model, který se v jedné oblasti ke špičce přiblížil a ve zbytku zůstal ve středu pole. Komu to stačí?
SpaceXAI vydala Grok 4.7 dne 21. září, po čtyřech posunutých termínech. Den nato ho změřila Artificial Analysis a právě kvůli tomuto nezávislému číslu o něm píšu.
Co Grok 4.7 je
Model stojí na novém, větším základním modelu než Grok 4.6. Prošel delším posilovaným učením na úlohách, které trvají mnoho hodin, a v tréninku dostal inženýrská data SpaceX. Cena se proti předchůdci nezměnila, tedy 2 a 6 USD za milion tokenů. Kontextové okno má 500 tisíc tokenů.
Kde stojí v žebříčku
Artificial Analysis mezitím přešla na novou verzi indexu inteligence s deseti hodnoceními, a tím se změnila i stupnice. S hodnotami ze starších článků proto tato čísla srovnávat nejdou.
| Model | Index v4.3.2 |
|---|---|
| Claude Fable 5.1 | 53 |
| GPT-6 Astra | 53 |
| Claude Opus 5 | 51 |
| Claude Fable 5 | 50 |
| Muse Spark 1.3 | 48 |
| GPT-5.6 Sol | 47 |
| Grok 4.7 | 46 |
| Grok 4.6 | 44 |
Grok 4.7 si proti předchůdci polepšil o dva body. Podle benchmarku se tím SpaceXAI dostala mezi čtyři nejsilnější laboratoře a to není malý výsledek. Na elitu, tedy na Fable 5.1 a GPT-6 Astra, mu ale chybí sedm bodů a o bod ho předstihl i starší GPT-5.6 Sol. Skok mezi elitu, který Musk sliboval, se nekonal.
Kde se ke špičce přiblížil
Dlouhá kancelářská a analytická práce. Test AA-Briefcase dává modelu rozsáhlé podklady, ze kterých má vytvořit dokumenty, tabulky a prezentace. Grok 4.7 v něm získal 1657 bodů Elo, o 111 víc než Grok 4.6, a před ním jsou jen Claude Opus 5 a Fable 5.1. V příbuzném testu GDPval-AA má 1695 bodů, o 90 víc než předchůdce.
Programování ve vlastním prostředí. V Coding Agent Indexu dosáhl s nástrojem Grok Build 56 bodů, o devět víc než Grok 4.6. Mezi modely, které běží ve svých nativních prostředích, je čtvrtý, za Fable 5.1, GPT-6 Astra a Opusem 5.
Právní úlohy. V benchmarku Harvey Legal vede se zhruba 20 procenty a první místo drží už od verze 4.5.
Klesla také míra halucinací, tedy vymýšlení odpovědí u faktů, které model nezná, a to z 34 na 29 procent.
Kde zaostává
Dlouhá práce v terminálu. SpaceXAI v oznámení uvádí pro Terminal-Bench 4.0 výsledek 38 procent. Artificial Analysis naměřila ve svém jednotném běhovém rámci 26 procent, což je méně než u levného DeepSeek V4.1 Flash. GPT-6 Astra má 60 procent a Fable 5.1 55 procent. Rozdíl mezi číslem výrobce a měřiče jde nejspíš na vrub odlišného prostředí. Ke špičce ale Grok v této disciplíně nepatří podle žádného z obou čísel.
Elektrotechnika. Tady měla pomoci data SpaceX. Grok s 64 procenty v benchmarku EEBench znatelně předstihl předchůdce i Fable 5.1, oficiální žebříček testu ale vede GPT-6 Astra se 69 procenty.
Kolik to stojí
Ceník za token zůstal stejný, model ale na jednu úlohu spotřebuje víc než dvakrát tolik tokenů co Grok 4.6.
| Model | Výstupní tokeny na úlohu |
|---|---|
| Grok 4.7 (xhigh) | 81 tisíc |
| Muse Spark 1.3 (max) | 60 tisíc |
| Grok 4.6 (xhigh) | 38 tisíc |
| GPT-6 Astra (max) | 27 tisíc |
Průměrná úloha indexu mu trvala zhruba sedm minut. Za stejnou práci tak zaplatíte víc, než napovídá nezměněný ceník. Proti modelům OpenAI a Anthropicu to je pořád méně.
Závěrem: Co si z toho odnést?
Vyzkoušel bych ho na dlouhé kancelářské a analytické úlohy a na právní agendu, kde se ke špičce dostal nejblíž. Dává smysl také tehdy, když hlídáte cenu za token.
Sáhl bych jinam u práce v terminálu a všude, kde potřebujete absolutní špičku. Sám používám Grok Build kvůli jeho rychlosti, ale spíše výjimečně, na drobnější práce.
Pro české firmy: SpaceXAI je americká firma a data zpracovává v USA. Pokud máte vůči klientům závazek držet data v EU, ověřte si to předem - zatím to nevypadá, že by EU servery nabízeli.
Za mě je Grok 4.7 poctivý posun o jeden stupeň, ne o tři, které Musk sliboval. SpaceXAI sama v oznámení mluví střízlivěji o modelu vysoce konkurenceschopném ve své třídě a měření jí v tom dává za pravdu.
Zdroje: oznámení SpaceXAI z 21. září 2026, měření Artificial Analysis (index inteligence verze 4.3.2, AA-Briefcase, GDPval-AA, Coding Agent Index), oficiální žebříček EEBench od firmy atopile. Platnost údajů k 22. září 2026.