Vibecoding.cz Patrick Zandl o AI vývoji
Brief Patrick Zandl

# Grok 4.7 zůstal pod elitou. V kancelářské práci se k ní přiblížil

Nejnovější verze Grok 4.7 vychází jen těsně po modelu 4.6 a tak nějak se očekávalo, že se vyrovná špičkovým modelům. Elon Musk to sliboval. Dopadlo to jako vždycky s ním: ještě to není...

Modely: Grok 4.7
Reklama
Obsah článku

Model za 2 USD za milion vstupních a 6 USD za milion výstupních tokenů, o kterém Elon Musk tvrdil, že překoná všechny existující modely. Kdyby to platilo, šlo by o nejlevnější špičku na trhu. Nezávislé měření ukazuje model, který se v jedné oblasti ke špičce přiblížil a ve zbytku zůstal ve středu pole. Komu to stačí?

SpaceXAI vydala Grok 4.7 dne 21. září, po čtyřech posunutých termínech. Den nato ho změřila Artificial Analysis a právě kvůli tomuto nezávislému číslu o něm píšu.

Co Grok 4.7 je

Model stojí na novém, větším základním modelu než Grok 4.6. Prošel delším posilovaným učením na úlohách, které trvají mnoho hodin, a v tréninku dostal inženýrská data SpaceX. Cena se proti předchůdci nezměnila, tedy 2 a 6 USD za milion tokenů. Kontextové okno má 500 tisíc tokenů.

Kde stojí v žebříčku

Artificial Analysis mezitím přešla na novou verzi indexu inteligence s deseti hodnoceními, a tím se změnila i stupnice. S hodnotami ze starších článků proto tato čísla srovnávat nejdou.

ModelIndex v4.3.2
Claude Fable 5.153
GPT-6 Astra53
Claude Opus 551
Claude Fable 550
Muse Spark 1.348
GPT-5.6 Sol47
Grok 4.746
Grok 4.644

Grok 4.7 si proti předchůdci polepšil o dva body. Podle benchmarku se tím SpaceXAI dostala mezi čtyři nejsilnější laboratoře a to není malý výsledek. Na elitu, tedy na Fable 5.1 a GPT-6 Astra, mu ale chybí sedm bodů a o bod ho předstihl i starší GPT-5.6 Sol. Skok mezi elitu, který Musk sliboval, se nekonal.

Kde se ke špičce přiblížil

Dlouhá kancelářská a analytická práce. Test AA-Briefcase dává modelu rozsáhlé podklady, ze kterých má vytvořit dokumenty, tabulky a prezentace. Grok 4.7 v něm získal 1657 bodů Elo, o 111 víc než Grok 4.6, a před ním jsou jen Claude Opus 5 a Fable 5.1. V příbuzném testu GDPval-AA má 1695 bodů, o 90 víc než předchůdce.

Programování ve vlastním prostředí. V Coding Agent Indexu dosáhl s nástrojem Grok Build 56 bodů, o devět víc než Grok 4.6. Mezi modely, které běží ve svých nativních prostředích, je čtvrtý, za Fable 5.1, GPT-6 Astra a Opusem 5.

Právní úlohy. V benchmarku Harvey Legal vede se zhruba 20 procenty a první místo drží už od verze 4.5.

Klesla také míra halucinací, tedy vymýšlení odpovědí u faktů, které model nezná, a to z 34 na 29 procent.

Kde zaostává

Dlouhá práce v terminálu. SpaceXAI v oznámení uvádí pro Terminal-Bench 4.0 výsledek 38 procent. Artificial Analysis naměřila ve svém jednotném běhovém rámci 26 procent, což je méně než u levného DeepSeek V4.1 Flash. GPT-6 Astra má 60 procent a Fable 5.1 55 procent. Rozdíl mezi číslem výrobce a měřiče jde nejspíš na vrub odlišného prostředí. Ke špičce ale Grok v této disciplíně nepatří podle žádného z obou čísel.

Elektrotechnika. Tady měla pomoci data SpaceX. Grok s 64 procenty v benchmarku EEBench znatelně předstihl předchůdce i Fable 5.1, oficiální žebříček testu ale vede GPT-6 Astra se 69 procenty.

Kolik to stojí

Ceník za token zůstal stejný, model ale na jednu úlohu spotřebuje víc než dvakrát tolik tokenů co Grok 4.6.

ModelVýstupní tokeny na úlohu
Grok 4.7 (xhigh)81 tisíc
Muse Spark 1.3 (max)60 tisíc
Grok 4.6 (xhigh)38 tisíc
GPT-6 Astra (max)27 tisíc

Průměrná úloha indexu mu trvala zhruba sedm minut. Za stejnou práci tak zaplatíte víc, než napovídá nezměněný ceník. Proti modelům OpenAI a Anthropicu to je pořád méně.

Závěrem: Co si z toho odnést?

Vyzkoušel bych ho na dlouhé kancelářské a analytické úlohy a na právní agendu, kde se ke špičce dostal nejblíž. Dává smysl také tehdy, když hlídáte cenu za token.

Sáhl bych jinam u práce v terminálu a všude, kde potřebujete absolutní špičku. Sám používám Grok Build kvůli jeho rychlosti, ale spíše výjimečně, na drobnější práce.

Pro české firmy: SpaceXAI je americká firma a data zpracovává v USA. Pokud máte vůči klientům závazek držet data v EU, ověřte si to předem - zatím to nevypadá, že by EU servery nabízeli.

Za mě je Grok 4.7 poctivý posun o jeden stupeň, ne o tři, které Musk sliboval. SpaceXAI sama v oznámení mluví střízlivěji o modelu vysoce konkurenceschopném ve své třídě a měření jí v tom dává za pravdu.


Zdroje: oznámení SpaceXAI z 21. září 2026, měření Artificial Analysis (index inteligence verze 4.3.2, AA-Briefcase, GDPval-AA, Coding Agent Index), oficiální žebříček EEBench od firmy atopile. Platnost údajů k 22. září 2026.

Patrick Zandl

Lektor agentního vývoje a technologický publicista. Od roku 2025 provozuje Vibecoding.cz — česky psaný web o AI nástrojích pro vývojáře — a vede veřejné workshopy Claude Code v Praze; firemní AI workshopy vede na aivefirmach.cz.

Profil autora →