2026-09-22 · 4 min čtení
Nový Grok 4.7 stojí v API 2 USD za milion vstupních tokenů, tedy stejně jako předchůdce. V nezávislém indexu Artificial Analysis má ale 46 bodů proti 53 bodům u Claude Fable 5.1 a GPT-6. V agentním kódování je rozdíl ještě větší.
Grok 4.7 byl podle příspěvku vydavatele na síti X uveden 21. září 2026 a v API stojí 2 USD za milion vstupních tokenů a 6 USD za milion výstupních — tedy přesně stejně jako předchozí Grok 4.6. V nezávislém testu Artificial Analysis Intelligence Index (verze v4.3.2, který kombinuje deset benchmarků) ale získal 46 bodů, zatímco vedoucí Claude Fable 5.1 a GPT-6 mají 53 bodů.
Podle vydavatele stojí Grok 4.7 na větším základním modelu, byl trénovaný delším reinforcement learningem (tedy učením odměnou za správné odpovědi) a je navržený tak, aby si lépe ověřoval vlastní výstup. Elon Musk před uvedením uvedl, že model poběží na základu s 2,1 bilionu parametrů, že do trénování byla zahrnuta data společnosti SpaceX a že model překoná všechny současné modely. Poslední tvrzení nezávislá měření nepotvrzují.
Čísla z Artificial Analysis vypadají takto:
Pozor na jednu věc: Artificial Analysis, BeInCrypto i příspěvky na X označují vydavatele jako „SpaceXAI", zatímco The Decoder píše o xAI. Zda skutečně došlo k přejmenování nebo spojení se SpaceX, se na primárním zdroji ověřit nepodařilo — berte to jako nepotvrzené.
Model je dostupný přes Grok API, v editoru Cursor, v prostředí Grok Build a dále přes cizí kódovací nástroje, model routery a cloudové platformy.
1. Přes API: vytvořte si účet u poskytovatele Groku, vygenerujte API klíč a v požadavku uveďte identifikátor modelu Grok 4.7. Existuje i rychlejší varianta („fast"), která je podle dostupných zdrojů dvakrát dražší než základní verze — konkrétní cenu v USD za milion tokenů zdroje neuvádějí. 2. V Cursoru: model vyberte v nastavení modelů v Cursoru. 3. Přes model router (např. služba, která přeposílá dotazy více modelům): stačí změnit název modelu v konfiguraci.
Když chcete otestovat právě tu schopnost, na které si model podle benchmarků stojí nejlépe — dlouhou znalostní práci s dokumenty — zkuste tento prompt:
Jsi analytik. Níže je pět dokumentů (výroční zpráva, dvě smlouvy,
e-mailová korespondence a tabulka nákladů). Úkol:
1) Vypiš všechna finanční tvrzení, která si mezi dokumenty odporují,
a u každého uveď, ve kterém dokumentu a odstavci jsi je našel.
2) Pak si svůj vlastní seznam zkontroluj a označ body, kde si nejsi
jistý, že jde o skutečný rozpor, a vysvětli proč.
3) Nakonec navrhni tři otázky, které je potřeba doplnit od klienta.
Neuváděj nic, co v dokumentech není.
Bod 2 je tam schválně — právě sebeověřování výstupu je to, co vydavatel u nové verze zdůrazňuje.
Na agentní kódování, tedy samostatné spouštění příkazů v terminálu a opravu chyb v cyklu, je Grok 4.7 zjevně slabší volba: 26 procent na Terminal-Bench 4.0 proti 60 procentům u GPT-6 Astra je rozdíl více než dvojnásobný. Na CursorBench 4.0 i Terminal-Benchi skóruje pod Fable 5.1 Max, na DeepSWE v1.1 mírně pod GPT 5.6 Sol Max. Pokud řešíte složitější refaktoring nebo necháváte agenta pracovat bez dohledu, sáhněte po Claude Opus 5 nebo modelech řady GPT.
Nedohledané jsou navíc dost podstatné parametry: délka kontextového okna, maximální délka výstupu, multimodalita (práce s obrázky) a datum, po které má model znalosti. Neznáme ani případné bezplatné limity v aplikaci Grok nebo v API a dostupnost či omezení použití v EU. Pokud tohle pro vaše nasazení potřebujete vědět, ověřte si to přímo v dokumentaci poskytovatele, než začnete stavět.
Grok 4.7 je zajímavý poměrem výkonu k ceně. Za 2 USD za milion vstupních tokenů dostanete model, který se v dlouhé agentní znalostní práci (AA-Briefcase) drží těsně za nejdražší konkurencí. Pro srovnání: Claude Fable 5 stojí 10 USD za milion vstupních tokenů, tedy pětinásobek — jde ovšem o verzi bez přípony, ne přímo o Fable 5.1 z benchmarkových tabulek, jehož ceníkový údaj tu neuvádíme.
Praktický důsledek: na hromadné zpracování textů, rešerše a rozsáhlejší analýzy dokumentů může být Grok 4.7 rozumná volba, protože stejný typ úlohy u vlajkových modelů znamená několikanásobně vyšší účet. Na programování pod dohledem agenta zůstává rozdíl v úspěšnosti tak velký, že úspora na ceně tokenů se rozplyne v čase, který strávíte opravami.
Ceník základní varianty: 2 USD / 1 M vstupních tokenů, 6 USD / 1 M výstupních tokenů. Varianta „fast" je dvojnásobně dražší, přesná čísla nezveřejněna. Benchmarková čísla pocházejí z Intelligence Indexu v4.3.2 a z privátního benchmarku AA-Briefcase. Skóre 46 bodů řadí vydavatele podle Artificial Analysis do top 4 laboratoří. Hodnoty CursorBench 4.0 (46,3 %) a DeepSWE v1.1 (71,0 %), které kolují na X, nejsou potvrzené primárním zdrojem. Musk dále tvrdí, že Grok 4.8 dokončí trénink a Grok 5 se bude blížit AGI — to je zatím jen prohlášení, ne oznámený produkt.
Zdroj informací: The Decoder (https://the-decoder.com/xai-launches-grok-4-7-at-bargain-prices-but-benchmarks-reveal-a-wide-gap-to-claude-and-gpt-6/), Artificial Analysis, BeInCrypto, tbreak
Téma: Kódování s AI · Ceny a bezplatné tarify