xAI 12. srpna 2026 představilo Grok 4.6, další generaci svého frontier modelu. Model se výrazně zaměřuje na dlouhodobější agentní práci, programování a úlohy, při kterých musí systém postupně provést větší množství kroků místo jediné otázky a odpovědi. Podporuje textové i obrazové vstupy a nabízí velmi rozsáhlé kontextové okno.
V nezávislých hodnoceních se Grok 4.6 pohybuje mezi nejvýkonnějšími současnými modely a v některých oblastech se dostává velmi blízko systémům typu GPT-5.6 Sol.
Výsledky jednotlivých benchmarků se ale výrazně liší a není přesné z nich vyvozovat, že Grok 4.6 obecně překonává všechny konkurenční modely.
Důležitější než několik bodů v benchmarku je posun zaměření: xAI, stejně jako ostatní velké laboratoře, optimalizuje model stále více pro dlouhodobou práci agenta, nikoliv pouze pro jednotlivé chatové odpovědi.
Komentář
Tohle je podle mě podstatnější než otázka, zda má Grok v konkrétním žebříčku 67 nebo 69 bodů. AI trh se postupně přesouvá od: „Který chatbot odpoví nejlépe na jednu otázku?“ k mnohem praktičtější otázce: „Který systém dokáže dvě hodiny samostatně pracovat, používat nástroje, průběžně kontrolovat výsledky a na konci skutečně dokončit úkol?“
Napsat komentář