Grok 4.6 – co dokładnie ogłosiło xAI?
xAI udostępnił 12 sierpnia model Grok 4.6. Firma opisuje go jako krok w stronę „długo działających agentów” oraz bardziej ambitnej pracy interaktywnej i wizualnej – model ma lepiej zamieniać pomysły w działające projekty i samodzielnie testować oraz weryfikować własne wyniki na dłuższych ścieżkach zadań.
W ogłoszeniu podano wyniki benchmarków: 61 punktów w AA Intelligence Index (wobec 56 dla Groka 4.5 i na równi z GPT-5.6 Sol), 69,9% w CursorBench v3.2, 65,9% w DeepSWE v1.1, 61,3% we FrontierCode v1.1 oraz 26% w Terminal-Bench v3.0. Warto pamiętać, że to liczby raportowane przez producenta – niezależne ewaluacje zwykle pojawiają się w kolejnych tygodniach.
Model od dnia premiery jest dostępny w edytorze Cursor, w Grok Build, przez konsolę API oraz u partnerów: OpenRouter, Vercel i Cloudflare. Cennik ustawiono na 2 dolary za milion tokenów wejściowych i 6 dolarów za milion wyjściowych, z droższym wariantem szybkim i promocją podwójnego limitu użycia w pierwszym tygodniu.
Nasz komentarz: xAI coraz wyraźniej buduje własny łańcuch dystrybucji – premiera od pierwszego dnia w Cursorze, na OpenRouterze i u dostawców chmurowych to dziś równie ważna informacja jak same benchmarki.
Wyścig agentowy zagęszcza się na środkowej półce cenowej
Naszym zdaniem Grok 4.6 potwierdza kierunek, w którym zmierza cała czołówka: kolejne wydania nie walczą już o efektowność pojedynczej odpowiedzi, tylko o niezawodność modelu pozostawionego z zadaniem na dłużej. Nacisk na samotestowanie i weryfikację własnych wyników to dokładnie ta cecha, której brakowało agentom porzucającym zadanie w połowie.
W naszej ocenie z tej premiery płyną trzy obserwacje:
- Parytet na szczycie robi się normą – zrównanie z GPT-5.6 Sol w AA Intelligence Index pokazuje, że różnice między czołowymi modelami topnieją, a o wyborze coraz częściej decydują cena, dostępność i niezawodność w długich zadaniach.
- Dystrybucja jest częścią produktu – obecność od dnia premiery w Cursorze, OpenRouterze, Vercelu i Cloudflare skraca drogę od ogłoszenia do realnego użycia praktycznie do zera.
- Benchmarki producenta wymagają cierpliwości – wyniki z dnia premiery pochodzą z materiałów xAI; rozsądnie jest poczekać na niezależne ewaluacje, zanim uzna się przewagę za potwierdzoną.
Uważamy, że przy cenie 2/6 dolarów za milion tokenów Grok 4.6 celuje w tę samą półkę, o którą walczy Google tanimi modelami Flash – i to właśnie na niej, a nie wśród flagowców, rozstrzygnie się, kto obsłuży masowe wdrożenia agentów.
W skrócie
- xAI wydał Grok 4.6 – model projektowany pod długo działających agentów, z samotestowaniem wyników na dłuższych zadaniach.
- W AA Intelligence Index model uzyskał 61 punktów, zrównując się z GPT-5.6 Sol; pozostałe wyniki to dane producenta sprzed niezależnych ewaluacji.
- Cennik API to 2/6 dolarów za milion tokenów; model od premiery dostępny w Cursorze, Grok Build, API oraz przez OpenRouter, Vercel i Cloudflare.
Opracowanie redakcyjne na podstawie artykułu xAI: https://x.ai/news/grok-4-6