xAI Grok premiera modelu agenty AI

xAI wydaje Grok 4.6 – nacisk na długo działających agentów

xAI zaprezentował Grok 4.6, model nastawiony na długo działających agentów oraz ambitniejsze zadania interaktywne i wizualne. W AA Intelligence Index nowa wersja zrównała się z GPT-5.6 Sol, a cennik API ustawiono agresywnie – 2 dolary za milion tokenów wejściowych.

xAI wydaje Grok 4.6 – nacisk na długo działających agentów

Grok 4.6 – co dokładnie ogłosiło xAI?

xAI udostępnił 12 sierpnia model Grok 4.6. Firma opisuje go jako krok w stronę „długo działających agentów” oraz bardziej ambitnej pracy interaktywnej i wizualnej – model ma lepiej zamieniać pomysły w działające projekty i samodzielnie testować oraz weryfikować własne wyniki na dłuższych ścieżkach zadań.

W ogłoszeniu podano wyniki benchmarków: 61 punktów w AA Intelligence Index (wobec 56 dla Groka 4.5 i na równi z GPT-5.6 Sol), 69,9% w CursorBench v3.2, 65,9% w DeepSWE v1.1, 61,3% we FrontierCode v1.1 oraz 26% w Terminal-Bench v3.0. Warto pamiętać, że to liczby raportowane przez producenta – niezależne ewaluacje zwykle pojawiają się w kolejnych tygodniach.

Model od dnia premiery jest dostępny w edytorze Cursor, w Grok Build, przez konsolę API oraz u partnerów: OpenRouter, Vercel i Cloudflare. Cennik ustawiono na 2 dolary za milion tokenów wejściowych i 6 dolarów za milion wyjściowych, z droższym wariantem szybkim i promocją podwójnego limitu użycia w pierwszym tygodniu.

Nasz komentarz: xAI coraz wyraźniej buduje własny łańcuch dystrybucji – premiera od pierwszego dnia w Cursorze, na OpenRouterze i u dostawców chmurowych to dziś równie ważna informacja jak same benchmarki.

Wyścig agentowy zagęszcza się na środkowej półce cenowej

Naszym zdaniem Grok 4.6 potwierdza kierunek, w którym zmierza cała czołówka: kolejne wydania nie walczą już o efektowność pojedynczej odpowiedzi, tylko o niezawodność modelu pozostawionego z zadaniem na dłużej. Nacisk na samotestowanie i weryfikację własnych wyników to dokładnie ta cecha, której brakowało agentom porzucającym zadanie w połowie.

W naszej ocenie z tej premiery płyną trzy obserwacje:

  • Parytet na szczycie robi się normą – zrównanie z GPT-5.6 Sol w AA Intelligence Index pokazuje, że różnice między czołowymi modelami topnieją, a o wyborze coraz częściej decydują cena, dostępność i niezawodność w długich zadaniach.
  • Dystrybucja jest częścią produktu – obecność od dnia premiery w Cursorze, OpenRouterze, Vercelu i Cloudflare skraca drogę od ogłoszenia do realnego użycia praktycznie do zera.
  • Benchmarki producenta wymagają cierpliwości – wyniki z dnia premiery pochodzą z materiałów xAI; rozsądnie jest poczekać na niezależne ewaluacje, zanim uzna się przewagę za potwierdzoną.

Uważamy, że przy cenie 2/6 dolarów za milion tokenów Grok 4.6 celuje w tę samą półkę, o którą walczy Google tanimi modelami Flash – i to właśnie na niej, a nie wśród flagowców, rozstrzygnie się, kto obsłuży masowe wdrożenia agentów.

W skrócie

  • xAI wydał Grok 4.6 – model projektowany pod długo działających agentów, z samotestowaniem wyników na dłuższych zadaniach.
  • W AA Intelligence Index model uzyskał 61 punktów, zrównując się z GPT-5.6 Sol; pozostałe wyniki to dane producenta sprzed niezależnych ewaluacji.
  • Cennik API to 2/6 dolarów za milion tokenów; model od premiery dostępny w Cursorze, Grok Build, API oraz przez OpenRouter, Vercel i Cloudflare.

Opracowanie redakcyjne na podstawie artykułu xAI: https://x.ai/news/grok-4-6