Na rynku modeli językowych doszło do istotnego przetasowania. Najnowszy model od SpaceXAI, Grok 4.6, zrównał się wynikiem z najlepszymi rozwiązaniami OpenAI, jednocześnie oferując znacznie korzystniejsze warunki cenowe. To sygnał, że rywalizacja w sektorze AI przesuwa się z wyścigu o samą jakość w stronę optymalizacji kosztów i wydajności.
Z danych opublikowanych przez Artificial Analysis wynika, że nowy model zdobywa 61 punktów w ich autorskim indeksie inteligencji. To dokładnie tyle samo, ile osiąga GPT-5.6 Sol od OpenAI. Wyżej plasują się jedynie dwa modele od Anthropic: Claude Opus 5 z wynikiem 63 punktów oraz Claude Fable 5, który uzyskał 62 punkty. Co więcej, skok jakościowy względem poprzednika, modelu Grok 4.5, wynosi aż pięć punktów.
Czym jest indeks Artificial Analysis i dlaczego ma znaczenie
Indeks Artificial Analysis to zagregowany wskaźnik, który łączy wyniki z wielu różnych benchmarków w jeden, łatwy do porównania wynik. Zamiast analizować dziesiątki oddzielnych testów, specjaliści i deweloperzy mogą spojrzeć na jeden numer, który mówi o ogólnej „inteligencji” modelu. Dzięki temu porównanie Grok 4.6 z konkurencją staje się przejrzyste i szybkie.
Warto podkreślić, że wyrównanie do czołówki w tym zestawieniu to nie tylko kwestia prestiżu. Oznacza to, że model SpaceXAI realnie konkuruje z najlepszymi rozwiązaniami dostępnymi na rynku w szerokim spektrum zadań. Dla firm i programistów to kluczowa informacja, ponieważ otwiera drzwi do tańszych, ale wciąż zaawansowanych implementacji.
Dominacja w zadaniach agentowych i efektywność operacyjna
Szczególnie mocną stroną nowego modelu okazują się zadania agentowe. Chodzi tu o sytuacje, w których system AI samodzielnie wykonuje wieloetapowe procesy, podejmując po drodze decyzje i korzystając z różnych narzędzi. W tym obszarze Grok 4.6 radzi sobie wyjątkowo dobrze, co potwierdzają wyniki testu GDPval-AA v2, zaprojektowanego do mierzenia realnej pracy umysłowej na komputerze.
W tym konkretnym porównaniu model SpaceXAI zajmuje drugie miejsce z wynikiem Elo 1,753, ustępując jedynie Claude Opus 5. Co jednak przykuwa uwagę analityków, to liczba kroków potrzebna do wykonania złożonego zadania. Grok 4.6 potrzebuje do tego średnio około 53 kroków, podczas gdy jego najbliższy rywal z Anthropic wymaga ich aż 103. To sugeruje, że model działa nie tylko skutecznie, ale i bardziej bezpośrednio, co w praktyce przekłada się na szybsze odpowiedzi i mniejsze zużycie zasobów.
Agresywna polityka cenowa i dostępność
Kluczowym argumentem przemawiającym za wyborem Grok 4.6 jest jednak cena. Model wyceniono na 2 dolary za milion tokenów wejściowych i 6 dolarów za milion tokenów wyjściowych. To sprawia, że jest on ponad 60 procent tańszy od swoich głównych rywali. Dla porównania, zarówno Claude Opus 5, jak i GPT-5.6 Sol kosztują odpowiednio 5 i 25 dolarów (Claude) oraz 5 i 30 dolarów (GPT) za milion tokenów.
Ta różnica w cenie przy porównywalnej jakości może być decydującym czynnikiem dla startupów i firm skalujących swoje operacje. Niższe koszty jednostkowe oznaczają, że można przetwarzać znacznie większe wolumeny danych lub wdrożyć AI w procesach, które wcześniej były nieopłacalne.
Grok 4.6 jest już dostępny dla klientów. Model można wykorzystać za pośrednictwem oficjalnego API, a także w popularnych narzędziach deweloperskich, takich jak Cursor, Grok Build oraz u partnerów dystrybucyjnych, w tym OpenRouter, Vercel czy Cloudflare. Dodatkowo, aby zachęcić do testów, x.ai przygotowało promocję dla nowych użytkowników. Przez pierwszy tydzień od premiery można liczyć na podwójny limit wykorzystania w środowiskach Grok Build i Cursor.
Debiut Grok 4.6 pokazuje, że rynek modeli AI wchodzi w nową fazę. Doganianie liderów pod względem możliwości to już nie tylko kwestia prestiżu, ale przede wszystkim walka o klienta poprzez inteligentną strategię cenową. To dobra wiadomość dla wszystkich, którzy chcą korzystać z zaawansowanej sztucznej inteligencji bez ponoszenia kosztów, które jeszcze niedawno wydawały się nieuniknione.

