Grok 4.7: tania alternatywa z luką do liderów AI

xAI, firma Elona Muska, zaprezentowała Grok 4.7 – swój najbardziej zaawansowany model do programowania i pracy z wiedzą. Nowa wersja opiera się na większym modelu bazowym, przeszła dłuższy trening z uczeniem ze wzmocnieniem i została zaprojektowana tak, by lepiej weryfikować własne odpowiedzi. Największym atutem okazuje się jednak cena, która znacząco odbiega od stawek zachodniej konkurencji.

Ile kosztuje Grok 4.7 i gdzie można go uruchomić

Za milion tokenów wejściowych zapłacimy 2 dolary, a za milion tokenów wyjściowych – 6 dolarów. To stawki znacznie bliższe modelom chińskim niż rozwiązaniom od Anthropic czy OpenAI. Takie podejście cenowe może być świadomą strategią xAI, która próbuje konkurować kosztami, skoro wyniki benchmarków nie pozwalają jeszcze na walkę o prymat jakościowy.

Model jest dostępny przez Grok API, w edytorze Cursor oraz w narzędziu Grok Build. Dla zespołów szukających tańszej alternatywy dla flagowych modeli to potencjalnie interesująca propozycja – pod warunkiem, że ich zadania nie wymagają najwyższej precyzji w złożonych scenariuszach.

Jak wypada w niezależnych testach

Artificial Analysis Intelligence Index w wersji 4.3.2, który łączy wyniki dziesięciu różnych benchmarków, przyznaje Grokowi 4.7 46 punktów. To lokata w środku stawki. Liderzy – Claude Fable 5.1 oraz GPT-6 – osiągają po 53 punkty. Różnica siedmiu punktów w zagregowanym rankingu nie brzmi dramatycznie, ale w praktyce przekłada się na wyraźne różnice w konkretnych zastosowaniach.

Ciekawostką jest fakt, że dwa najwyższe poziomy rozumowania w Groku 4.7 wypadają niemal identycznie. Oznacza to, że przełączanie na tryb „głębszego myślenia” nie przynosi wymiernych korzyści w testach – co może rozczarować użytkowników liczących na skok jakości przy trudniejszych zadaniach.

Kodowanie agentowe to najsłabszy punkt

Największa przepaść ujawnia się w testach Terminal-Bench 4.0, sprawdzających zdolność modelu do samodzielnego działania w środowisku terminala. Grok 4.7 osiąga tam zaledwie 26 procent, podczas gdy GPT-6 Astra notuje 60 procent, a Claude Fable 5.1 – 55 procent.

Co więcej, nawet tańszy DeepSeek V4.1 Flash wyprzedza Groka, uzyskując 27 procent. To wynik, który stawia nowy model xAI w niekomfortowej pozycji – nie tylko przegrywa z zachodnimi flagowcami, ale też nie dominuje w segmencie budżetowym.

Co to oznacza dla rynku modeli AI

Premiera Groka 4.7 pokazuje rosnące rozwarstwienie rynku. Z jednej strony mamy frontierowe modele Claude i GPT, które wyznaczają standardy w złożonych zadaniach agentowych. Z drugiej – tańsze rozwiązania, które próbują przyciągnąć użytkowników ceną, świadomie akceptując gorsze wyniki w wymagających benchmarkach.

Dla deweloperów i firm wybór staje się coraz bardziej zależny od konkretnego zastosowania. Proste zadania tekstowe czy podstawowa generacja kodu mogą być obsłużone przez tańsze modele bez odczuwalnej straty jakości. Jednak automatyzacja złożonych workflowów, gdzie liczy się niezawodność i samodzielność agenta, wciąż wymaga sięgania po droższe rozwiązania.

xAI wyraźnie stawia na dostępność i konkurencyjną cenę, odkładając walkę o prymat technologiczny na później. Czy ta strategia się opłaci – przekonamy się, obserwując, jak deweloperzy zareagują na kompromis między kosztem a możliwościami nowego Groka.

Źródło