Imagine Image 2.0 tuż za GPT-Image-2 w rankingu Arena

Firma xAI wprowadziła na rynek nową wersję swojego generatora grafik – Imagine Image 2.0. Model zadebiutował w trybie „Quality Mode” na platformie grok.com/imagine oraz w mobilnych aplikacjach Grok na systemy iOS i Android. Według zapowiedzi producenta, dostęp do API dla tego rozwiązania pojawi się wkrótce. Największą uwagę przykuwa jednak wynik, jaki osiągnął w niezależnych testach porównawczych Arena – plasuje się tuż za modelem GPT-Image-2 od OpenAI.

Wyniki w rankingu Arena i porównanie z konkurencją

W zestawieniach Arena opublikowanych 7 sierpnia 2026 roku, szybszy wariant „low” modelu Imagine 2.0 zajął drugą pozycję na świecie w dwóch kategoriach. W edycji obrazów (Image Edit Arena) uzyskał wynik 1439 punktów Elo, podczas gdy prowadzący GPT-Image-2 od OpenAI zdobył 1463 punkty. W kategorii generowania tekstu na obraz (Text-to-Image Arena) nowy model xAI osiągnął 1320 punktów, ponownie ustępując rozwiązaniu OpenAI, które uzyskało 1380 punktów.

Za modelem xAI w zestawieniu znalazły się takie systemy jak Reve 2.1 od xAI, Muse-Image od Meta, Qwen-Image-3.0-Pro od Alibaba, a także Gemini od Google i SeedDream od ByteDance. Co istotne, nowy model wyraźnie pokonał w testach wariant „Quality” swojego poprzednika, co pokazuje znaczący postęp jakościowy w stosunku do pierwszej generacji.

Narzędzia edycyjne zaprojektowane z myślą o iteracyjnej pracy

Imagine Image 2.0 został wyposażony w szereg funkcji, które mają ułatwić pracę nad grafiką w trybie iteracyjnym. Producent chwali się, że model precyzyjnie wykonuje złożone instrukcje, zachowuje czytelną typografię i czysty układ w skomplikowanych wizualizacjach, a także utrzymuje spójność w kolejnych generacjach.

Kluczowe funkcje edycyjne

W pakiecie znalazły się następujące narzędzia:

  • Magic Wand – modyfikuje wyłącznie zaznaczony fragment obrazu, pozostawiając resztę bez zmian.
  • Segmentacja – umożliwia wybór precyzyjnych regionów grafiki do dalszej obróbki.
  • Usuwanie tła – eksportuje obiekty z przezroczystym tłem, co przydaje się przy tworzeniu assetów.
  • Multi-Ref Editing – pozwala połączyć nawet pięć różnych obrazów wejściowych w jedną, spójną generację.
  • Smart Resize – automatycznie dopasowuje grafikę do dowolnego formatu, a model sam uzupełnia brakujące obszary.

Szablony i przygotowanie do produkcji wideo

xAI dodaje również gotowe szablony, które grupują typowe zadania graficzne w skonfigurowane punkty startowe. Kategorie obejmują edycję zdjęć, fotografię produktową, materiały marketingowe, narzędzia projektowe, assety do gier oraz emoji do streamingu.

Producent prezentuje także funkcję, która generuje osobno postacie, lokalizacje i rekwizyty, utrzymując przy tym spójny styl wizualny we wszystkich elementach. Firma pozycjonuje to rozwiązanie jako krok w stronę pełnych procesów produkcji wideo. Imagine 2.0 potrafi tworzyć spójne światy wizualne z postaciami, rekwizytami i lokacjami, które mogą służyć jako punkt wyjścia do realizacji materiałów filmowych.

Debiut Imagine Image 2.0 pokazuje, że xAI poważnie myśli o rywalizacji z OpenAI w obszarze generatywnej grafiki. Model nie tylko zbliżył się wynikami do lidera, ale też oferuje praktyczne narzędzia, które mogą przekonać twórców do zmiany dotychczasowych narzędzi pracy. Najbliższe miesiące pokażą, czy użytkownicy docenią nowe funkcje i czy xAI zdoła utrzymać tempo rozwoju w tej dynamicznej dziedzinie.

Źródło