Grok 4.5 wchodzi do gry: Czy niska cena zrekompensuje braki w wydajności?
Elon Musk i jego zespół z xAI rzucili rękawicę gigantom rynku AI, prezentując najnowszy model Grok 4.5. Choć rynkowa premiera przynosi mieszane wyniki w testach syntetycznych, firma stawia na bezkompromisową wojnę cenową. Model został wyceniony na poziomie 2 USD za milion tokenów wejściowych i 6 USD za wyjściowe, co drastycznie podkopuje pozycję konkurencji. Dla porównania, za korzystanie z Fable 5 od Anthropic zapłacimy odpowiednio 10 USD i 50 USD, co czyni propozycję xAI wyborem niemal budżetowym w klasie premium.
To kluczowy moment dla branży. Grok 4.5 oficjalnie wszedł w fazę zamkniętych testów wewnątrz SpaceX oraz Tesli, a jego niska cena zmusza liderów rynku do natychmiastowej rewizji cenników. xAI dysponuje potężnym argumentem: 1,5 biliona parametrów opartych na architekturze V9, co przy obecnych kosztach eksploatacji stawia model w roli niezwykle agresywnego konkurenta.
Architektura szkolenia i benchmarki
Grok 4.5 powstał dzięki ogromnej mocy obliczeniowej dziesiątek tysięcy procesorów Nvidia GB300. Inżynierowie xAI skupili się na rygorystycznym filtrowaniu danych i dedykowanej infrastrukturze do asynchronicznego uczenia maszynowego. Efekty są widoczne w zadaniach związanych z linią komend – w teście Terminal Bench 2.1 model uzyskał 83,3%, niemal zrównując się z GPT 5.5. Elon Musk idzie o krok dalej, twierdząc, że ’wydajność Grok 4.5 jest bliska – a momentami nawet przewyższa – możliwości Claude Opus od Anthropic’.
Jednak tam, gdzie wymagane jest głębokie rozumowanie przy rozwiązywaniu realnych problemów z repozytoriów GitHub (DeepSWE 1.1), Grok 4.5 z wynikiem 53% wyraźnie odstaje od rywali z OpenAI i Anthropic, którzy przekraczają próg 67%. Pasquale Pillitteri radzi, by traktować te liczby jak obietnice, a nie wyniki, dopóki model pozostaje w zamkniętej becie.
Efektywność kluczem do sukcesu
Poza samym cennikiem, xAI promuje Groka jako narzędzie wyjątkowo sprawne operacyjnie. Według deklaracji producenta, model zużywa ponad cztery razy mniej tokenów niż Opus 4.8 przy realizacji tych samych zadań programistycznych, generując przy tym wyniki z prędkością 80 tokenów na sekundę. To podejście przypomina strategię chińskich graczy: dostarczyć produkt wystarczająco dobry, by zrealizować większość komercyjnych zadań, ale za ułamek ceny rynkowych liderów.
Ekosystem i dostępność
Nowy model jest już integrowany z popularnymi narzędziami biurowymi Microsoftu oraz edytorem kodu Cursor. Niedawne przejęcie Cursora przez SpaceX za 60 miliardów dolarów jasno pokazuje, skąd xAI zamierza czerpać dane treningowe do optymalizacji kodu. Mimo dynamicznego startu w USA, użytkownicy w Unii Europejskiej muszą uzbroić się w cierpliwość. Ze względu na lokalne bariery regulacyjne, premiera na starym kontynencie planowana jest dopiero na połowę lipca.
