OpenAI uderza w Anthropic: GPT-5.6 Sol oferuje wydajność flagowca za ułamek ceny
Rynek dużych modeli językowych właśnie wszedł w fazę brutalnej optymalizacji. OpenAI wdrożyło GPT-5.6 Sol — model, który nie tylko dogonił liderów w benchmarkach, ale zrobił to przy drastycznie niższych kosztach eksploatacji. To bezpośredni atak na pozycję Anthropic i ich Claude Mythos 5, który do tej pory uchodził za niedościgniony wzór w zadaniach inżynieryjnych.
Dlaczego to ważne teraz? OpenAI agresywnie przesuwa granicę opłacalności, oferując model trzy razy tańszy od głównego konkurenta. Wprowadzenie Sol do ograniczonej fazy testowej zbiega się w czasie z nowymi rekordami w testach cyberbezpieczeństwa i biologii, co wymusza na branży rewizję strategii cenowych pod presją realnej wydajności w kodowaniu.
Nowy standard opłacalności w segmencie premium
Rynek LLM przestał gonić wyłącznie za parametrami, a zaczął liczyć dolary. Według danych z platformy Artificial Analysis, Sol niemal zrównał się pod względem możliwości z liderem rankingu, osiągając 59 punktów w indeksie inteligencji — traci tym samym zaledwie punkt do Claude. Kluczowa różnica tkwi w cenniku: 1 mln tokenów wejściowych w Sol kosztuje 5 USD, a wyjściowych 30 USD. To sprawia, że korzystanie z narzędzia OpenAI jest aż trzykrotnie tańsze niż w przypadku flagowca od Anthropic.
Dominacja w kodowaniu i zadaniach biurowych
Choć w ogólnym rankingu Sol musi uznać minimalną wyższość konkurentów w niuansach językowych, w zastosowaniach inżynieryjnych przejmuje pałeczkę lidera. Jak zauważa Sam Altman: „GPT-5.6 Sol to nasz najsilniejszy model, wyznaczający nowy stan wiedzy w Terminal-Bench 2.1 dla przepływów pracy związanych z kodowaniem”. W tym konkretnym teście model uzyskał wynik 91,9%, pokonując Claude Mythos 5 (88,0%).
Model radzi sobie świetnie również w symulacjach realnych zadań biurowych. W teście AA-Briefcase uzyskał najwyższe noty za jakość prezentacji. Co więcej, w trybach Max i Ultra Sol otrzymuje zwiększone możliwości rozumowania, potrafiąc dzielić złożone projekty między mniejszych podagentów, co czyni go niemal autonomicznym asystentem programisty.
Agresywna strategia i ograniczenia
Optymalizacja nie kończy się na cenie za milion tokenów. Sol charakteryzuje się wyjątkową oszczędnością: zużywa nawet o 54% mniej tokenów wyjściowych w zadaniach programistycznych niż konkurenci o zbliżonej mocy. DevStock Academy wskazuje, że „Sol jest okrętem flagowym, ponieważ ma być najsilniejszym narzędziem OpenAI w trzech wrażliwych obszarach: pisaniu produkcyjnego kodu, biologii oraz cyberbezpieczeństwie”. To wyjaśnia, dlaczego premierę otacza ścisła kontrola — obecnie dostęp do modelu mają wyłącznie zaufani partnerzy i organizacje z USA.
Branżowy wyścig ku zeru
Nowa oferta OpenAI to nie tylko uderzenie w Anthropic, ale także reakcja na presję ze strony Meta czy xAI. Choć dla klientów tańsza technologia to dobra wiadomość, eksperci są sceptyczni. Agresywne zbijanie marż może odciąć mniejszych graczy od środków na badania. Dodatkowo, geo-fencing nowej technologii budzi irytację w Europie. Jak punktuje serwis Spidersweb, obecna sytuacja sprawia, że najmocniejszy model OpenAI jest zarezerwowany dla wybranych, a reszta świata zostaje na razie wyłączona z gry.
