LLM

OpenAI wprowadza GPT-6.1 Sol. Koszt spada głównie przy ponownym użyciu kontekstu

Zaledwie tydzień po debiucie GPT-6 Sol firma OpenAI udostępniła jego następcę – GPT-6.1 Sol. Model przygotowano z myślą o zadaniach programistycznych, obsłudze interfejsów graficznych oraz wieloetapowej pracy agentowej. W testach przedstawionych przez firmę w wybranych zastosowaniach zbliża się on do GPT-6 Astra, jednak główna różnica kosztowa nie wynika z ogólnej obniżki stawek, lecz z tańszego przetwarzania pamięci podręcznej.

W API standardowe ceny wejścia i wyjścia pozostały na poziomie poprzednika: wynoszą odpowiednio 2 dolary za milion tokenów wejściowych i 10 dolarów za milion tokenów wyjściowych. Zmieniła się natomiast stawka za odczyt danych z pamięci podręcznej (cache) – kosztuje teraz 0,10 dolara za milion tokenów. To o 95 proc. mniej niż przy standardowym wejściu i o połowę taniej niż w GPT-6 Sol. Taka struktura rozliczeń ma znaczenie przede wszystkim dla agentów, które w trakcie długich zadań wielokrotnie odwołują się do tego samego kodu lub obszernego kontekstu.

Deklarowane wyniki w benchmarkach

W materiałach porównawczych OpenAI przedstawia stosunek kosztów do możliwości w konkretnych testach syntetycznych. W benchmarku inżynierii oprogramowania DeepSWE v1.1 GPT-6.1 Sol uzyskał wynik zbliżony do GPT-6 Astra przy deklarowanym koszcie zadania wynoszącym około jednej piątej kosztu Astry, poprawiając najlepszy rezultat GPT-6 Sol o 6,4 punktu procentowego przy niższym nakładzie obliczeniowym na rozumowanie.

W AutomationBench model wyprzedził Opus 5.5 o 2,2 punktu procentowego przy średnim wysiłku rozumowania (o 4,8 punktu lepiej niż GPT-6 Sol), przy czym OpenAI podaje, że koszt zadania wyniósł około jednej trzeciej kosztu konkurenta. W zadaniach obsługi komputera (część offline OSWorld 2.0) do Astry zabrakło mu 2,1 punktu, przy deklarowanym koszcie pojedynczego wykonania niższym około siedmiokrotnie.

Nowy model nie wyprzedza jednak Astry we wszystkich zastosowaniach. W teście Terminal-Bench Science to GPT-6 Astra zachowuje prowadzenie z wynikiem 68,1 proc. i pozostaje rekomendacją producenta do najbardziej wymagających prac badawczych. GPT-6.1 Sol osiągnął w tym teście średni koszt 5,47 dolara za zadanie (wobec 23,80 dolara dla Astry i 23,21 dolara dla Opus 5.5).

Dostępność i zapowiedź wersji Ultrafast

GPT-6.1 Sol jest dostępny dla użytkowników planów Plus, Pro, Business, Enterprise oraz Edu w ChatGPT Work i w środowisku Codex. Deweloperzy mogą korzystać z niego przez API pod identyfikatorem gpt-6.1-sol. Model nie został udostępniony w standardowym interfejsie ChatGPT.

OpenAI zapowiedziało także wariant GPT-6.1 Sol Ultrafast przeznaczony do środowiska Codex. Według deklaracji ma on generować tokeny do ośmiu razy szybciej; jego wdrożenie zaplanowano na najbliższe dni.