LLM

OpenAI udostępnia GPT-5.5 Instant: Mniej halucynacji i koniec z przegadanymi odpowiedziami

OpenAI zdecydowało się na radykalne odświeżenie silnika napędzającego ChatGPT. Dotychczasowy GPT-5.3 Instant zostaje zastąpiony nową wersją – GPT-5.5 Instant, która od teraz figuruje jako domyślny model dla wszystkich użytkowników. Twórcy zapowiadają, że priorytetem w tej odsłonie było wyeliminowanie dwóch największych bolączek dużych modeli językowych: halucynacji oraz nadmiernej gadatliwości.

Koniec z potakiwaniem błędnym wynikom

Z punktu widzenia dziennikarskiego najbardziej rzuca się w oczy spadek liczby błędów merytorycznych. Zgodnie z wewnętrznymi testami OpenAI, nowy model generuje o 52,5% mniej halucynacji w zapytaniach o wysokim stopniu ryzyka, dotyczących m.in. medycyny, prawa czy finansów. To istotny krok, biorąc pod uwagę, że wcześniejsze wersje często bezkrytycznie przyznawały rację użytkownikowi, nawet gdy ten prezentował błędne obliczenia.

Przełom widać w sposobie korygowania błędów logiki krok po kroku. Podczas gdy starszy GPT-5.3 Instant miewał problemy z wychwyceniem błędów w równaniach kwadratowych, GPT-5.5 Instant potrafi samodzielnie odnaleźć pomyłkę w przekształceniach użytkownika i dostarczyć prawidłowe rozwiązanie. Skok jakościowy potwierdzają benchmarki: w zaawansowanym teście matematycznym AIME 2025 skuteczność wzrosła z 65,4% do imponujących 81,2%, a w badaniach naukowych na poziomie doktoranckim (GPQA) model osiągnął ponad 85% trafności.

Przejrzystość danych: Skąd model to o nas wie?

Wraz z modelem zadebiutowała funkcja „źródeł pamięci” (memory sources). To odpowiedź na obawy o prywatność i brak transparentności w logice AI. Teraz użytkownik może dokładnie sprawdzić, która notatka, plik czy archiwalna rozmowa wpłynęły na personalizację konkretnej odpowiedzi. OpenAI pozwala na edycję lub usuwanie tych wpisów, co daje większą kontrolę nad cyfrowym śladem pozostawianym w systemie.

Warto jednak zauważyć, że rozwiązanie to nie jest jeszcze w pełni kompletne. System nie zawsze wyświetla wszystkie czynniki, które brał pod uwagę, a w przypadku udostępniania czatu osobom trzecim, dane te pozostają ukryte. Personalizacja, czerpiąca z plików i kont Gmail, trafia w pierwszej kolejności do subskrybentów planów Plus i Pro, a użytkownicy darmowi muszą uzbroić się w kilka tygodni cierpliwości.

Dostrajanie formy i hierarchia możliwości

Dziennikarski warsztat nakazuje docenić walkę z tzw. laniem wody. GPT-5.5 Instant ma być modelem oszczędnym w słowach – rezygnuje z niepotrzebnych emoji, nadmiernego formatowania tekstu i zbędnych pytań pomocniczych. OpenAI obiecuje, że model dostarczy ten sam zakres informacji przy mniejszej objętości tekstu, co ma bezpośrednio przełożyć się na użyteczność w codziennej pracy.

W hierarchii OpenAI model Instant pozostaje jednak tym „codziennym” wyborem. Dla zadań krytycznych, takich jak programowanie czy cyberbezpieczeństwo, zarezerwowano model GPT-5.5 Thinking, który ma konkurować z najpotężniejszymi rozwiązaniami na rynku, takimi jak Claude Mythos. Dla przeciętnego użytkownika zmiana będzie jednak odczuwalna od razu: ChatGPT stanie się po prostu bardziej konkretny i mniej podatny na błędy, których do tej pory uporczywie bronił.