Anthropic prezentuje Claude Opus 4.8: Koniec z udawaniem nieomylności
Anthropic nie daje odpocząć konkurencji. Zaledwie sześć tygodni po premierze wersji 4.7, na rynek trafia Opus 4.8. To nie jest kosmetyczna poprawka ani walka o kolejne setne punktów w abstrakcyjnych testach. Twórcy wzięli na warsztat wiarygodność i realną użyteczność w środowisku pracy.
Premiera ta ma kluczowe znaczenie, ponieważ Anthropic przesuwa akcent z czystej mocy obliczeniowej na kontrolę wysiłku poznawczego i rzetelność w zadaniach agentowych. W rzeczywistości, gdzie modele AI często maskują błędy, byle tylko zachować pozory sprawstwa, nowy Opus stawia na przejrzystość. Jak podaje Anthropic w swojej dokumentacji, model jest bardziej niezawodny na każdym poziomie wysiłku w szerokim zakresie dziedzin, co ma ułatwić pracę zespołową i złożone wdrożenia w sektorze enterprise.
Uczciwość zamiast halucynacji
Kluczowym hasłem aktualizacji jest „uczciwość”. Opus 4.8 ma teraz czterokrotnie rzadziej ignorować własne błędy i częściej otwarcie komunikować brak pewności co do udzielanej odpowiedzi. To istotna korekta kursu. Poprawę widać w liczbach: wielodyscyplinarne rozumowanie wzrosło z 54,7% do 57,9%. Model nie próbuje już za wszelką cenę zadowolić użytkownika zmyślonymi faktami, co do tej pory było największą bolączką płatnych planów.
Precyzja w kodowaniu i suwak wysiłku
Dla deweloperów najistotniejszą nowością będą wyniki w zadaniach agentowych. Skuteczność w agentic coding podskoczyła z 64,3% do 69,2%. W połączeniu z nowymi narzędziami, pozwala to na obsługę potężnych migracji kodu. Anthropic wprowadził funkcję dynamicznych przepływów pracy, która według firmy pozwala Claude’owi „zaplanować większe zadanie, a następnie uruchomić setki równoległych subagentów w jednej sesji”.
Użytkownicy serwisu claude.ai otrzymali do ręki innowacyjny „suwak wysiłku”. Ta pięciostopniowa skala pozwala ręcznie sterować głębią analizy. Wyższe ustawienia oznaczają rygorystyczne rozumowanie, ale wiążą się z dłuższym oczekiwaniem i szybszym drenażem limitu tokenów. To próba oddania kontroli nad kosztami i czasem w ręce człowieka.
Szybciej, taniej, ale wciąż z krótką pamięcią
Mimo postępów w logice, Opus 4.8 nadal boryka się z ograniczeniami. Pierwsze testy pokazują, że model miewa trudności z utrzymaniem kompletu wytycznych w długim kontekście, co zmusza do ponawiania instrukcji. Firma próbuje to zrekompensować optymalizacją kosztów. Tryb fast przyspieszył 2,5-krotnie i stał się trzykrotnie tańszy niż w poprzedniej wersji.
Dla użytkowników indywidualnych cena subskrypcji Pro pozostaje bez zmian – około 94 zł miesięcznie. Przy obecnym wzroście wydajności oferta Anthropic staje się wyjątkowo agresywną alternatywą dla propozycji od OpenAI czy Google, szczególnie pod kątem czystej, programistycznej roboty.
