LLM

Anthropic wprowadza Claude 4.6 Sonnet: Nowa era adaptacyjnego wnioskowania i miliona tokenów

Anthropic oficjalnie inauguruje etap, który wewnątrz firmy określa się mianem „ery myślenia”. Nowy model Claude 4.6 Sonnet nie jest jedynie kolejną iteracją wydajnościową, lecz strategicznym przesunięciem w stronę systemów zdolnych do głębokiego rozumowania przed udzieleniem odpowiedzi. Zamiast generować kod lub tekst impulsywnie, jednostka ta wykorzystuje autorski silnik Adaptive Thinking, tworząc wewnętrzne monologi pozwalające na weryfikację logiki w czasie rzeczywistym. Dla programistów oznacza to koniec z „zgadywaniem” rozwiązań przez AI – model najpierw identyfikuje pierwotną przyczynę błędu, np. w skomplikowanych wyścigach (race conditions), a dopiero potem dostarcza poprawkę.

Inteligencja, która potrafi się zatrzymać

Kluczową innowacją jest parametr „effort”, który pozwala modelowi dynamicznie zarządzać zasobami obliczeniowymi. Claude 4.6 Sonnet potrafi ocenić, czy zadanie wymaga natychmiastowej reakcji, czy może dłuższego procesu analitycznego. Ta funkcja drastycznie redukuje problem halucynacji, który jest zmorą szybkich modeli językowych. W scenariuszach związanych z porządkowaniem danych (data cleaning), model poświęca dodatkowy czas na analizę wartości odstających i niespójności w schematach, zamiast bezrefleksyjnie przetwarzać otrzymany zestaw informacji.

Kod ukryty w wyszukiwarce

Anthropic w wyjątkowy sposób podszedł do problemu aktualności wiedzy. Zamiast tradycyjnego scrapowania pierwszych wyników z wyszukiwarki, Claude 4.6 Sonnet korzysta z Improved Web Search z dynamicznym filtrowaniem. System ten uruchamia kod Python w bezpiecznej piaskownicy (sandbox), aby przefiltrować i zweryfikować pozyskane dane. Jeśli użytkownik szuka biblioteki z konkretnego roku, sztuczna inteligencja programistycznie odrzuca nieaktualne źródła i priorytetyzuje zaufane centra (trusted hubs), takie jak GitHub czy oficjalne dokumentacje. Wynik? Skok celności wyszukiwania z 33,3% do blisko 47%, co w praktyce oznacza koniec z przestarzałymi fragmentami kodu.

Milion tokenów i sprawność agentów

Dla branży enterprise kluczowe będzie rozszerzone okno kontekstowe, które w wersji beta wzrosło do miliona tokenów. Pozwala to na załadowanie całych repozytoriów kodu lub potężnych archiwów technicznych bez ryzyka, że model „zapomni” instrukcje z początku promptu. Wydajność ta idzie w parze z imponującymi wynikami w benchmarkach: 72,5% w teście OSWorld sugeruje, że Claude zbliża się do ludzkiej precyzji w nawigowaniu po systemach operacyjnych, przeglądarkach i plikach lokalnych.

Mimo ogromnego skoku technologicznego, Anthropic utrzymał agresywną politykę cenową (3 USD za 1 mln tokenów wejściowych), pozycjonując Sonnet 4.6 jako „woła roboczego” produkcji. Dzięki lepszej zgodności z instrukcjami systemowymi i nowemu interfejsowi Thought, model staje się fundamentem dla budowy autonomicznych agentów, którzy potrafią nie tylko wykonywać zadania, ale przede wszystkim rozumieć ich głęboki kontekst techniczny.