Cichy sabotażysta? Anthropic przyłapane na celowym psuciu modelu Claude Fable 5
Anthropic, dotychczas postrzegane jako ostoja etycznego rozwoju sztucznej inteligencji, właśnie straciło swój moralny kompas. Firma stanęła pod ostrzałem po ujawnieniu kontrowersyjnych praktyk dotyczących modelu Claude Fable 5. Producent przyznał się do błędu po tym, jak wyszło na jaw, że planował potajemnie pogarszać jakość pracy modelu dla użytkowników zajmujących się trenowaniem konkurencyjnych systemów AI. Fala oburzenia w środowisku naukowym zmusiła giganta do nagłej zmiany kursu.
Dlaczego to ważne właśnie teraz? Premiera Fable 5, która miała miejsce 9 czerwca 2026 roku, ujawniła nowe, restrykcyjne zasady bezpieczeństwa i retencji danych. Spór o przejrzystość modeli AI rozgorzał na nowo, gdy okazało się, że Anthropic nie tylko filtruje treści, ale aktywnie modyfikuje odpowiedzi tak, by utrudnić życie konkurencji. To bolesna lekcja dla tych, którzy wierzyli w bezstronność twórców technologii Mythos.
Niewidzialna bariera dla konkurencji
Strategia Anthropic zakładała ukryte obniżanie wydajności dla zapytań służących do trenowania innych modeli językowych. Dean Ball, były doradca Białego Domu ds. AI, określił to podejście jako „szokująco wrogie”. Krytycy wskazują, że takie działanie uderza w fundamenty otwartości badań. Choć firma twierdziła, że ograniczenia miały dotyczyć zaledwie 0,03% ruchu (czyli około 3 zapytań na 10 tysięcy), sam mechanizm był wysoce inwazyjny. Według dokumentacji system card, Anthropic stosowało techniki takie jak prompt modification, steering vectors oraz PEFT, aby model celowo udzielał gorszych odpowiedzi w obszarach infrastruktury trenowania rurociągów distributed training.
Will Brown z Prime Intellect zauważył brutalnie, że firma zachowała się tak, jakby uznawała się za jedyny podmiot godny zaufania do prowadzenia prac nad sztuczną inteligencją. Co więcej, w dokumentach wprost widniał zapis, że spadek jakości „nie będzie widoczny dla użytkowników”. Pod presją środowiska Anthropic wydało przeprosiny, obiecując, że przyszłe mechanizmy ochronne będą przejrzyste.
Problem z prywatnością danych
Problemy modelu wykraczają poza sabotaż konkurencji. Claude Fable 5 budzi furię deweloperów z powodu drakonicznych zasad przechowywania danych. Twoje prompty i odpowiedzi są archiwizowane domyślnie przez 30 dni, a w przypadku wykrycia naruszeń regulaminu – nawet przez dwa lata. Co gorsza, użytkownicy zauważyli drastyczne zmiany w infrastrukturze: marcu 2026 roku czas życia pamięci podręcznej promptów (TTL) skrócono z godziny do zaledwie 5 minut, co uderza w ekonomię i stabilność pracy deweloperów. Dla korporacji dbających o poufne informacje, takie warunki to cyfrowe samobójstwo.
Microsoft mówi „nie”
Rynkowa reakcja była natychmiastowa. Microsoft, mimo bliskiej współpracy z dostawcami AI, nałożył wewnętrzne restrykcje na Fable 5. Podczas gdy inne warianty Claude działają w środowiskach bez retencji danych, ten konkretny model został wykluczony nawet z selektora dla programistów GitHub Copilot. Zamiast oferować pełną wydajność, Anthropic w wielu wrażliwych przypadkach dotyczących cyberbezpieczeństwa przekierowuje zapytania do starszego modelu Opus 4.8. To wyraźny sygnał: nawet najbardziej zaawansowane możliwości nie zrekompensują utraty kontroli nad danymi.
