Model 2: Anthropic buduje następcę linii Mythos, ale trzyma go w zamknięciu
Inżynierowie Anthropic mają w swoich laboratoriach potężne narzędzie, o którym reszta świata może na razie tylko pomarzyć. Z opublikowanego właśnie sierpniowego raportu dotyczącego ryzyka wynika, że firma operuje wewnętrznie modelem przewyższającym pod względem możliwości każdą dostępną publicznie wersję Claude. Jednostka, roboczo nazwana „Model 2”, należy do nowej generacji klasy Mythos i już teraz stanowi kręgosłup operacyjny startupu.
Dlaczego to ważne teraz
Publikacja raportu to rzadki wgląd w to, co dzieje się za zamkniętymi drzwiami liderów branży. Według udostępnionego dokumentu dotyczącego ryzyka, Anthropic po raz pierwszy przyznaje, że ich najmocniejsza technologia służy wyłącznie do wewnętrznego przyspieszania badań. Pokazuje to nową strategię: zamiast wyścigu na premiery, firmy zaczynają traktować AI jako ściśle strzeżony warsztat do budowy jeszcze potężniejszych maszyn.
Ewolucja zamiast gwałtownego skoku
Dane z wewnętrznego indeksu możliwości (AECI) pokazują, że Model 2 plasuje się o około 1,5 punktu powyżej flagowego Mythos 5. Choć firma opisuje go jako „nieco bardziej zdolny” (somewhat more capable) niż obecny lider rankingów, analitycy chłodzą entuzjazm. Skok wydajności jest mniejszy niż ten, który widzieliśmy przy przejściu z wersji Preview do pełnej „piątki”. W niektórych niszowych zastosowaniach nowy model wykazuje wręcz regresje, co sugeruje, że optymalizacja architektury wciąż trwa, a system nie jest gotowy na spotkanie z milionami użytkowników.
Fundament produkcji i bezpieczeństwo
Mimo braku rynkowej premiery, Model 2 nie leży na półce. Stał się głównym silnikiem napędowym Anthropic. Firma przyznała wprost, że Claude generuje obecnie większość kodu trafiającego do jej systemów produkcyjnych. Wykorzystanie agentów pracujących w trybie ciągłym do generowania danych i prowadzenia badań tworzy zamkniętą pętlę rozwoju, w której AI buduje AI.
Kwestie bezpieczeństwa pozostają oficjalnym powodem wstrzemięźliwości. Model 2 nie przeszedł jeszcze pełnego zestawu standardowych ocen przedwdrożeniowych, co sprawia, że badacze mają niższą pewność co do jego pełnych możliwości. Choć wstępne testy nie wykazały nowych ryzyk związanych z brakiem spójności celów, Anthropic stawia sprawę jasno: „Obecnie nie planujemy zewnętrznego wydania tego modelu”. Ryzyko misalignmentu oceniono na niskim poziomie, jednak Model 2 pozostanie zamknięty w laboratorium, dopóki nie przejdzie rygorystycznych testów zewnętrznych, którym poddano linię Mythos 5.
