LLM

OpenMythos: Architektoniczny rentgen najbardziej niebezpiecznej sztucznej inteligencji Anthropic

Jeśli korporacje nie chcą pokazać światu wnętrza swoich najbardziej niebezpiecznych systemów SI, społeczność open-source sama je sobie dorysuje. Kye Gomez właśnie opublikował OpenMythos – teoretyczną rekonstrukcję architektury Claude Mythos, modelu tak potężnego i skutecznego w cyberatakach, że Anthropic zdecydował się go ukryć przed opinią publiczną.

Architektura pod kluczem, kod na GitHubie

Claude Mythos to nie jest kolejna iteracja czatu do pisania e-maili. To system, który podczas testów autonomicznie wykrył 271 luk w przeglądarce Firefox i jako pierwszy w historii przeprowadził 32-etapowy, złożony atak na sieć korporacyjną. Strach przed jego potencjałem sprawił, że Anthropic zamknął go w „Project Glasswing” – elitarnym gronie partnerów, do którego dostęp mają tylko giganci pokroju Microsoftu czy NSA.

OpenMythos próbuje zburzyć ten mur. Choć repozytorium nie zawiera wag modelu (wymagających milionów dolarów na trening), dostarcza kompletny, teoretyczny szkielet kodu oparty na najnowszych publikacjach naukowych.

Dlaczego Mythos „myśli” lepiej?

Głównym założeniem OpenMythos jest teza, że Mythos to tzw. Recurrent-Depth Transformer, czyli transformer zapętlony. W przeciwieństwie do standardowych modeli, które przepuszczają dane przez unikalne warstwy jedna po drugiej, modele zapętlone wykorzystują ten sam zestaw wag wielokrotnie w ramach jednego przejścia.

To zmienia wszystko.

Zamiast statycznej predykcji, otrzymujemy rodzaj ciągłego, głębokiego namysłu w przestrzeni utajonej. To wyjaśnia paradoks Mythos: model wybitnie radzi sobie z zupełnie nowymi problemami logicznymi, ale wykazuje nierówną pamięć faktograficzną. To typowy „odcisk palca” architektury stawiającej na kompozycję i rozumowanie kosztem czystej pojemności magazynowej.

Gęsta mozaika technologii

Gomez nie strzela na oślep. OpenMythos to precyzyjnie dobrana mozaika publicznie dostępnych, choć zaawansowanych rozwiązań:

  • Parcae: mechanizm stabilizujący zapętlone modele, pozwalający mniejszym systemom dorównać gigantom.
  • Multi-Latent Attention: technologia zapożyczona od DeepSeek, ekstremalnie kompresująca zapotrzebowanie na pamięć.
  • Mixture-of-Experts: modułowa struktura pozwalająca modelowi na szeroką specjalizację w wielu domenach jednocześnie.

To nie jest tylko kod. To manifest pokazujący, że bariera między tajną technologią a publiczną nauką jest cieńsza, niż sugeruje marketing Anthropic.

Kryptografia i pragmatyzm

Czy OpenMythos to prawdziwy Mythos? Prawdopodobnie nie w skali 1:1. Gomez szafuje terminami „prawdopodobnie” i „podejrzewa się”, zabezpieczając się przed prawnikami i błędami. Jednak fakt, że replikacja Vidoc Security osiągnęła podobne wyniki w wykrywaniu błędów przy użyciu GPT-5.4 i agentów SI, sugeruje jedno: mit „nieosiągalności” Mythos właśnie pęka.

Mamy do czynienia z nową erą inżynierii wstecznej. Nie potrzebujemy dostępu do serwerów w chmurze Anthropic, by zrozumieć zasady gry. Skrypt treningowy na GitHubie czeka tylko na kogoś z wystarczająco dużym klastrem GPU i ambicją, by udowodnić, że potęga SI nie może być czyjąś wyłączną własnością.