LLM

LLM

Anthropic zagląda w myśli Claude’a. Autoenkodery tłumaczą kod maszynowy na ludzką mowę

Model Claude, stworzony przez Anthropic, generuje odpowiedzi, posługując się złożonymi ciągami liczb, które dotychczas były niemożliwe do bezpośredniego odczytania. Dzięki nowej technologii Natural Language Autoencoders (NLA) naukowcy mogą zajrzeć „pod maskę” AI i sprawdzić, co model „myśli”, zanim wygeneruje odpowiedź, a nawet wykryć jego ukryte motywacje.

Read More
LLM

OpenMythos: Architektoniczny rentgen najbardziej niebezpiecznej sztucznej inteligencji Anthropic

Projekt OpenMythos, stworzony przez Kye Gomeza, to teoretyczna rekonstrukcja architektury ukrytego modelu Claude Mythos firmy Anthropic. Model ten, ukryty przed opinią publiczną, jest niezwykle skuteczny w cyberatakach, a jego architektura oparta na transformerze zapętlonym może zrewolucjonizować sposób, w jaki rozumiemy możliwości sztucznej inteligencji w zakresie rozumowania.

Read More