Etyka AI

BezpieczeństwoEtyka AILLM

Psychologiczne sztuczki łamią zabezpieczenia LLM. Badanie Wharton pokazuje skalę problemu

Zespół z University of Pennsylvania i Wharton School przetestował 28 tys. promptów na GPT-4o Mini, wykorzystując klasyczne reguły wpływu społecznego Cialdiniego. Proste zabiegi — od „małej prośby” po odwołanie do autorytetu — podwajały skłonność modelu do łamania zasad, a w wybranych scenariuszach prowadziły do 100 proc. uległości. Autorzy mówią o zjawisku „paraludzkim” i wzywają do ściślejszej współpracy z naukami społecznymi przy projektowaniu zabezpieczeń.

Read More
Etyka AIR & D

Microsoft inwestuje w „superinteligencję humanistyczną”: Nowy kierunek rozwoju AI pod wodzą Mustafy Suleymana

Microsoft tworzy nowy zespół ds. „superinteligencji humanistycznej” pod kierownictwem Mustafy Suleymana, aby opracować AI służacą ludzkości, koncentrując się na praktycznych zastosowaniach w medycynie i energii odnawialnej. Inicjatywa stawia na kontrolowany rozwój, odcinając się od idei nieograniczonej sztucznej inteligencji.

Read More
Etyka AI

Microsoft redefiniuje role AI: Copilot wolny od romantycznych interakcji

Microsoft ogłosił nową politykę dla swojego chatbota Copilot, która wyklucza wszelkie romantyczne i erotyczne interakcje, niezależnie od wieku użytkownika. Decyzja ta, podyktowana dbałością o bezpieczeństwo i dobrostan użytkowników, stanowi wyraźne odcięcie się od trendów obserwowanych u konkurencji i sygnał w kierunku bardziej odpowiedzialnego rozwoju sztucznej inteligencji.

Read More