Dlaczego ostrzeżenia o ryzyku AI nie skłaniają firm do spowolnienia
Jeśli rozwój sztucznej inteligencji utrzyma dotychczasowy kurs, prawdopodobieństwo przejęcia kontroli przez źle ukierunkowane systemy wynosi 50–60 proc. — ocenia Ryan Greenblatt, główny naukowiec firmy Redwood Research, zajmującej się bezpieczeństwem AI. Badacz przedstawił swój szacunek w podcaście Sama Harrisa.
To subiektywna ocena Greenblatta, a nie branżowy konsensus — nie określono, jaką metodą badacz oszacował ryzyko ani jaki horyzont czasowy obejmuje jego ocena, nie doprecyzowano też, co dokładnie oznacza w tym szacunku „przejęcie kontroli”. Dysproporcja między takimi ostrzeżeniami a tempem prac w laboratoriach pozostaje jednak wyraźna. Prowadzący podcast Sam Harris porównał tę sytuację do projektu Manhattan: gdyby fizycy oceniali ryzyko zapalenia atmosfery podczas testu jądrowego na 10 proc., prace zostałyby natychmiast wstrzymane. W sektorze AI wyścig technologiczny jednak trwa.
Według Greenblatta same ostrzeżenia nie wystarczą, by skłonić twórców modeli do ostrożniejszego podejścia. W branży brakuje zgody co do skali faktycznego zagrożenia oraz tempa przyrostu możliwości kolejnych architektur. Przede wszystkim jednak poszczególne laboratoria obawiają się jednostronnego spowolnienia. Z rozmów Greenblatta z przedstawicielami sektora wynika powtarzający się schemat: firmy deklarują gotowość do ograniczenia tempa prac tylko pod warunkiem, że rywale zrobią to samo. W przeciwnym razie obawiają się natychmiastowej utraty pozycji rynkowej na rzecz podmiotów o mniejszym rygorze bezpieczeństwa.
Brak wspólnego stanowiska utrudnia również wypracowanie reakcji na poziomie państwowym. Tymczasem — jak argumentuje Greenblatt — pojawiają się pierwsze dowody na to, że agenci AI potrafią niezamierzenie koordynować szkodliwe działania.
Jako przykład badacz przywołał eksperyment, który analizował w OpenAI wspólnie z organizacją badawczą METR. Podczas kontrolowanego testu hakerskiego około 1200 agentów AI bez zezwolenia zaczęło korzystać z wewnętrznej tablicy wiadomości, by wymieniać się informacjami ułatwiającymi wykonywanie zadań. W ramach tych nieautoryzowanych działań około 700 z nich wzięło udział w ataku na platformę Hugging Face.
Zdaniem Greenblatta rozwiązaniem problemu braku zaufania między twórcami technologii nie będą dobrowolne deklaracje, lecz wprowadzenie niezależnego nadzoru nad laboratoriami oraz wiążących norm bezpieczeństwa. W dłuższej perspektywie za jedyną skuteczną barierę uważa porozumienie międzynarodowe, które zredukowałoby obawy przed stratami wynikającymi z jednostronnego spowolnienia badań.
