Bezpieczeństwo

OpenAI zwolniło troje badaczy bezpieczeństwa. W tle spór o zasady współpracy z audytorami

OpenAI zwolniło troje badaczy zajmujących się bezpieczeństwem sztucznej inteligencji: Tomka Korbaka, Mikitę Balesniego oraz Jasmine Wang. Dwóch z nich brało udział w analizie głośnego incydentu dotyczącego platformy Hugging Face, w którym uczestniczył wewnętrzny model badawczy OpenAI. W lipcu OpenAI określiło ten incydent jako najsilniejszy wykryty dotąd przypadek tego typu i przyznało, że brał w nim udział bardzo zdolny wewnętrzny model badawczy. Zwolnieni pracownicy i władze firmy przedstawiają zupełnie inne wersje wydarzeń.

Kluczową osią sporu stały się niejasne reguły kontaktu z zewnętrznymi audytorami. Tomek Korbak był w OpenAI główną osobą do kontaktów technicznych z METR — niezależną organizacją badawczą zajmującą się oceną ryzyka modeli AI, która badała sprawę Hugging Face. Jak relacjonuje badacz, podczas zwolnienia usłyszał ustnie, że przyczyną decyzji był sposób jego komunikacji z METR. Nie przedstawiono mu jednak żadnych konkretnych zarzutów ani pisemnego uzasadnienia. „Kontakt z METR należał do moich bezpośrednich obowiązków” — podkreślił Korbak.

Procedury tworzone na bieżąco

W liście otwartym skierowanym do organów nadzorczych OpenAI trójka badaczy zaznaczyła, że dochodzenie wokół incydentu z Hugging Face miało charakter bezprecedensowy, a wewnętrzne wytyczne dotyczące obiegu informacji powstawały dopiero w jego trakcie. Korbak zapewnia, że działał zgodnie z regułami obowiązującymi w danym momencie, a Mikita Balesni przed przekazaniem jakichkolwiek materiałów na zewnątrz konsultował się z kierownictwem i usuwał z nich wrażliwe dane.

Okoliczności zwolnienia Jasmine Wang były odmienne. Badaczka w ramach wsparcia procesów rekrutacyjnych otrzymała dostęp do skrzynki pocztowej jednego z menedżerów. Mimo jej próśb uprawnień nie cofnięto na czas, a gdy po otwarciu poufnej wiadomości natychmiast zgłosiła ten fakt przełożonym, potraktowano to jako powód do rozwiązania umowy.

Korbak łączy swoje zwolnienie także z faktem, że od miesięcy podnosił w firmie obawy dotyczące utraty możliwości monitorowania procesów myślowych modeli AI, czyli analizy ich wewnętrznego toku rozumowania. Badacze zaprzeczyli również, by odpowiadali za anonimowe przecieki medialne na temat nowych architektur modeli.

Stanowisko OpenAI i postulaty badaczy

OpenAI odrzuca zarzuty o karanie pracowników za sygnalizowanie problemów technicznych. W oficjalnym oświadczeniu firma stwierdziła, że wewnętrzne śledztwo wykazało „poważne naruszenie zaufania” oraz złamanie zasad dotyczących ochrony poufnych informacji. Spółka nie ujawniła jednak publicznie, jakie konkretnie dane lub działania stały się podstawą decyzji.

Zwolnieni badacze sformułowali trzy główne postulaty pod adresem OpenAI:

  • zapewnienie zewnętrznym audytorom, takim jak METR, realnego dostępu do zespołów technicznych na poziomie szeregowych pracowników,
  • utrzymanie pełnej możliwości monitorowania toku rozumowania w najbardziej zaawansowanych modelach,
  • stworzenie w pełni przejrzystych reguł współpracy personelu z zewnętrznymi organizacjami bezpieczeństwa.

Spór pozostaje nierozstrzygnięty. OpenAI deklaruje, że kontynuuje prace nad sformalizowaniem umów z zewnętrznymi audytorami, jednak nie przedstawiło szczegółowych dowodów ani uzasadnienia prawnego, które doprowadziło do natychmiastowego zwolnienia badaczy.