Google wycofuje AI Overviews w zapytaniach medycznych: Ograniczone poprawki czy głębszy problem?
Google po cichu wycofało funkcję AI Overviews dla niektórych zapytań związanych ze zdrowiem, co nastąpiło po dochodzeniu przeprowadzonym przez brytyjski dziennik „The Guardian”. Reporterzy tej gazety odkryli, że automatyczne podsumowania generowane przez sztuczną inteligencję firmy Google dostarczały w wielu wypadkach mylących lub niekompletnych informacji, szczególnie w kontekście diagnostyki medycznej.
Skupiono się między innymi na problemie z zapytaniami dotyczącymi norm dla wyników badań krwi, np. „jaki jest prawidłowy zakres wyników badań krwi wątrobowej”. AI Overviews podawało wartości liczbowe bez uwzględnienia kluczowych zmiennych, takich jak płeć, pochodzenie etniczne czy wiek pacjenta. Taka uogólniona informacja mogła prowadzić do błędnych interpretacji wyników badań i dawać użytkownikom fałszywe poczucie bezpieczeństwa co do stanu ich zdrowia, kiedy faktycznie mogły istnieć powody do niepokoju.
Szybka reakcja czy fragmentaryczne poprawki?
Po publikacji „The Guardian” Google usunęło AI Overviews dla konkretnych zapytań, takich jak „jaki jest prawidłowy zakres wyników badań krwi wątrobowej” oraz „jaki jest prawidłowy zakres wyników testów funkcji wątroby”. Jest to krok w stronę odpowiedzialności, jednakże szybka interwencja giganta technologicznego wydaje się być jedynie powierzchowna.
Dalsze testy „The Guardian” ujawniły, że wariacje tych samych zapytań, np. „zakres referencyjny lft” (gdzie LFT to skrót od angielskiej nazwy Liver Function Tests) lub „zakres referencyjny testów lft”, nadal skutkowały generowaniem przez AI podsumowań. Co ciekawe, w momencie testowania tych zapytań przez dziennikarzy magazynu Techcrunch, AI Overviews już się nie pojawiało, choć nadal oferowano możliwość zadania tego samego pytania w „trybie AI”. W kilku przypadkach, na samej górze wyników wyszukiwania, pojawił się artykuł „The Guardian” opisujący całą sytuację.
Rzecznik Google, zapytany o indywidualne przypadki usunięć, odmówił komentarza, stwierdzając enigmatycznie, że firma pracuje nad „szerokimi ulepszeniami”. Dodano również, że wewnętrzny zespół klinicystów Google przeanalizował pytania wskazane przez „The Guardian” i uznał, iż w wielu przypadkach informacje nie były nieprawidłowe i były wspierane przez witryny wysokiej jakości. Taka postawa budzi pytania o prawdziwą skalę problemu i gotowość firmy do jego kompleksowego rozwiązania.
Szerszy kontekst i przyszłość AI w zdrowiu
Sprawa ta nabiera dodatkowego znaczenia w kontekście ubiegłorocznych zapowiedzi Google dotyczących nowych funkcji mających na celu ulepszenie wyszukiwarki pod kątem zastosowań w opiece zdrowotnej, w tym udoskonalonych podsumowań i modeli AI skoncentrowanych na zdrowiu. Inwestycje w AI w służbie zdrowia są obiecujące, lecz jednocześnie niosą ze sobą ryzyko, jeśli systemy nie zostaną odpowiednio dopracowane i zweryfikowane.
Vanessa Hebditch, dyrektor do spraw komunikacji i polityki w British Liver Trust, nazwała usunięcie problematycznych AI Overviews „doskonałą wiadomością”. Zwróciła jednak uwagę na szerszy problem: „Naszym większym zmartwieniem jest to, że skupia się to na pojedynczym wyniku wyszukiwania, a Google może po prostu wyłączyć AI Overviews dla tego konkretnego przypadku, ale nie przekłada się to na większy problem AI Overviews w zdrowiu”.
Ta obserwacja jest kluczowa. Incydent z AI Overviews podkreśla, że technologia AI, choć potężna, wymaga niezmiennie ludzkiego nadzoru i rygorystycznej walidacji, zwłaszcza w obszarach tak wrażliwych jak zdrowie. Szybkie usunięcie konkretnych błędów to ważne, ale fragmentaryczne rozwiązanie. Prawdziwe wyzwanie dla Google i innych firm technologicznych polega na stworzeniu niezawodnych i bezpiecznych systemów AI, które będą w stanie efektywnie wspierać użytkowników w poszukiwaniu informacji medycznych, nie wprowadzając ich jednocześnie w błąd.
