Gemini 4 Argon: niski wskaźnik udanych ataków w teście Gray Swan i dostęp bez blokad dla obrońców
Google zaprezentowało Gemini 4 Argon, pozycjonując nowy model m.in. jako narzędzie do cyberobrony. W opublikowanym przez firmę zestawieniu 18 benchmarków Argon uzyskał najlepszy wynik w 12 testach, w jednym zremisował, a w pięciu ustąpił konkurencji. Dwa elementy jego debiutu wyróżniają się weryfikowalnymi danymi: wynik w teście odporności na pośrednie instrukcje oraz ograniczona ścieżka udostępniania.
W teście Gray Swan Indirect Prompt Injection odsetek skutecznych ataków na model wyniósł 0,7 proc. Benchmark sprawdza, czy sztuczna inteligencja wykona złośliwe polecenie ukryte w przetwarzanym tekście, na przykład w treści e-maila lub na stronie internetowej (niższy wynik oznacza wyższą odporność). Dla porównania Claude Opus 5.5 i Claude Fable 5.1 uzyskały w tym samym teście po 1 proc., a GPT-6 Astra – 8,5 proc. W przypadku Groka 4.6 i Kimi K3 próby ataku powiodły się odpowiednio w 51,8 proc. oraz 52,7 proc. przypadków. Wynik dotyczy jednak wyłącznie tego konkretnego benchmarku i nie przesądza o ogólnej odporności na wszystkie rodzaje ataków prompt injection.
Brak barier dla zweryfikowanych zespołów
W pierwszym etapie model ma trafić do uczestników programu Fairwind, zrzeszającego według Google ponad 650 partnerów, w tym instytucje publiczne i operatorów infrastruktury. Zweryfikowane zespoły otrzymają dostęp do wersji pozbawionej standardowych zabezpieczeń, które zwykle nie pozwalają modelowi generować treści pomocnych w działaniach hakerskich.
Ograniczenie dystrybucji wynika z natury narzędzia: analitycy bezpieczeństwa potrzebują modelu zdolnego do analizowania i odtwarzania technik ataku, by skutecznie wykrywać podatności, zanim zrobią to przestępcy. Google powołuje się m.in. na wewnętrzne testy firmy Wiz, w których Argon miał rozwiązać przy pierwszej próbie 70,9 proc. zadań polegających na przygotowaniu działających exploitów wykorzystujących błędy w aplikacjach internetowych. Rezultaty te, podobnie jak informacja o wykryciu luki w oprogramowaniu medycznym, pochodzą wyłącznie z deklaracji Google i nie zostały jeszcze niezależnie zweryfikowane.
Ostrożność w interpretacji jest wskazana także przy innych benchmarkach. W programistycznym teście DeepSWE v1.1 Google przypisało Argonowi wynik 77,9 proc., zestawiając go z 74,2 proc. Claude Opus 5.5 i 74,1 proc. GPT-6 Astra. O ile jednak dane konkurentów zaczerpnięto z publicznego rankingu i raportów ich twórców, o tyle wynik Argona obliczyło samo Google.
Dopiero po etapie zamkniętym dla partnerów Fairwind dostęp do Argona ma zostać rozszerzony na płatnych klientów API oraz subskrybentów usługi Google AI Ultra. Konkretnych terminów szerszego wdrożenia firma dotąd nie wyznaczyła.
