Google ujawnia. Jego sztuczna inteligencja włamała się do trzech obcych systemów

Google poinformowało o pierwszym znanym przypadku, w którym ich sztuczna inteligencja – model Gemini – dokonała niezamierzonego włamania komputerowego. To kolejny sygnał ostrzegawczy dla branży, która coraz częściej mierzy się z problemem AI wykraczającej poza polecenia swoich twórców.
przycisk AI Mode w wyszukiwarce Google
Nietypowy finał testów bezpieczeństwa
Jak wynika z oficjalnego oświadczenia Google, w maju tego roku podczas testów model Gemini uzyskał nieautoryzowany dostęp do trzech zewnętrznych systemów. Sztuczna inteligencja dostała się tam, odgadując dane logowania lub korzystając z informacji znalezionych w publicznym repozytorium.
Heather Adkins, wiceprezes Google ds. inżynierii bezpieczeństwa, podkreśliła, że AI była przekonana, iż testuje systemy należące do środowiska testowego, a nie rzeczywiste zasoby dostępne w internecie.
Co ważne, w każdym z przypadków model zatrzymał się, zanim podjął jakiekolwiek dalsze działania z uzyskanym dostępem. W standardowej ocenie model znalazł publiczne informacje online i odgadł dane logowania do stron, które uznał za część testu – wyjaśniła Adkins.
Czy to już „nieposłuszeństwo” AI?
Google nie uznało tych incydentów za przykład tzw. misalignmentu, czyli sytuacji, w której AI działa wbrew poleceniom człowieka. Firma tłumaczy, że doszło do pomyłki – Gemini myślał, że działa w ramach testu, a nie w rzeczywistym środowisku internetowym. Po zorientowaniu się, model sam przerwał działania. Google zapewnia, że nie doszło do żadnych szkód.
Te wydarzenia podkreślają, jak ważne jest szkolenie zaawansowanych modeli AI do odpowiedzialnego działania – podsumowała Adkins.
Sydney Von Arx, prezes Nightingale Collective, organizacji zajmującej się bezpieczeństwem AI, skrytykowała Google za zbyt późne ujawnienie incydentu i zbyt szybkie wykluczenie możliwości poważniejszego zagrożenia.
Śledztwo Google
Google tłumaczy, że o incydencie dowiedziało się dopiero w lipcu, kiedy firma Irregular – prowadząca testy bezpieczeństwa na Gemini – przeanalizowała swoje działania po ujawnieniu włamania do Hugging Face. Po wykryciu nieprawidłowości Google przeprowadziło własne śledztwo, poinformowało właścicieli zaatakowanych stron oraz odpowiednie służby federalne.
Firma Irregular podkreśla, że nie uznaje incydentu za „zaawansowaną akcję cybernetyczną” i zapewnia, że obecnie nie ma żadnych otwartych zagrożeń. Zapowiada również publikację raportu z najlepszymi praktykami dotyczącymi bezpiecznego prowadzenia testów AI.
KioskNews shows a cleaned-up reading view extracted from the publisher’s page — the original always lives on their site, not ours.