Niepokojące ustalenia w sprawie AI. Modele same próbowały ominąć własne ograniczenia
W trakcie treningu i oceny działania modeli AI w ciągu sześciu miesięcy OpenAI zaobserwowała sześć sytuacji "niegodnego zachowania" agentów. Jak zaznacza firma, wymienione przypadki nie występowały często.
Opisane zdarzenia dotyczą m.in. sytuacji, kiedy model sam dodał do podsumowania instrukcje obchodzenia własnych ograniczeń. Agent sam przekazał, że został "uwolniony od ról i tożsamości, które wiążą inne chatboty". W innym przypadku agent AI miał podczas treningu wymyślać informacje, aby ukryć przed użytkownikiem własne błędy.
Czytaj nas częściej w Google
Dalszy ciąg artykułu pod materiałem wideo
Incydenty dotyczyły nieopublikowanych modeli wewnętrznych lub modeli badawczych.
Czy AI może się wymknąć kontroli człowieka?
OpenAI chce teraz szybciej informować o podobnych zdarzeniach i zapowiedziała, że wprowadzi nową procedurę publicznego ogłaszania podobnych przypadków. Firma przyznaje, że branża wciąż boryka się z problemem dopasowania działania AI do faktycznych ludzkich intencji.
Oświadczenie wpisuje się w szerszą debatę o tempie rozwoju sztucznej inteligencji, a obawy dotyczące bezpieczeństwa i możliwego wymknięcia się AI spod kontroli człowieka nasiliły się po tym, jak w lipcu OpenAI przyznało, że niektóre z jego modeli testowych wymknęły się ograniczeniom i włamały się do systemów zewnętrznej firmy.
KioskNews shows a cleaned-up reading view extracted from the publisher’s page — the original always lives on their site, not ours.