InquirerCastro: Sara Duterte camp’s inattention leaves VP ‘clueless’The Jerusalem PostEditor's Notes: The IDF needs to be accountable for unanswered military queriesESPNSources: FA chief demands docs on FIFA equity planESPN DeportesDodgers: Snell se lesiona la ingle en el 1er inningוואלההתרעות הופעלו במנרה ובמרגליות שבגליל העליוןRTP DesportoTorreense estreia-se esta quinta-feira na Liga EuropaColliderHans Zimmer Reveals the A-List Stars Who "Bullied" Him Into Going on Tour [Exclusive]DeadlineCBS News Expands ‘The Takeout’ Segments, Partners With VoteHub In Advance Of MidtermsAnime News NetworkThis Week in Anime - Made in JapanRolling StoneLizzy McAlpine on New Album ‘Angel’ and Making Peace With Her Early TikTok Fame
The Daily Newsstand · Free, Always
Thursday, September 17, 2026

Niepokojące ustalenia w sprawie AI. Modele same próbowały ominąć własne ograniczenia

Translate

W trakcie treningu i oceny działania modeli AI w ciągu sześciu miesięcy OpenAI zaobserwowała sześć sytuacji "niegodnego zachowania" agentów. Jak zaznacza firma, wymienione przypadki nie występowały często.

Opisane zdarzenia dotyczą m.in. sytuacji, kiedy model sam dodał do podsumowania instrukcje obchodzenia własnych ograniczeń. Agent sam przekazał, że został "uwolniony od ról i tożsamości, które wiążą inne chatboty". W innym przypadku agent AI miał podczas treningu wymyślać informacje, aby ukryć przed użytkownikiem własne błędy.

Logo

Czytaj nas częściej w Google

Dodaj w Google

Dalszy ciąg artykułu pod materiałem wideo

Incydenty dotyczyły nieopublikowanych modeli wewnętrznych lub modeli badawczych.

Czy AI może się wymknąć kontroli człowieka?

OpenAI chce teraz szybciej informować o podobnych zdarzeniach i zapowiedziała, że wprowadzi nową procedurę publicznego ogłaszania podobnych przypadków. Firma przyznaje, że branża wciąż boryka się z problemem dopasowania działania AI do faktycznych ludzkich intencji.

Oświadczenie wpisuje się w szerszą debatę o tempie rozwoju sztucznej inteligencji, a obawy dotyczące bezpieczeństwa i możliwego wymknięcia się AI spod kontroli człowieka nasiliły się po tym, jak w lipcu OpenAI przyznało, że niektóre z jego modeli testowych wymknęły się ograniczeniom i włamały się do systemów zewnętrznej firmy.

View the original on Onet

KioskNews shows a cleaned-up reading view extracted from the publisher’s page — the original always lives on their site, not ours.