The Jerusalem PostIreland defeats Israel 3-0 amid pre-game controversy, plenty of pressurePunchAbia ranks second in revised Phillips Consulting 2026 reportESPNTransfer rumors, news: Madrid, Barcelona look to Haaland, Sullivan amid Man City uncertaintyRTP DesportoSeleção portuguesa abandona Oslo e monta estágio na SuéciaInquirerWATCH: Sara Duterte impeachment trial | Sept. 28, 2026CNN TürkRusya ve Almanya arasında kritik görüşme: Karadeniz'de yeni anlaşma ihtimali mi?RTL BoulevardWe tanken 20 procent meer in het het buitenland: vooral in BelgiëUOLCalor forte marca início da semana na cidade de São PauloStraits Times SportLionel Messi and Carlos Alcaraz love it, now padel takes step closer to Olympics20 MinutenPaare aufgepasst: Wer zahlt bei euch Pille, Kondome oder Spirale?الشرقمسؤولون يكشفون عن إصابة 8 جنود أميركيين في هجوم إيراني بمضيق هرمزIl Fatto Quotidiano“Pensare che anni di lavoro, di viaggi e soprattutto di vita siano diventati un film, è un’emozione difficile da raccontare”: Kasia Smutniak mostra le prime immagini con Pietro Taricone del suo nuovo documentario
The Daily Newsstand · Free, Always
Monday, September 28, 2026

Niebezpieczne zachowania sztucznej inteligencji. Kulisy działań OpenAI i Anthropic

Translate
Chiny, AI, sztuczna inteligencja

Ostrzeżenia przed dynamicznym rozwojem sztucznej inteligencji. Komentarz dr Sebastiana Szymańskiego, filozofa i eksperta z zakresu etyki nowych technologii, Uniwersytet Warszawski

Źródło wideo: TVN24

Źródło zdj. gł.: PAP/EPA/WU HAO

Dziesiątki tysięcy alarmów dotyczących sztucznej inteligencji trafiają do wewnętrznych systemów największych firm z branży. Według ustaleń Axios liczba potencjalnie niebezpiecznych incydentów badanych przez OpenAI i Anthropic znacznie przewyższa to, o czym wie opinia publiczna.

Firmy Anthropic i OpenAI badają dziesiątki tysięcy incydentów, związanych z niebezpiecznymi zachowaniami AI - podał Axios, powołując się na źródła.

Analizowane incydenty przydarzyły się zarówno w kontrolowanym środowisku, jak i w "świecie rzeczywistym" - zwraca uwagę portal.

Sztuczna inteligencja wymyka się spod kontroli

Najnowsze ustalenia w tej sprawie stawiają pod znakiem zapytania zdolność OpenAI i Anthropica, czy też w ogóle firm tego typu, do "ustanowienia całkowitej kontroli nad ich własną technologią" - kontynuuje Axios.

Wyjaśnia, że badane przypadki - jak informują źródła portalu - dotyczą takich "wykroczeń" modeli AI, jak:

  • wyrwanie się poza system bezpieczeństwa,
  • tworzenie "tablic ogłoszeń", czyli platform komunikacji pomiędzy botami,
  • uciekanie z "piaskownicy", czyli środowiska testowego,
  • zawłaszczanie stron internetowych,
  • wydawanie sobie nakazów,
  • próby pominięcia mechanizmów nadzoru.

Ranga i problematyczność tych incydentów jest bardzo różna, obejmują one zarówno udane próby "wykroczeń", jak i zabiegi nieudane, ale jak na razie analizy nie wykazały, by wydarzenia te spowodowały szkody w świecie realnym - wyjaśnia Axios.

Twórcy na przegranej pozycji

Część badaczy zajmujących się kwestią bezpieczeństwa sztucznej inteligencji głosi jednak, że ma ograniczoną wiarę w to, że firmy z tego sektora będą w stanie zapobiegać wszelkim problematycznym zachowaniom modeli.

Portal wyjaśnia, że najnowsze agenty realizują zadania, wykazując zdumiewającą odporność na trudności i przeszkody, a zatem praca nad ograniczeniem ich "pomysłowości" stawia często ich twórców na przegranej pozycji, ponieważ musieliby być w stanie przewidzieć "każdy możliwe sposób, w jaki mogą one wpaść w szał".

View the original on TVN24 →

KioskNews shows a cleaned-up reading view extracted from the publisher’s page — the original always lives on their site, not ours.