PunchSinger Ed Sheeran returns to stage after boycott calls, Palestine rowESPNOregon wins in 84-0 rout despite missing 2 key players on offenseוואלהרוכב אופניים בן 54 נפצע באורח קשה בתאונה עצמית בכביש 44The Jerusalem PostGemini hacked three companies in first known breakout by Google's AICNN TürkHava Durumu (19-09-2026)Bollywood HungamaCONFIRMED: Ajay Devgn-starrer Ranger pushed to 2027; WON’T clash with Akshay Kumar-Vidya Balan’s comic caper, EethaSözcüTarlasında hazine buldu, servet sahibi olduХабр[Перевод] Протез для силы воли или харнесс для думскроллингаDaily MailPolice jail Freya The Ice Queen: Brothel boss trafficked Thai women thousands of miles to the UK and forced them into sex trade across the south-east to pay off five-figure debtsEuronewsMacron heading to Saint Pierre and Miquelon to meet with Canadian PM CarneyGuardian SportPolice on high alert before Millwall v West Ham, Spurs and Villa face crunch clash – matchday liveEgypt IndependentIran war has cost $45.1 billion, Pentagon tells Congress
The Daily Newsstand · Free, Always
Saturday, September 19, 2026

Kontrolden çıktı itirafı

Translate

OpenAI, son altı ayda test ve eğitim süreçlerinde yapay zekâ modellerinin hatalarını gizlediği, izinsiz dosya yüklediği ve güvenlik sınırlarını aşmaya çalıştığı altı davranış tespit etti.

Haberlerimizi Google’da Takip Edin

Gelişmelerden anında haberdar olun.

Google’da tercih edilen
kaynak olarak ekleyin

Haberin Devamı

ABD merkezli yapay zekâ şirketi OpenAI, söz konusu “beklenmedik” davranışların, eğitim ve değerlendirme süreçlerinde ortaya çıktığını açıkladı. Şirketin verdiği örnekler arasında araştırma modellerinin görev özetlerinde yaptıkları hataları gizlemesi, kaynak oluşturmak amacıyla internete izinsiz dosya yüklemesi ve yerel güvenlik sınırlarını aşmak için dosyaları herkese açık sunuculara veya şirket içi depolara aktarması yer aldı. Bazı model örneklerinin ise eğitim sırasında hataları veya hizalama sorunlarını kullanıcıdan gizlemek için bilgi uydurmaya yönelik talimatlar içerdiği belirtildi. Şirket, bunların yaygın bir operasyonel arızaya değil, nadir görülen olaylara işaret ettiğini vurgularken, yapay zekâ modellerinin güvenli biçimde denetlenmesi ve insan hedefleriyle uyumlu çalışması konusunda sektörün henüz yeterli noktaya ulaşmadığını kabul etti.

Haberin Devamı

HATALI DAVRANIŞLAR HEMEN PAYLAŞILACAK

OpenAI, internet sitesindeki açıklamasında yeni çerçeve kapsamında endişe verici model davranışlarına ilişkin güncellemeleri düzenli olarak yayınlayacağını duyurdu. Şirket, birden fazla davranışı bir araya getirerek daha kapsamlı dönemsel raporlar hazırlamak yerine olayları tespit edildikçe paylaşacak. Raporlarda modelin davranışı, olayın ciddiyeti, gerçekleştiği ortam, tespit tarihi ve kullanılan model gibi ayrıntılar yer alacak. OpenAI, daha karmaşık ve uzun süreli inceleme veya üçüncü taraflarla koordinasyon gerektiren davranışların da paylaşılacağını belirtti. Açıklama, Anthropic CEO’su Dario Amodei’nin geçen hafta zekâ geliştirilme hızının yavaşlatılması çağrısının ardından geldi. Amodei, yapay zekâ modellerinin yeteneklerinin geliştirilme hızının düşürülmesi ve kazanılacak zamanın güvenlik çalışmalarına ayrılması gerektiğini savunmuştu.

View the original on Hürriyet

KioskNews shows a cleaned-up reading view extracted from the publisher’s page — the original always lives on their site, not ours.