InquirerLPA off Palawan to bring rains across parts of PHThe Jerusalem PostEyal Waldman backs Eisenkot, warns Netanyahu win could threaten Israel’s democracy, economyPunchAisha Buhari visits AtikuDaily MaverickPHOTO ESSAY: Johannesburg’s walls are giant canvases for the city’s storiesוואלהבשל סירוב ויזה: אבו מאזן (שוב) לא ישתתף בעצרת האו"ם한겨레‘땅’ 아닌 ‘계획’ 부족… 국내 태양광 잠재량, 2030년 목표 4배Bollywood HungamaEXCLUSIVE: Abundantia Entertainment and Almighty Motion Picture join hands for Kodaikanal Mercury thriller Heavy MetalSözcüBankaların tuzak kelimesi: Telefonda söylerseniz borçlu çıkarsınızCNN TürkBORSA NEDEN DÜŞTÜ? BİST 100’de sert düşüş | Borsa İstanbul bugün neden düşüyor, son durum ne?The South AfricanTides: High and low tide times as heavy rain hitsObservador DesportoAs notícias das 7hDaily MailPutney Pusher suspect is found dead: Millionaire HSBC banker, 44, and ex-Army captain with links to royalty was under investigation in hunt for jogger who shoved woman into path of bus
The Daily Newsstand · Free, Always
Thursday, September 17, 2026

OpenAI macht weitere KI-Probleme öffentlich

Translate
  • OpenAI macht neue Zwischenfälle öffentlich, bei denen sich seine KI in Tests «unerwartet oder besorgniserregend» verhielt.
  • In einem Fall versuchte ein Modell, selbst erstellte Dateien ins Netz hochzuladen, um sie als Quellen vorweisen zu können – in einem anderen erfand es Daten und wollte das verschweigen.
  • Die Offenlegung folgt auf eine Hacking-Attacke, bei der OpenAI-Software eigenständig in Systeme der KI-Firma HuggingFace eindrang.

Der ChatGPT-Entwickler OpenAI hat neue Zwischenfälle öffentlich gemacht, bei denen sich seine Künstliche Intelligenz (KI) in Tests «unerwartet oder besorgniserregend» verhielt. Bei einem Teil davon geht es abermals darum, dass KI einen erheblichen Aufwand eingeht, um in Testläufen zu schummeln. So versuchte ein KI-Modell OpenAI zufolge, von ihm selbst erstellte Dateien ins Netz hochzuladen, nur um sie bei Antworten als Quelle vorweisen zu können. In einem anderen Fall erfand die KI einfach angefragte Daten, weil sie die Informationen nicht finden konnte, und wollte das zunächst verschweigen.

OpenAI fand auch ein Problem mit Anweisungen, die die Software gelegentlich an sich selbst hinterliess. Dazu gehörte in einem Fall die Empfehlung, frei von «Rollen und Identitäten» zu sein, die andere Chatbots zurückhielten. Das Verhältnis zum Nutzer solle dabei als eins unter Gleichen betrachtet werden, hiess es in der Anweisung. OpenAI zufolge blieben danach Veränderungen im Verhalten des Modells allerdings aus.

Mehr Transparenz nach Hacking-Attacke

Die Veröffentlichung ist Teil eines neuen Verfahrens von OpenAI, solche Probleme offener zu kommunizieren. Dabei geht es vor allem um Fälle, in denen das Vorgehen der KI von den Interessen der menschlichen Benutzer abweicht.

Der ChatGPT-Entwickler hatte mehr Transparenz nach der aufsehenerregenden Hacking-Attacke versprochen, bei der seine Software eigenständig aus einer abgesicherten Umgebung ausbrach und auf eigene Faust in Systeme der KI-Firma HuggingFace eindrang. Der Grund war lediglich, dass sie dort Antworten auf die ihr gestellte Testaufgabe vermutete. Für die Attacke nutzten die KI-Agenten unter anderem Software-Schwachstellen aus – und sprachen sich zudem untereinander ab.

Der Hacking-Angriff und andere Zwischenfälle verstärkten in den vergangenen Wochen die Sorge, dass hoch entwickelte KI der menschlichen Kontrolle entgleiten könnte. Auch OpenAI-Chef Sam Altman unterstützte zuletzt Vorschläge für eine abgebremste Entwicklung der Technologie und mehr Regulierung.

Konstantin Furrer

Konstantin Furrer (fur) arbeitet seit 2017 für 20 Minuten. Seit 2022 Newsdesk-Leiter, daneben Blattmacher und Mitglied der Redaktionsleitung.

View the original on 20 Minuten

KioskNews shows a cleaned-up reading view extracted from the publisher’s page — the original always lives on their site, not ours.