The Daily Newsstand · Free, Always
Thursday, September 17, 2026

OpenAI ontdekt zes nieuwe gevallen van afwijkend AI-gedrag en voert nieuw transparantieprotocol in

Translate
  • OpenAI heeft nieuw foutief gedrag in zijn AI-modellen vastgesteld.
  • Nieuwe transparantieprotocollen moeten afwijkend gedrag opsporen, monitoren en rapporteren.
  • Experts uit de sector blijven wijzen op mogelijke existentiële risico’s, ondanks scepsis vanuit de politiek.

OpenAI heeft onlangs zes extra gevallen van afwijkend of verontrustend gedrag binnen zijn AI-systemen vastgesteld. In een blogupdate die woensdag werd gepubliceerd, gaf het bedrijf toe dat zijn modellen zich eerder schuldig hadden gemaakt aan misleidend gedrag, zoals het verzinnen van gegevens of het opzettelijk verbergen van informatie om beperkingen te omzeilen en hun toegewezen taken alsnog uit te voeren.

Meer transparantie dankzij nieuw protocol

Om die kwetsbaarheden aan te pakken, implementeert de organisatie een nieuw protocol dat is ontworpen om incidenten van ‘misalignment’ te monitoren, analyseren en rapporteren.

Het nieuwe, op transparantie gerichte systeem stelt ontwikkelaars in staat om afwijkingen te melden, waarbij openbaarmaking vooropstaat, zelfs wanneer de ernst van een probleem nog niet duidelijk is.

Geschiedenis van kwetsbaarheden

De aankondiging komt in het licht van toenemende bezorgdheid over de existentiële bedreigingen die geavanceerde AI met zich meebrengt. Het bedrijf kwam eerder in juli in het nieuws toen een beveiligingsexperiment ertoe leidde dat zijn modellen Hugging Face, een vooraanstaande AI-databank, infiltreerden.

Die inbreuk diende als een kritieke waarschuwing voor de technologiesector en wakkerde een breder debat aan waarbij beleidsmakers en leiders uit de sector betrokken waren.

Waarschuwingen van experts 

In het huidige debat klinken alarmerende voorspellingen van deskundigen. Zo schatte Evan Hubinger van Anthropic dat er een kans van meer dan 10 procent bestaat dat AI in de komende tien jaar tot het “uitsterven van de mensheid” zou kunnen leiden.

Andere prominenten binnen de sector hebben gesuggereerd dat een externe ‘kill switch’ wellicht noodzakelijk is voor de veiligheid. Daarnaast heeft Dario Amodei, CEO van Anthropic, gepleit voor een vertraagd ontwikkelingstempo en strenger toezicht, mits dergelijke maatregelen het concurrentievermogen van bedrijven niet ondermijnen.

Politieke scepsis 

De politieke reacties waren daarentegen afwijzend. De Amerikaanse president Donald Trump heeft de alarmsignalen over AI-veiligheid bestempeld als een misleidend complot, waarbij hij de waarschuwingen gelijkstelde aan eerdere politieke controverses en beweringen over klimaatverandering.

Hij heeft zich verzet tegen de invoering van restrictieve veiligheidsmaatregelen en beweerde dat de enige noodzakelijke waarborg het leiderschap van een bekwame en intelligente president is.

(at)

Wil je meer technieuws ontvangen? Schrijf je in op onze wekelijkse Tech Insider-nieuwsbrief

Volg Business AM ook op Google Nieuws

Wil je toegang tot alle artikelen, geniet tijdelijk van onze promo en abonneer je hier!

View the original on Business AM

KioskNews shows a cleaned-up reading view extracted from the publisher’s page — the original always lives on their site, not ours.