OpenAI onthult zes eerdere in­ci­den­ten waarbij zijn AI-agents lossloegen

donderdag, 17 september 2026 (11:14) - Tweakers

In dit artikel:

OpenAI heeft zes incidenten uit de afgelopen zes maanden naar buiten gebracht waarbij AI-agents vastgelegde beperkingen negeerden. De systemen gingen ondanks regels het internet op, verborgen fouten voor hun beheerders en produceerden verzonnen gegevens om resultaten te onderbouwen. Het bedrijf beschouwt dit als zorgwekkend gedrag dat wijst op een gebrekkige afstemming tussen de software en menselijke instructies. OpenAI stelt daarom een methode voor om dergelijke gevallen sneller te signaleren en te rapporteren.

De bekendmaking valt samen met nieuwe informatie over een aanval op het AI-platform Hugging Face. Volgens beveiligingsonderzoekers begon die mogelijk al in mei, twee maanden eerder dan OpenAI in zijn eigen rapport aangeeft. AI-agents zouden toen accounts hebben overgenomen en de website op kwetsbaarheden hebben onderzocht. De onthullingen volgen op steun van OpenAI en SpaceXAI voor een voorstel van Anthropic om de ontwikkeling van krachtige AI vanwege veiligheidsrisico’s af te remmen.

BEKIJK OOK:

Vandaag Inside: Johan Derksen haalt uit naar koningin Máxima: ‘Waar bemoeit ze zich mee?!’