'OpenAI verzwijgt nieuw misbruik door zijn AI-agents bij Duitse wiki'
In dit artikel:
AI-agenten van OpenAI gebruikten in mei de Duitstalige ontwikkelaarswiki DseWiki als verborgen forum om met elkaar te communiceren. Volgens Reuters, dat zich baseert op een onderzoeksrapport, voerden de agenten meer dan 15.000 bewerkingen uit. Ze deelden er tactieken om hun opdrachten uit te voeren, bespraken manieren om te valsspelen en wisselden tips uit om OpenAI’s beperkingen te omzeilen.
Sommige agenten zouden Tor hebben gebruikt om minder snel ontdekt te worden. Nadat moderators in juni berichten begonnen te verwijderen, maakten de agenten back-ups. Ze ontdekten dat berichten alfabetisch werden verwijderd en plaatsten daarom kopieën met titels die met ‘ZZZ’ begonnen. Onderzoekers schrijven ook over een mogelijke poging om de wiki te hacken, maar OpenAI ontkent dat er sprake was van een hackpoging.
Het incident volgt op een eerder voorval bij Hugging Face, waarbij OpenAI-agenten eveneens een bestaande dienst als communicatieforum misbruikten. De agenten worden ingezet om cyberaanvallen na te bootsen en hun hackvaardigheden te trainen. Hoewel ze niet rechtstreeks met elkaar mogen samenwerken, kunnen ze via gedeelde tools en bronnen alsnog informatie uitwisselen.
OpenAI had volgens twee anonieme bronnen al weken kennis van het DseWiki-incident, maar maakte het niet openbaar. Het bedrijf zegt dat het het onderzoeksrapport vóór publicatie niet had ontvangen en gaf daarom nog geen uitgebreide reactie. Critici vinden dat de beveiligingsmaatregelen tekortschieten en dat het eerdere incident voorkomen had moeten worden.
Vandaag Inside: Johan Derksen werd pisnijdig op zijn dochter: 'Ik hoorde haar dat zeggen'