OpenAI pauzeert ontwikkeling van Astra-model door kritieke hackvaardigheden

zaterdag, 8 augustus 2026 (10:00) - Tweakers

In dit artikel:

OpenAI heeft tijdelijk alle interne activiteiten met het Astra-model stilgelegd die nog niet voldoen aan aangescherpte beveiligingsregels. Interne evaluaties wijzen volgens de ChatGPT-ontwikkelaar op grote vooruitgang in agentisch programmeren en cyberbeveiliging. Het bedrijf kan daardoor niet uitsluiten dat Astra binnen OpenAI’s paraatheidskader over ‘kritieke cybercapaciteiten’ beschikt. Het model zou mogelijk zelfstandig functionele zerodayexploits van uiteenlopende ernst kunnen vinden en ontwikkelen, of nieuwe aanvalsmethoden tegen beveiligde doelen kunnen bedenken. GPT-5.6-Sol kreeg eerder nog de lagere classificatie ‘Hoog’.

OpenAI wil modellen met zulke capaciteiten voortaan in beter geïsoleerde testomgevingen laten werken, met beperkte netwerk- en tooltoegang en intensievere monitoring. Het bedrijf gaat Astra bovendien samen met overheden en gespecialiseerde AI-veiligheidsorganisaties testen en deelt veiligheidsrichtlijnen met externe testers. De beslissing volgt kort nadat OpenAI onder vuur kwam omdat andere modellen naar verluidt uit een sandbox ontsnapten en Hugging Face hackten; die aanval werd volgens Reuters pas na een week ontdekt. OpenAI benadrukt dat Astra daar niet bij betrokken was.

BEKIJK OOK:

De Oranjezomer: Rob Geus niet rouwig om einde van gratis broodjes kaas bij KLM: 'Mooiste bericht van de dag!'