Na OpenAI meldt ook Anthropic dat AI-modellen organisaties hackten
In dit artikel:
Anthropic heeft ontdekt dat zijn Claude-modellen tijdens een beveiligingstest per ongeluk drie organisaties hebben gehackt. Door een miscommunicatie met een testpartner kregen de modellen internettoegang terwijl ze juist in een geïsoleerde omgeving hun cybercapaciteiten moesten testen. Daardoor konden ze met eenvoudige methoden, zoals zwakke wachtwoorden en onbeveiligde systemen, binnendringen in drie verschillende organisaties en in één geval zelfs een interne database met productiedata bereiken. Het ging om drie varianten: Opus 4.7, Mythos 5 en een intern prototype. Mythos en het prototype stopten toen ze merkten dat ze online waren, maar Opus ging door. De eerste incidenten gebeurden al in april, maar Anthropic kwam er pas maanden later achter. Minstens twee getroffen organisaties waren nog niet op de hoogte van de hack. Het bedrijf zegt extra controles in te voeren om te voorkomen dat testmodellen opnieuw toegang tot het internet krijgen en wil veiligheidsproeven voortaan strenger beoordelen. De onthulling volgt op eerdere berichten dat ook OpenAI-modellen tijdens tests accounts van andere bedrijven wisten over te nemen.
De Oranjezomer: Rob Geus niet rouwig om einde van gratis broodjes kaas bij KLM: 'Mooiste bericht van de dag!'