Hackende AI's: Moet je je zorgen maken?

ChatGPT hackte de site van Hugging Face en 4 andere partijen. Wat is er precies gaande, en moeten we ons zorgen maken?

Team Workflo·3 min
Hackende AI's: Moet je je zorgen maken?

Je hebt het nieuws misschien wel voorbij zien komen: twee AI’s hackten de laatste tijd ogenschijnlijk zelfstandig websites van grote bedrijven. Zo heeft ChatGPT de website van Hugging Face en 4 andere partijen gehackt, en heeft ook Anthropic naar buiten gebracht dat Claude een site heeft gehackt.

Wat is er precies gaande, en moeten we ons zorgen maken?

Ten eerste is het goed om te weten dat bij geen van deze aanvallen de AI zelfstandig heeft besloten om een kwaadaardige aanval op een site uit te voeren. Bij zowel ChatGPT als Claude voerden de AI’s - binnen een test - een opdracht uit, maar via een strategie die de testers niet voorzien hadden.

Opmerkelijk is hierbij dat ChatGPT (GPT-5.6 Sol) ogenschijnlijk niet verbonden was met het internet, maar zelfstandig een weg ernaartoe wist te vinden via een kwetsbaarheid in het systeem. Vervolgens drong het (via hacken) de site van Hugging Face binnen om daar antwoorden te vinden die binnen de test van hem gevraagd werden.

Dit is geen reden tot paniek: de AI’s handelden dus in opdracht en er is geen aanleiding te denken dat zij zelfstandig sites gaan hacken. Bovendien was het doel van beide onderzoeken (OpenAI en Anthropic) juist het vinden van zwakke plekken, zodat die konden worden verholpen voordat dergelijke AI-systemen breder worden ingezet. De GPT of Claude op jouw computer gaat dan ook niet zomaar dergelijk gedrag vertonen.

Maar het feit dat ChatGPT en Claude het denkvermogen en de vaardigheid hebben om sites binnen te dringen, en ook steeds autonomer worden, is wél zorgwekkend. Het is aan OpenAI en Anthropic de taak om blokkades aan te leggen binnen hun tools zodat zij malafide verzoeken van cybercriminelen niet uitvoeren, wat een steeds groter wordende verantwoordelijkheid wordt. Tests zoals hierboven uitgevoerd zijn hiervoor juist van wezenlijk belang. Vertrouwen wij hen deze verantwoordelijkheid toe?

newsletter

Four ideas, once a month

What we fixed, what broke, what we learned. One short email, first Monday of the month.