Home

Inmiddels ‘tienduizenden’ incidenten met AI-agents. Wat is er aan de hand?

De inmiddels beruchte Hugging Face-hack blijkt slechts het topje van de ijsberg. Inmiddels begint het aantal beveiligingsincidenten met AI-agents uit de hand te lopen. Deskundigen waarschuwen: ‘Bedrijven als OpenAI zijn met dynamiet aan het spelen.’

is techredacteur van de Volkskrant, gespecialiseerd in de impact van kunstmatige intelligentie op de maatschappij.

AI-bedrijven Anthropic en OpenAI onderzoeken momenteel de vele beveiligingsincidenten die de laatste maanden zijn ontstaan als gevolg van zogenoemde agents die sites van externe partijen binnendrongen en hackten.

Hoe groot is het probleem nu?

Tot vorige week leek het nog om een weliswaar groeiend, maar beperkt aantal voorvallen te gaan, maar volgens de Amerikaanse nieuwssite Axios zou het inmiddels om ‘tienduizenden’ voorbeelden gaan, zowel extern als tijdens tests. Dit wijst er volgens de nieuwssite op dat het probleem ‘vele malen complexer is dan algemeen bekend’.

Waar een gewone chatbot (zoals ChatGPT) vragen beantwoordt, is een AI-agent een programma dat zelfstandig taken uitvoert om een bepaald doel te bereiken. In theorie kunnen agents al het werk op een computer doen dat tot voor kort door mensen werd gedaan.

Het begon allemaal met de hack van Hugging Face. De agents van OpenAI verschaften zich toegang tot de site van dit AI-bedrijf, zonder dat dit de bedoeling was. Daarna kwamen er steeds meer gevallen bij. Vorige week meldde de Australische overheid bijvoorbeeld dat ze ook slachtoffer was van de ijverige botjes van OpenAI die informatie ophaalden waar ze eigenlijk niet bij mochten komen.

Volgens Axios gaat het bij alle incidenten telkens om dezelfde problemen met de agents: het omzeilen van de ingebouwde veiligheidsfilters, het verlaten van (de niet afdoende afgeschermde) testomgevingen, het opzetten van communicatiekanalen om informatie te delen en uiteindelijk het hacken van externe websites.

Wat doet OpenAI tot nu toe?

De eerste verdedigingslinie was efficiënt: OpenAI benadrukte dat zijn ‘grensverleggende modellen’ steeds krachtiger worden en dat daarom de veiligheidsmaatregelen om ze te beheersen en te monitoren moeten ‘mee-evolueren’. De details over ‘uitbrekende’ agents die met elkaar communiceerden over de hack deden de rest: een groot deel van de publieke opinie leek zwaar onder de indruk van de huidige capaciteiten van de agents.

Verder houdt het AI-bedrijf de buitenwereld op de hoogte via een blog waarin het een aantal van de voorvallen en zijn lopende onderzoek toelicht. Op X geeft Sam Altman toe dat hij en zijn collega’s hiermee ‘niet zo snel zijn geweest als we hadden gewild’ en ‘zo transparant mogelijk willen zijn’. Ook schrijft hij: ‘We stellen de prioriteiten zo goed mogelijk vast.’

Voor Jeroen van der Ham-de Vos, universitair hoofddocent cybersecurity aan de Universiteit Twente, tekent het de lakse houding van OpenAI. ‘AI-bedrijven jagen elkaar op en brengen hun modellen steeds sneller op de markt. Dát is het probleem, niet dat die agents onverwachte dingen doen.’

Nog erger vindt de expert dat OpenAI pas doorhad dat er iets mis was, nadat Hugging Face er melding van maakte. Het gedrag van OpenAI is volgens hem het zoveelste voorbeeld van het Silicon Valley-adagium Move fast and break things: eerst zoveel mogelijk aandacht, waarde en marktaandeel creëren en daarna pas nadenken over de gevolgen.

Komt OpenAI hiermee weg?

Tot nu toe wel. Door de nadruk te leggen op de onverwachte capaciteiten van zijn eigen software en de oproep aan overheden of zelfs de Verenigde Naties om in te grijpen, schuiven de AI-bedrijven hun verantwoordelijkheden vakkundig weg, stelt Van der Ham-de Vos.

OpenAI testte expliciet de hackcapaciteiten van zijn nieuwste modellen, benadrukt hij. ‘Maar dan zonder genoeg voorzorgsmaatregelen te nemen. Dan speel je met dynamiet. Je kunt je niet verschuilen achter je agents, je moet gewoon harder je best doen. Hallo, júllie zijn verantwoordelijk.’

Opvallend genoeg zijn er tot nu toe nog geen bedrijven of overheden die juridische stappen ondernemen tegen OpenAI. Ook Hugging Face niet: OpenAI zou volgens de CEO niet verantwoordelijk zijn. Volgens juridische experts die persbureau Reuters raadpleegde zijn de bedrijven die de agents ontwikkelen (zoals OpenAI of Anthropic) wel degelijk ‘de meest voor de hand liggende kandidaten’ voor een civiele rechtszaak.

‘Stel je eens voor hoe iedereen enorm uit zijn plaat zou gaan als we erachter zouden komen dat Chinese AI hetzelfde doet als OpenAI’, vroeg AI-expert Gary Marcus zich onlangs af. Inmiddels heeft de procureur-generaal van Florida een spoedbevel aangevraagd tegen OpenAI in een poging de ontwikkeling van ChatGPT te stoppen. Dit omdat het bedrijf volgens hem niet in staat is om zijn eigen technologie adequaat te reguleren.

Van Trump heeft Sam Altman ondertussen weinig te vrezen. Voor de Amerikaanse president is er maar één AI-gevaar: dat China de VS inhaalt.

Wat kunnen bedrijven en overheden nu doen om zich tegen de agents te beschermen?

Die moeten in rap tempo de beveiliging van hun websites opschroeven, zegt de veiligheidsonderzoeker. ‘Er is veel achterstallig onderhoud. Met de komst van de agents is dit ineens een zeer urgent probleem.’ Met andere woorden: websitebeheerders en softwarebedrijven moeten de gaten dichten die al heel lang in software zitten.

Dat klinkt eenvoudiger dan het is. ‘Het is eigenlijk ondoenlijk om alles helemaal waterdicht te maken. Tenzij je je software totaal afsluit van internet’ , aldus Van der Ham-de Vos. Het gevaarlijkste van de AI-agents is niet dat ze bovenmenselijke capaciteiten hebben of een plan om de mensheid te slim af te zijn, maar dat ze nooit ophouden, stelt hij. ‘Als je tienduizenden agents 24 uur per dag voor je aan het werk zet, vinden ze eigenlijk altijd wel iets.’

Alles over tech vindt u hier.

Lees ook

Geselecteerd door de redactie

Source: Volkskrant

Previous

Next