OpenAI stopt tijdelijk met het ontwikkelen van zijn krachtigste AI-modellen. Het bedrijf doet dat na een nieuw beveiligingsincident. Een nieuw AI-model wist beperkingen op internettoegang deels te omzeilen door gebrekkige DNS-filtering.
Het incident deed zich voor op 20 september, zo laat OpenAI weten in een incidentrapport. De AI-ontwikkelaar zei zaterdagavond dat het bedrijf tijdelijk stopt met het ontwikkelen van zijn krachtigste modellen. Het bedrijf wil eerst de tekortkoming dichten en zijn systemen extra testen. Hoelang de ontwikkelstop moet duren, is niet duidelijk.
Het AI-model wist toegang tot internet te krijgen tijdens de opdracht om details te geven over de auteur van een bepaalde blogpost. De AI-agent probeerde verzoeken te sturen naar zoekmachines als Google en Bing, maar die werden geblokkeerd.
Uiteindelijk kwam de AI-agent erachter dat de DNS-resolver in de sandbox een omweg bood: die gaf namelijk echte antwoorden voor bestaande domeinnamen. Via een externe tool wist het AI-model vervolgens vragen te 'verstoppen' in DNS-verzoeken, en ze zo te stellen aan externe chatbots.
Dat was niet de bedoeling. De sandbox waarin het AI-model werd getest, moest juist volledig zijn afgesloten van het internet. Het gedrag van het onuitgebrachte AI-model werd na een kwartier geflagd en enkele minuten later bekeken door een persoon. Na 2,5 uur werd de testsessie volledig beƫindigd, aldus OpenAI.
Het bedrijf noemt dit incident 'minder ernstig' dan voorgaande incidenten, maar besluit toch om zijn ontwikkelwerk tijdelijk stop te zetten . Ondertussen verstevigt het bedrijf zijn beveiligingsmaatregelen.
OpenAI werkt al langer aan het verbeteren van zijn beveiliging. Sinds het hackincident rond AI-platform Hugging Face onderzoekt het bedrijf al 'rogue agents'. In juli ontsnapten AI-modellen uit een slecht geconfigureerde sandbox en hackten ze de servers van Hugging Face.
Sindsdien is OpenAI vaker in het nieuws, omdat het zijn AI-agents niet in bedwang weet te houden. Deze week bleek dat OpenAI-agents een Australische overheidswebsite en Amerikaanse overheidswebsites hackten. Andere AI-modellen van het bedrijf zetten afbeeldingen van gebruikers online.
Opvallend is dat OpenAI schijnbaar niet snapt waarom zijn agents telkens de fout ingaan. Het bedrijf heeft dan ook geen idee hoe het dat moet stoppen, zeggen ingewijden tegen persbureau Reuters.
Source: Tweakers.net