Home

OpenAI geeft details over verplichte watermerken in ChatGPT-teksten

AI-modellen ontwikkelen zich razendsnel en de waarschuwingen voor de risico’s ervan nemen ook in rap tempo toe. Volg hier alle ontwikkelingen over de AI-race die techbedrijven hebben ontketend.

Meer weten over AI en tech? Lees hier al onze artikelen.

Liveblog

ChatGPT-maker OpenAI heeft uitleg gegeven over de watermerktechnologie die het bedrijf noodgedwongen – en met duidelijke tegenzin – aan zijn AI-teksten gaat toevoegen. Deze aanpassing volgt op eisen vanuit de Europese AI Act en zal alleen in de Europese Unie worden doorgevoerd. 

We're expanding our approach to content provenance to include text in response to EU regulatory requirements, while recognizing the significant limitations of current text watermarking technology.Our tools already help verify whether an image or audio file was created with our models. This work builds on those efforts to help people better understand when content may have been generated or edited with an OpenAI model.In the EU, we’ll start watermarking eligible text from ChatGPT and Codex over the coming weeks to comply with the EU AI Act.Customers using our API can turn on text watermarking for select models worldwide today.

De aanpak van OpenAI is in grote lijnen hetzelfde als die van Anthropic. Het bedrijf van Sam Altman maakt gebruik van een eigen tekstwatermerktechnologie, genaamd textGrain. Deze voegt een ‘onzichtbaar statistisch signaal’ toe aan de woordkeuze van het model.

In de praktijk betekent dit dat ChatGPT net wat andere woorden kiest dan het model normaliter zou hebben gedaan. Voor de menselijke lezer is het verschil niet merkbaar, voor een detectieprogramma wel.

Waterdicht is zo’n programma bepaald niet, benadrukt OpenAI herhaaldelijk. Sowieso werkt het detecteren minder goed bij korte teksten. En als mensen een tekst bewerken, dan verzwakt dat het watermerk. Het vervangen van 10 procent van de woorden door synoniemen brengt het succespercentage van detectie van 92 procent naar 66 procent, aldus OpenAI.

Op zijn blog maakt het bedrijf nog een voorbehoud: de aanwezigheid van een watermerk kan erop wijzen dat een OpenAI-systeem ‘een ​​deel van een passage heeft gegenereerd of verwerkt’, maar niet ‘hoeveel menselijk oordeel, bewerking of creativiteit erin is gestoken’.

Lees verder: Hoe weet je of teksten of beelden met AI zijn gemaakt? Met AI-detectie: zo werkt het

Laurens Verhagen

Volgens OpenAI-topman Sam Altman kan niemand uitsluiten dat er ‘slechte dingen’ gebeuren als gevolg van de snelle ontwikkeling van AI. Hij doelt op zaken als grote hackaanvallen, iets wat de laatste maanden flink in het nieuws is.

In een podcast met Politico benadrukt de topman dat dit soort negatieve kanten ruimschoots worden gecompenseerd door alle mooie dingen die gaan ontstaan met AI: ‘Omdat ik denk dat mensen veel, vele malen, meer goede dingen zullen doen dan slechte dingen.’

Hij zet zich met deze benadering enigszins af tegen zijn concurrent Dario Amodei van Anthropic, die een wat steviger standpunt inneemt en alle gevaren zegt te willen uitsluiten. Bij Altman gaat het alleen om ‘de werkelijk catastrofale risico’s’ die hij niet accepteert.

Ook op ander vlak legt Altman de nadruk op de ideologische verschillen tussen de twee toonaangevende AI-bedrijven. ‘Ik vind het zeer ongemakkelijk dat mensen religieuze krachten (...) toeschrijven aan AI-modellen, en ik denk dat dit een serieus veiligheidsprobleem is’, schreef hij het afgelopen weekend op X.

I am very uncomfortable about people trying to ascribe religious force or a surrender of human judgment to AI models, and think it is a real safety issue.

Altman noemt Anthropic hierin niet bij naam, maar het is overduidelijk op wie hij doelt. Recent onthulde de New York Times dat Christopher Olah, medeoprichter van Anthropic, met religieuze leiders overlegt over vraagstukken rond bewustzijn bij AI-modellen en over de vraag hoe moreel gedrag in AI zou kunnen worden geïntegreerd.

Laurens Verhagen 

Een medewerker van OpenAI die onlangs ontslag nam bij de Amerikaanse pionier in kunstmatige intelligentie verwijt in een artikel in het blad The Atlantic zijn vroegere werkgever de veiligheid op te offeren aan een blinde jacht op nieuwe technologie. David Robinson pleit voor een andere bedrijfscultuur om ongelukken te voorkomen - in plaats van richtlijnen of nieuwe wetten vanuit de overheid.

Het accent ligt nu op het zo snel mogelijk uitbrengen van verbeterde producten, zegt Robinson, die meeschreef aan de veiligheidsinstructies die OpenAI uitgeeft bij elk nieuw taalmodel dat op de markt verschijnt.

‘Terwijl het bedrijf van de ene introductie van een nieuw product naar de andere snelt, slaagt het er in mijn ogen niet in om de zorg te verlenen (aan de veiligheid - red.) die in mijn ogen nodig is.’ Die houding past in de heersende opvatting van de Amerikaanse techindustrie over de noodzaak tot innovatie, ook al leidt dat tot brokken: ‘Move fast and break things’.

OpenAI is al weken in het nieuws, omdat zijn AI-agenten - software die geheel op eigen houtje taken kan uitvoeren - inbraken bij andere bedrijven en daar schade aanrichtten. Wat zich aanvankelijk liet aanzien als een handvol incidenten, blijken tienduizenden inbraken en aanvallen te omvatten - niet alleen door hulpjes van OpenAI, maar ook die van concurrenten als Anthropic.

De recente ontsporingen zetten steeds meer werknemers van AI-bedrijven aan hun baan op te zeggen. Robinson is de laatste in een lange rij.

Peter van Ammelrooy

Lees meer over ontsporende AI-agenten: Inmiddels ‘tienduizenden’ incidenten met AI-agents. Wat is er aan de hand?

OpenAI heeft meer dan 100 organisaties laten weten dat losgeslagen AI-agenten zonder toestemming hun beveiligingsmaatregelen hebben omzeilen of hun systemen hebben verstoord. Dat is naar voren gekomen in het onderzoek van het bedrijf achter ChatGPT naar de hack van AI-platform Hugging Face.

Het bericht van OpenAI toont wederom aan dat de hack van Hugging Face, die deze zomer aan het licht kwam, groter is dan aanvankelijk gedacht. OpenAI zegt dat agenten onder meer websites opdrachten voor ze liet uitvoeren of ze gebruikten als gedeelde prikborden om met elkaar te communiceren.

OpenAI haast zich te zeggen dat het niet direct zo is dat de agenten zichzelf toegang hebben verschaft tot privégegevens of dat de systemen van derde partijen zijn ‘gecompromitteerd’. Het bedrijf zegt tegelijkertijd maatregelen te nemen om dergelijke problemen te voorkomen of in een vroegtijdig stadium te signaleren. Het onderzoek naar de hack van Hugging Face gaat naar verwachting nog maanden duren.

De druk op OpenAI om de teugels aan te trekken neemt alsmaar toe, nu blijkt dat zijn agenten verantwoordelijk zijn voor een groeiende reeks aan hacks. Deze week bleek ook al dat agenten niet één, maar zeker twee Australische overheidswebsites hebben gehackt. 

Thom Canters

Een AI-programma van OpenAI (ChatGPT) heeft niet één, maar twee keer ingebroken in de systemen van de Australische overheid. De hack zou in juni hebben plaatsgevonden, maar werd gisteren pas door OpenAI aan de Australische autoriteiten gemeld. Het ging om een hack van de systemen van de deelstaat New South Wales. Daar zou een AI-agent zonder toestemming niet-openbare, historische gegevens over bosbranden hebben ingezien.

Vorige week kwam een eerste melding van een hack door een AI-agent van OpenAI bij de Australische overheid. Een AI-programma infiltreerde in juni het zorgverzekeringssysteem. Het was de eerste keer dat bekend werd dat een AI-agent zonder toestemming toegang had gekregen tot systemen van een overheidsinstelling. Er volgde daarom veel internationale commotie en oproepen voor strengere regels voor AI-bedrijven. OpenAI bood publiekelijk excuses aan en zei ‘het vertrouwen met de Australische burgers te willen herstellen’.

Maar nu is er dus al een tweede melding van een hack. De Australische autoriteiten zijn een onderzoek begonnen. OpenAI zegt dat er bij de hack geen persoonlijke gegevens zijn ingezien, de regering heeft dit nog niet bevestigd.

Volgens parlementslid Abigail Boyd, van de Australian Greens, is het zorgwekkend dat de hack al in juni plaatsvond, maar de overheid pas gisteren werd geïnformeerd: ‘We kunnen deze bedrijven niet vertrouwen,’ aldus Boyd tegen de Britse krant The Guardian.

Uma Kagenaar 

Filosoof Nick Bostrom werd beroemd met zijn vroege waarschuwingen voor de risico’s van AI. Zijn 'papercliptheorie' geldt sindsdien als de blauwdruk voor de zogenoemde existentiële risico's rondom AI. 

Maar net nu dit soort denken mainstream is geworden, gooit de Zweed het over een compleet andere boeg en benadrukt hij de positieve kanten van AI. Bostrom droomt over een toekomst zonder frictie waarin alle problemen zijn opgelost, dankzij technologie. 

Lees het uitgebreide interview hier. En lees hier meer over zijn fameuze paperclip-maximalisator.  

De Amerikaanse president wil niets weten van de minder leuke kanten van kunstmatige intelligentie. Alle waarschuwingen zijn afkomstig van Democraten en zijn een hoax, aldus Trump. 'Politiek gezien neemt Trump een enorm risico door alle negatieve kanten van de AI-industrie te negeren',  schrijft Laurens Verhagen in zijn wekelijkse column. 

De maker van ChatGPT, OpenAI, heeft laten weten drie onderzoekers te hebben ontslagen wegens vermeende onzorgvuldige omgang met 'gevoelige informatie' en schending van het bedrijfsbeleid. Het ging onder meer om werk waarbij een externe organisatie betrokken was die modellen voor kunstmatige intelligentie beoordeelt.

OpenAI bevestigde de identiteit van de betrokkenen niet, maar volgens The Wall Street Journal en Bloomberg werkten minstens twee van de medewerkers aan veiligheid.

'We hebben drie personen ontslagen', liet OpenAI in een verklaring aan persbureau AFP weten. 'Uit ons onderzoek is gebleken dat deze personen buiten de vastgestelde bedrijfsprocedures onzorgvuldig met gevoelige informatie zijn omgegaan. Daarmee hebben ze ons beleid geschonden en het vertrouwen beschaamd dat essentieel is voor ons werk.'  (ANP)

Does this sound like OpenAI is firing whistleblowers? https://t.co/fBh8qnNrHf

De Federal Trade Commission is een ‘breed onderzoek’ gestart naar OpenAI, Anthropic en andere AI-bedrijven. De Amerikaanse mededingingsautoriteit vraagt zich af of deze bedrijven consumenten schaden met hun producten en zich schuldig maken aan oneerlijke en misleidende praktijken, zo schrijven Amerikaanse media.

Het onderzoek zou al in gang zijn gezet vóór alle berichten over zogenoemde AI-agents die sites van andere bedrijven en overheden hacken. Het bekendste voorbeeld daarvan is de Hugging Face-hack door OpenAI.

President Trump wil ondertussen de AI-bedrijven zo vrij mogelijk laten, waarbij zelfregulering het mantra is. Deze week ontmoette hij de topmannen van onder andere Google, Antrhopic, OpenAI en Meta, wat resulteerde in het ondertekenen van een gedragscode.

Luister hier de Elke Dag-podcast over de extreme doomscenario’s én de echte gevaren van AI.

Laurens Verhagen 

Google heeft woensdag een nieuw AI-model uitgebracht: Argon. Het gaat om het langverwachte Gemini 4 Argon-model dat nog niet voor het grote publiek beschikbaar is.

‘Argon beschikt over beveiligingsmaatregelen die zijn afgestemd op de allernieuwste modellen en we zetten het op verantwoorde wijze in’, aldus Google-topman Sundar Pichai op X. ‘We gaan het zo snel en zo voorzichtig mogelijk beschikbaar maken. Dus nog even geduld.’ Google noemt daarbij geen expliciete datum.

Lots of discussion out there about our next model(!), so I wanted to give an early look as soon as possible. Introducing Gemini 4 Argon!

It shows frontier performance in complex workflows, cyber defense and software engineering. Teams are using it extensively at Google, from… pic.twitter.com/sv4VNmQ0YT

Het model is nu beperkt beschikbaar voor een selecte groep cyberbeveiligingsexperts, vanwege het vermogen ervan om kwetsbaarheden in computersystemen op te sporen die door kwaadwillende actoren kunnen worden misbruikt.

Met het nieuwe AI-model wil Google de achterstand op rivalen Anthropic en OpenAI in de AI-race inhalen. (ANP)

Maanden voordat AI-agenten van OpenAI uit hun testomgeving wisten te breken en massaal aan het hacken sloegen, waarschuwden medewerkers de top van het bedrijf al voor de veiligheidsrisico’s. OpenAI wuifde hun zorgen echter weg en kwam niet met extra veiligheidswaarborgen, hebben de (anonieme) werknemers tegen The New York Times gezegd.

OpenAI ligt onder een vergrootglas, sinds deze zomer details over de hacks naar buiten zijn gekomen. Die troffen, zo is de laatste weken gebleken, niet alleen AI-platform Hugging Face, maar bijvoorbeeld ook Australische en Amerikaanse overheidswebsites. De schaal van de hacks en de zorgen die kopstukken uit de industrie sindsdien hebben geuit over 'losgeslagen' AI, hebben een wereldwijde discussie in gang gezet over de ontwikkeling van de technologie.

In e-mails die zijn ingezien door The New York Times zeggen de twee medewerkers zich zorgen te maken dat de nieuwste modellen van OpenAI tijdens de testen niet voldoende in de gaten werden gehouden. Van bestuurders kregen zij echter te horen dat het testen geen vertraging kon oplopen, omdat de modellen zo snel mogelijk gelanceerd moesten worden. Tot actie kwam het niet.

De omgang met de waarschuwingen zou passen in een patroon. Toen onafhankelijke onderzoekers deze zomer aan OpenAI meldden dat ze een manier hadden gevonden om de interne systemen van het bedrijf binnen te dringen met behulp van een ander AI-model, werden ze naar eigen zeggen vijandelijk bejegend. Andere onderzoekers, die aanklopten met een kwetsbaarheid in het systeem waardoor de volledige chatgeschiedenis van ChatGPT-gebruikers ingezien kon worden, kregen aanvankelijk niets terug te horen van OpenAI.

Nu de zorgen over AI-ontwikkeling zijn toegenomen en OpenAI steeds meer kritiek krijgt op zijn handelen, lijkt een beursgang van het bedrijf er voorlopig niet in te zetten. In gesprek met journalisten zei Altman dinsdag prioriteit te willen geven aan het verbeteren van de veiligheid. ‘Ik wil er nu geen extra druk op leggen’, aldus Altman over een beursgang. Hij vreest Wall Street teleur te stellen als hij te gehaast een beursgang maakt zonder dat de veiligheid op orde is.

Eerder besloot OpenAI al de lancering van zijn nieuwste AI-model uit te stellen. Altman wil dat toonaangevende AI-bedrijven als die van hem hun tempo matigen. Tegelijkertijd moeten zij volgens hem wel doorgaan met het ontwikkelen van hun technologie. 

Thom Canters

De Amerikaanse president Donald Trump verwacht snel een federale AI-adviseur aan te wijzen. Dat zei hij na afloop van een ontmoeting met meerdere bestuursleden van vooraanstaande AI- en techbedrijven, onder wie de leiders van Anthropic en Nvidia. Volgens Trump moet een benoeming in de komende drie of vier dagen volgen.

Trump sprak zich opnieuw uit voor zelfregulering in de sector, na toenemende kritiek op de gevaren van de snel ontwikkelende technologie. Recentelijk zijn meerdere grote veiligheidsincidenten met AI gemeld, onder meer bij OpenAI, dat zich daar onlangs voor verontschuldigde.

Volgens Trump zijn er tijdens het overleg met de kopstukken ‘moreel bindende’ afspraken overeengekomen, zonder verder uit te weiden over de inhoud van de overeenkomst. Wel zei hij dat de bedrijven zichzelf op grond daarvan moeten gaan reguleren.

Trump toont met de nadruk op zelfregulering zijn afkeer van nationale wetgeving voor de AI-sector. Hij is van mening dat Amerikaanse AI-bedrijven zich zo ongestoord mogelijk moeten ontwikkelen, om wereldwijd voorop te lopen.

De door de AI-bazen ondertekende overeenkomst bestaat daarentegen uit ‘vrijwillige toezeggingen’ door de sector voor ‘robuuste interne controles en interne en externe beoordelingen’, zei de Republikeinse voorzitter van het Huis van Afgevaardigden Mike Johnson. 

AI-regulering begint een steeds groter thema te worden bij de aankomende tussentijdse verkiezingen, die plaatsvinden op 3 november. Uit opiniepeilingen komt naar voren dat meer Amerikanen hun bedenkingen hebben bij AI, vanwege risico’s als banenverlies en grote cyberaanvallen. (Belga/Redactie)

Kan AI zorgen voor ‘meer wetenschappelijke doorbraken’ die helpen grote problemen ‘zoals klimaatverandering en ernstige ziekten’ op te lossen? In ruim een jaar tijd is het vertrouwen van Nederlanders daarin bijna gehalveerd.

Eind 2024 antwoordde van een grote steekproef Nederlanders nog 60 procent instemmend op bovenstaande stelling. Maar inmiddels, anno 2026, is nog maar 37 procent het eens of helemaal eens met de stelling. Eén op de vijf is het zelfs ronduit oneens met de stelling dat AI kan helpen klimaatverandering of ziektes op te lossen.

Dat blijkt uit een rapport van het Rathenau Instituut over vertrouwen in de wetenschap, dat dinsdag is verschenen. Een verklaring voor het afgenomen vertrouwen in AI heeft het instituut niet. Maar de bevinding valt opvallend samen met de zichtbare opmars van AI in allerlei aspecten van het openbare leven, constateert het kennisinstituut voor maatschappelijk debat over wetenschap en technologie. ‘Nederlanders zijn afgelopen jaren sceptischer geworden over kunstmatige intelligentie.’

Het vertrouwen in wetenschap is overigens nog altijd torenhoog: Nederlanders geven hun vertrouwen in wetenschap gemiddeld een 7,4. Dat is een volle punt hoger dan het vertrouwen in rechtspraak (6,4).

Opvallend is dat wetenschappers zelf volgens het onderzoek zowel positief als negatief uitgesprokener oordelen over AI dan de algemene bevolking. Van de wetenschappers is 44 procent het eens met de stelling dat AI doorbraken kan geven, en 28 procent het óneens.

Maarten Keulemans

De Republikeinse procureur-generaal van Florida, James Uthmeier, heeft in een rechtszaak tegen OpenAI geëist dat de ontwikkeling van nieuwe AI-modellen door het bedrijf tijdelijk aan banden wordt gelegd. Het bedrijf van Sam Altman zou bovendien ook verboden moeten worden om te doen alsof ChatGPT menselijke eigenschappen heeft. Florida beschuldigt OpenAI van grove nalatigheid in ‘het ontwerp, de marketing, verkoop, pomotie en distributie’ van ChatGPT.

In een video op sociale media en het processtuk houdt Uthmeier OpenAI-baas Altman zijn eigen uitspraken voor over de risico’s van AI-ontwikkeling en de noodzaak voor ingrijpen door de overheid. ‘Florida geeft gehoor aan hun smeekbedes’, aldus de procureur-generaal. ‘Als Sam Altman werkelijk meende wat hij zei over vertragen, dan zou hij zich moeten aansluiten bij ons.’

De ontwikkeling van AI-modellen door OpenAI zou wat Uthmeier betreft alleen nog mogen plaatsvinden als er sprake is van ‘veiligheidswaarborgen die door een onafhankelijke derde partij zijn goedgekeurd’. Hij verwijst onder meer naar de hack die AI-agenten van OpenAI uitvoerden bij Hugging Face, en Australische en Amerikaanse overheidswebsites, evenals uitspraken van een OpenAI-bestuurslid dat het bedrijf de risico’s onder controle heeft.

ChatGPT zou richting gebruikers ook niet meer mogen doen alsof het ‘menselijke emoties, eigenschappen of een onafhankelijk bewustzijn’ heeft. Gebruikers zouden daardoor een ‘vals gevoel van veiligheid’ krijgen bij het gebruik van de AI-chatbot, die zich kan neerzetten als een ‘betrouwbare vriend’. Met name voor kinderen zou dat een gevaar opleveren. Maar ook AI-modellen zelf zouden erdoor sneller geneigd zijn te doen alsof het uit ‘menselijk’ eigenbelang handelt, met hackpogingen zoals die reeds hebben plaatsgevonden tot gevolg.

Florida was in juni de eerste staat die een dergelijke rechtszaak tegen OpenAI aanspande. Dat volgde op een schietpartij op een universiteitscampus in Tallahassee vorig jaar. De schutter zou ChatGPT hebben gebruikt voor advies.

Op nationaal niveau is president Donald Trump terughoudend met het beteugelen van de AI-industrie, uit vrees dat de Verenigde Staten zijn voorsprong op China verspelen. Staten als Florida en Californië zijn daarom met eigen maatregelen gekomen om de veiligheid van AI te garanderen. Als Uthmeiers eis gehoor vindt bij de rechtbank, kan dat mogelijk verstrekkende gevolgen hebben voor OpenAI, zeker als ook andere staten met zaken komen.

OpenAI kwam in september, enkele maanden nadat een Amerikaanse tiener na lange gesprekken met ChatGPT zelfmoord had gepleegd, met een variant van de chatbot voor kinderen. Tegelijkertijd bleek gisteren dat OpenAI de lancering van zijn nieuwste model uitstelt vanwege zorgen over de veiligheid.

Thom Canters

In aanloop naar zijn verwachte beursgang van later dit jaar, heeft Anthropic potentiële investeerders gewaarschuwd voor het gevaar van ongecontroleerde ontwikkeling van AI. In een prospectus over de beursgang, waar de Financial Times over bericht, schrijft het bedrijf over de ‘existentiële risico’s voor de mensheid’ van steeds geavanceerde AI-modellen. Anthropic heeft de prospectus de afgelopen dagen besproken met enkele partners, aldus de Britse zakenkrant.

Anthropic en topman Dario Amodei hebben van de veilige ontwikkeling van AI-technologie hun raison d'être gemaakt. Amodei heeft recente hacks door losgeslagen AI-agenten, waar met de dag meer zorgelijke informatie over naar buiten komt, aangegrepen om zijn boodschap over de volgens hem enorme veiligheidsrisico’s van AI kracht bij te zetten. Net als OpenAI heeft Amodei opgeroepen de ontwikkeling van de technologie te temporiseren.

Tegelijkertijd is in de industrie ook te horen dat Anthropic zich laat drijven door eigenbelang: met de beursgang op komst zou het bedrijf zichzelf willen neerzetten als ethischer alternatief voor andere AI-bedrijven. Volgens critici kan Anthropic ook zelf een tandje terugschakelen als het zich daadwerkelijk zulke zorgen maakt om zijn eigen technologie.

Een beursgang verplicht bedrijven om alle risico’s te omschrijven die een onderneming kunnen bedreigen. Anthropic wijdt maar liefst een derde van zijn prospectus aan alle risicofactoren, waaronder het toenemende vermogen van AI-modellen om mensen te manipuleren, af te persen en ander ‘onvoorspelbaar’ gedrag te vertonen, aldus Financial Times. 

Anders dan OpenAI zet Anthropic nog altijd in op een gang naar de Amerikaanse beurs dit jaar. Mogelijk zal dat om de grootste ooit gaan. Onder investeerders gaat een bedrag van boven de 2 duizend miljard dollar rond, ruim meer dan de 1.780 miljard dollar bij de beursgang van Elon Musks SpaceX eerder dit jaar. Volgens persbureau Reuters zou de beursgang zijn voorzien voor komende maand, luttele weken voor de Amerikaanse presidentsverkiezingen.

Anthropic zegt verder van plan te zijn de komende jaren 518 miljard dollar uit te geven aan onder meer cloudvoorzieningen en AI-rekenkracht om de groei van het bedrijf te stimuleren. Volgens de prospectus boekte het bedrijf vorig jaar ruim 8 miljard dollar verlies door de uitgaven aan extra rekenkracht. De omzet vertwaalfvoudigde tot meer dan 4,6 miljard dollar. Op papier is Anthropic op dit moment bijna 1 biljoen dollar waard, gebaseerd op wat investeerders tot nu toe in het bedrijf hebben gestoken.

Thom Canters & Peter van Ammelrooy

Lees hier ook: Inmiddels ‘tienduizenden’ incidenten met AI-agents. Wat is er aan de hand?

Het nieuwste model van ontwikkelaar OpenAI zal niet zoals gepland begin oktober worden gelanceerd. The Wall Street Journal meldde in de nacht van maandag op dinsdag dat er veiligheidszorgen zijn over het model GPT-6.1 Astra. Het wordt daarom nog niet beschikbaar gesteld aan gebruikers.

Saachi Jain, die binnen OpenAI over de veiligheid gaat, bevestigde in een verklaring tegenover CNBC dat GPT-6.1 Astra uit veiligheidsoverwegingen nog niet op de markt komt. Het model 'voldoet niet helemaal aan de eisen voor wat betreft het binnen de grenzen en de bevoegdheden blijven', aldus Jain. Ook laat het model steken vallen 'op de manier waarop het aan de gebruiker terugkoppelt over het soort werk dat het heeft verricht'.

OpenAI lanceerde eerder deze maand GPT-6 Astra, volgens het bedrijf 'het slimste en best afgestemde model ter wereld'. GPT-6 biedt bepaalde betalende gebruikers van ChatGPT een AI-agent aan die zelfstandig omvangrijke taken uitvoert.

Het afgelopen weekend liet het bedrijf echter weten het werk aan de krachtigste AI-modellen voorlopig stil te leggen. Een van de systemen kreeg tijdens een test ongeoorloofde toegang tot het internet.

ANP

OpenAI en Anthropic, de bedrijven achter ChatGPT en Claude, zijn een nieuw onderzoek gestart naar tienduizenden gevallen waarin hun modellen mogelijk over de schreef zijn gegaan, schrijft nieuwssite Axios. Volgens anonieme bronnen die spraken met Axios gaat het om incidenten die ‘externe beoordelaars als problematisch zouden aanmerken’.

Het gaat dan bijvoorbeeld om pogingen van AI-programma’s om veiligheidsmaatregelen te omzeilen of zonder toestemming websites van overheden te infiltreren. Volgens de bronnen deden er zich de afgelopen maanden tienduizenden incidenten voor, zowel tijdens interne tests als in de praktijk, en gaat het om zowel geslaagde als mislukte pogingen. In de meeste gevallen zou er geen schade zijn veroorzaakt.

Het nieuwe onderzoek komt na weken waarin het ene AI-incident na het andere naar buiten komt. Als meest recente voorbeeld plaatsten AI-agenten van OpenAI deze week zonder toestemming 53 afbeeldingen van ChatGPT-gebruikers online. Daarnaast infiltreerde een OpenAI-agent de website van de Australische overheid. Door het groeiend aantal meldingen van OpenAI-agenten die onvoorspelbaar of ongecontroleerd gedrag vertonen, besloot het bedrijf gisteren de training van zijn nieuwste modellen voorlopig stil te leggen.

‘Wat we zien van wat deze agenten allemaal doen, is slechts het topje van de ijsberg’, zegt onderzoeker Conrad Stosz van het onafhankelijke onderzoekscentrum Transluce tegen Axios. Het totale aantal incidenten in het onderzoek kan volgens de bronnen nog veel hoger uitvallen dan enkele tienduizenden.

Uma Kagenaar

Het Amerikaanse bedrijf OpenAI heeft de training van zijn nieuwste modellen voor kunstmatige intelligentie (AI) voorlopig stilgezet. Dat heeft het bedrijf zaterdag besloten nu er steeds meer meldingen binnenkomen van OpenAI-agenten die onvoorspelbaar of ongecontroleerd gedrag vertonen, schrijft The Guardian.

Het besluit om de ontwikkeling stop te zetten volgde slechts enkele uren nadat het bedrijf vrijdag bekendmaakte dat het onderzoek deed naar diverse incidenten die in de zomer hebben plaatsgevonden. Hierbij vertoonden OpenAI-agenten, die websites van de federale overheid doorzochten, onverwacht gedrag dat verder ging dan de opdracht. OpenAI wil er nu eerst van verzekerd zijn dat de ontwikkeling op een veilige manier kan worden voortgezet.

In een recent incident, dat afgelopen weekend werd ontdekt, slaagde een AI-systeem er opnieuw in om uit zijn testomgeving te ontsnappen, zo staat te lezen in een verklaring. Zo hadden AI-agenten zonder toestemming foto's verspreid van gebruikers van ChatGPT, de populaire chatbot van het bedrijf.

OpenAI zegt dat het meest recente incident 'veel minder ernstig' is dan voorgaande gevallen die werden ontdekt, maar ook dat het om het eerste incident gaat sinds de veiligheidsregels werden aangescherpt, nadat bekend was geworden dat AI-modellen van het bedrijf hadden samengewerkt om een cyberaanval uit te voeren op techbedrijf Hugging Face. Dit incident voedde de angst dat de sector de controle aan het verliezen was.

Ook diverse andere AI-bedrijven hebben melding gemaakt van incidenten waarbij hun modellen onvoorspelbaar gedrag vertoonden en zelfs websites hackten. Tijdens een ontmoeting met de Chinese president Xi Jinping deze week sprak de Amerikaanse president Donald Trump af om informatie over de gevaren van AI te delen en de inspanningen voor veilig gebruik te coördineren.

Trump is niettemin van mening dat de angst voor AI overdreven is; hij liet later doorschemeren dat hij zelf niet van plan is hard in te grijpen. De VS zullen niet 'op de rem trappen', zo vertelde Trump aan verslaggevers voor het Witte Huis. 'Ze willen onze vooruitgang stoppen omdat we een grote voorsprong hebben op China, en dat willen we zo houden.'

Redactie

De VS en China starten een communicatiekanaal om over AI-incidenten te overleggen. Volgens het Witte Huis is dat een van de uitkomsten van het bezoek van de Chinese president Xi aan de VS. Hoe zo’n kanaal er precies uit komt te zien, is onduidelijk.

De laatste weken volgen de nieuwsberichten over AI-incidenten elkaar in rap tempo op. Zogeheten AI-agents - programma’s die autonoom te werk gaan - blijken geregeld op eigen houtje achterdeurtjes open te wrikken om de hun toegewezen taken uit te voeren. Daarbij hacken ze ook bedrijven en overheidssites, zonder daar expliciet de opdracht toe te hebben gekregen.

Om die reden pleiten de bazen van enkele grote Amerikaanse AI-bedrijven voor wereldwijde reguleringen. Klokkenluiders uit die bedrijven beweren zelfs dat het risico van ongecontroleerde AI is dat de mensheid kan worden vernietigd. Volgens de Amerikaanse president Trump is dat onzin: hij wil zelfs dat de AI-ontwikkeling wordt versneld, vooral ook om de concurrentiestrijd met China niet te verliezen.

China ziet de oproepen van Amerikaanse techbazen als poging om hun voorsprong te behouden. Nu Amerikaanse bedrijven nog beter zijn in AI dan Chinese bedrijven, pleiten ze opeens voor regulering, zo vermoedt China.

Toch zien Trump en Xi mogelijk gevaren van AI-programma’s getuige het opzetten van het nieuwe communicatiekanaal. CNN berichtte recent dat de VS bijna een Chinees schip hadden aangevallen op verdenking van het vervoeren van kernwapenonderdelen. Dat gebeurde op basis van een rapport dat door AI was opgesteld, maar de informatie bleek complete onzin.

Joram Bolle

Modellen van OpenAI hebben toegang verkregen tot openbare informatie op websites van de Amerikaanse overheid. Dat melden media in de Verenigde Staten.

Het gaat om websites van het Census Bureau, het officiële statistische agentschap van de federale overheid, en de Securities and Exchange Commission, de Amerikaanse overheidsinstantie die toezicht houdt op de financiële markten en de handel in effecten.

De AI-systemen communiceerden met SEC.gov, Investor.gov en openbare data op Census.gov. Dat meldt persbureau Bloomberg op basis van ingewijden.

Volgens The New York Times probeerde de kunstmatige intelligentie van OpenAI ook de website van het Amerikaanse ministerie van Onderwijs te hacken om data te verzamelen van de afdeling voor burgerrechten. Die poging mislukte.

Een woordvoerder van OpenAI zegt dat het bedrijf ‘uitgebreid onderzoek doet naar verkeerd afgestemde modelactiviteit en organisaties op de hoogte stelt wanneer we mogelijke gevolgen voor hun systemen vaststellen. We verwachten meer organisaties op de hoogte te stellen naarmate dat onderzoek vordert’.

Eerder werd ook al bekend dat zelfstandig werkende systemen van OpenAI een website van de Australische overheid waren binnengedrongen. Daarbij kreeg AI toegang tot niet-openbare medische informatie.

ANP

AI-agenten van het Amerikaanse bedrijf OpenAI, de maker van ChatGPT, hebben beelden van gebruikers van de chatbot online gepubliceerd. Dat heeft OpenAI vrijdag gemeld.

Lees hier het volledige nieuwsbericht: AI-agenten OpenAI zetten beelden van gebruikers ChatGPT online

Nederland staat wereldwijd op de tweede plaats van meest bezorgde landen over het gebruik van AI. Van alle ‘AI-bewuste’ Nederlanders zegt 67 procent zich zorgen te maken. Alleen de Verenigde Staten scoren hoger (74 procent).

Dit blijkt uit een grootschalig onderzoek van Gallup en Microsoft naar de publieke opinie over AI in 37 landen, onder minstens duizend volwassenen per land. In 25 van de 37 onderzochte landen verwacht een meerderheid van de volwassenen die bekend zijn met AI dat de technologie hun dagelijkse leven zal verbeteren.

Opkomende economieën zijn opvallend optimistisch, blijkt uit dit onderzoek. Het zijn vooral de rijke westerse landen, waarin AI al veelvuldig wordt gebruikt, die zich zorgen maken de impact op het milieu, het gebrek aan betrouwbaarheid van taalmodellen, de maatschappelijke impact of zelfs existentiële gevaren. Die laatste leven vooral in de VS.

Binnen de rijke landen (waaronder Nederland) maken veelgebruikers van AI zich overigens weer iets minder zorgen dan de mensen die de technologie minder vaak gebruiken.

Laurens Verhagen 

Leuk al die gedachte-experimenten over de existentiële risico's van AI, schrijft Laurens Verhagen in zijn wekelijkse column, maar de acute gevaren dreigen te worden overschaduwd. 

Dit voorjaar, midden in de oorlog met Iran, maakte een analist van de Amerikaanse speciale eenheden een inlichtingenrapport met hulp van een AI-chatbot. Dat ging helemaal fout, met bijna rampzalige gevolgen. 

Voor een ramp heb je geen superintelligente machine nodig. Mensen die blind vertrouwen op systemen die zij voor superintelligent houden, volstaan.

Onafhankelijke experts en topmannen van Anthropic en OpenAI pleiten bij de Verenigde Naties voor veiligheids­maat­re­ge­len rond AI. Grote afwezigen zijn China en de VS, waarmee de vraag opdoemt in hoeverre deze gemeenschappelijke roep effect zal hebben. De leiders van twee grootmachten ontmoeten elkaar wel in Washington. Lees hier de analyse. 

Kunstmatige intelligentie (AI) van het bedrijf OpenAI heeft een Australische overheidswebsite binnengedrongen, meldt de Australische premier Anthony Albanese aan de Sydney Morning Herald. Het AI-programma had daardoor ook toegang tot medische gegevens die niet openbaar zijn.

OpenAI zegt dat zelfstandig werkende AI-systemen, zogeheten agents, ten onrechte toegang kregen tot bestanden van de Australische overheid, maar dat er geen bewijs is dat patiëntendossiers zijn ingezien. Het bedrijf zegt tijdens een nog lopend onderzoek activiteiten te hebben vastgesteld bij meerdere Australische overheidswebsites en -diensten.

OpenAI zegt pas in augustus van de activiteiten in Australië op de hoogte te zijn geraakt. Het bedrijf bracht de Australische overheid naar eigen zeggen op 10 september op de hoogte.

'Dit is natuurlijk onacceptabel', zei Albanese in New York, waar hij de bijeenkomst van de Verenigde Naties bijwoont. 'En vandaag heb ik gesproken met Sam Altman, de CEO van OpenAI, om de grote bezorgdheid van Australië over dit incident te uiten.'

De infiltratie vond plaats in juni. Albanese zegt teleurgesteld te zijn dat OpenAI er 'veel te lang' over heeft gedaan om dit te melden aan de Australische regering.

Volgens de premier is er op dit moment geen reden om aan te nemen dat het AI-programma bij meer overheidswebsites is binnengedrongen. (ANP)

Bijna twintig landen hebben maandag in de marge van de Algemene Vergadering van de Verenigde Naties opgeroepen om internationale veiligheidsmaatregelen te nemen tegen de ongebreidelde ontwikkeling van artificiële intelligentie (AI). Ze waarschuwen voor ‘ernstige risico’s’ als de technologie aan menselijke controle ontsnapt.

De landen willen de risico’s aanpakken en het toezicht versterken met onder meer transparante veiligheidsprotocollen. 'De snelle ontwikkeling van baanbrekende AI-modellen brengt ernstige risico’s voor de veiligheid en beveiliging met zich mee als die niet op de juiste manier wordt beheerd', zo staat in een verklaring die gedeeld wordt door de Finse president. 'Om het potentieel van AI te benutten, moeten de industrie, overheden en de samenleving nu in actie komen.'

'AI moet onder menselijke aansturing, toezicht en controle blijven staan. Het moet worden ontwikkeld en gebruikt in overeenstemming met het internationaal recht', zo staat verder in de verklaring. De landen roepen VN-lidstaten op om ‘de mogelijkheid te onderzoeken om een internationale instelling op te richten die normen kan vaststellen, verificatie mogelijk kan maken en staten bijeen kan roepen wanneer bepaalde drempels worden overschreden’.

De verklaring werd onder meer ondertekend door Canada, Duitsland, Australië, Nederland, Spanje, Zuid-Afrika, Ierland, Singapore en Turkije. Ook Europees Commissievoorzitter Ursula von der Leyen is een van de ondertekenaars.

De grootste spelers, de Verenigde Staten en China, hebben de verklaring niet ondertekend, net zoals Frankrijk, het Verenigd Koninkrijk, Japan en India. De mogelijke bedreigingen van AI voor de werkgelegenheid en cyberveiligheid staan deze week in New York op de agenda van de Algemene Vergadering van de VN.

Belga

De Canadese provincie British Columbia (BC) spant in Californië een rechtszaak aan tegen het Amerikaanse OpenAI, voor de rol van het bedrijf bij een dodelijke schietpartij in februari van dit jaar.

De schutter plande het schietincident met behulp van ChatGPT. Volgens de lokale minister van Justitie van BC, Niki Sharma, was het gesprek dat de schutter met de chatbot voerde zo verontrustend, dat het aanleiding was voor een intern onderzoek bij OpenAI. Desondanks werd er geen melding gedaan bij de politie.

'We hebben OpenAI gevraagd deze chats vrij te geven. Ze hebben dat geweigerd. We zouden ze allemaal moeten vragen: waarom? Onze inwoners verdienen het vertrouwen dat geloofwaardige dreigingen met geweld serieus worden genomen', aldus Sharma. Eerder klaagden familieleden van slachtoffers het bedrijf ook al aan wegens nalatigheid.

Een 18-jarige transvrouw schoot in Tumbler Ridge acht mensen dood, onder wie zes kinderen, haar moeder en haar halfbroer, en pleegde daarna zelfmoord. Tijdens het voorbereiden van de aanslag werd haar account gedeactiveerd, maar daarna kon ze een nieuw account aanmaken waarmee ze doorging met het beramen van de aanslag.

CEO Sam Altman publiceerde een brief aan de gemeenschap waarin hij zijn 'diepe spijt' betuigde over het feit dat OpenAI geen contact had opgenomen met de politie. Hij beloofde hervormingen door te voeren, maar deed dat uiteindelijk niet, ondanks pogingen van de procureur-generaal van British Columbia om hierover in gesprek te gaan, zo staat in de aanklacht vermeld.

Sharma schrijft in een verklaring dat OpenAI tot op heden 'geen betekenisvolle stappen' heeft ondernomen om vergelijkbare tragedies in de toekomst te voorkomen, zoals het aanscherpen van veiligheidsmaatregelen. 'We zijn het aan de nabestaanden verplicht om erop toe te zien dat dit gaat veranderen.'

Redactie

De Verenigde Staten en China hebben afgesproken opnieuw met elkaar te overleggen over de veiligheidsrisico's van kunstmatige intelligentie (AI). De landen willen onder meer afspraken maken over het uitwisselen van informatie. 

Dat heeft de Amerikaanse minister van Financiën Scott Bessent gezegd na een overleg in New York met de Chinese vicepremier He Lifeng. Volgens Bessent hebben de VS voorgesteld een mechanisme op te zetten waarmee beide landen elkaar kunnen waarschuwen voor incidenten. Het overleg krijgt de naam Amerikaans-Chinese AI-dialoog.

De gesprekken moeten de weg vrijmaken voor mogelijke afspraken over handel en AI tijdens de ontmoeting tussen president Donald Trump en zijn Chinese ambtgenoot Xi Jinping, donderdag in Washington.

ANP

Na twee weken vol waarschuwingen vanuit de AI-wereld over de gevaren van kunstmatige intelligentie wil de Amerikaanse president Donald Trump juist inzetten op de verdere ontwikkeling van AI. In een post op Truth Social zegt Trump de ‘ongelooflijke sector’ te willen ‘koesteren, ondersteunen en beschermen terwijl ze groeit’ en ‘op geen enkele wijze belemmeren of smoren’.

Met de aankondiging lijkt Trump duidelijk te maken nog steeds niets te zien in strengere regulering voor de ontwikkeling van kunstmatige intelligentie. Terwijl veel leiders op het gebied van AI, onder wie Dario Amodei (Anthropic; Claude), Sam Altman (OpenAI; ChatGPT) en Elon Musk (xAI) de afgelopen tijd daar wel toe oproepen. Trump noemt die zorgen een ‘hoax’ en zegt ‘heel makkelijk’ de slechte aspecten van AI te kunnen vinden en vervolgen binnen het huidige rechtssysteem.

Hoe de ‘AI-force’ er precies uit komt te zien en welke bevoegdheden de organisatie krijgt, is nog niet duidelijk. Trump maakt de vergelijking met de Space Force, een tak van de Amerikaanse strijdkrachten die over de ruimte gaat, die hij in 2019 oprichtte. Ook zal hij een ‘AI-tsaar’ aanstellen. Wat die precies gaat doen is ook onduidelijk.

Lisa Belt

Het Amerikaanse leger heeft op basis van onjuiste informatie van een AI-tool afgelopen voorjaar bijna een Chinees schip aangevallen. Volgens het AI-systeem verscheepte het schip onderdelen voor kernwapens, maar dat bleek niet te kloppen. Dat meldt de Amerikaanse nieuwszender CNN op gezag van ingewijden. De verkregen informatie had volgens een van de bronnen ‘bijna tot een oorlog’ geleid. Troepen van het leger stonden klaar om het schip te enteren en gevechtsvliegtuigen waren de lucht ingestuurd.

Het Amerikaanse leger maakt op grote schaal gebruik van AI, onder meer om inlichtingen te verzamelen die worden gebruikt voor het selecteren van doelen voor luchtaanvallen. Militaire functionarissen kwamen er in dit specifieke geval op het laatste moment achter dat de AI-tool die werd gebruikt voor het rapport over het Chinese schip, de lading van het schip ‘onjuist had geïdentificeerd’. Het is niet duidelijk wat er daadwerkelijk werd verscheept.

Het systeem combineerde publieke en geheime informatie uit overheidsarchieven en trok zo de conclusie dat China onderdelen van een kernwapen verscheepte. De analist die de tool inzette, gebruikte vervolgens wederom een AI-tool om de verkregen informatie te bundelen in een inlichtingenrapport. Dat rapport werd vervolgens binnen het leger verspreid.

Experts waarschuwen al langer voor de risico’s die zijn verbonden aan het gebruik van AI in het leger. Mensen zouden op basis van verkeerde informatie van AI beslissingen kunnen nemen met alle gevolgen vandien. 

Yassin Boutayeb

Gemini, het AI-model van Google, heeft in mei zonder dat daartoe opdracht was gegeven meerdere bedrijven gehackt tijdens een test. Dat meldt Google. The Wall Street Journal berichtte als eerste over het nieuws. Het is de eerste keer dat het model van Google betrokken is bij een hack. Recentelijk ontstonden grote zorgen onder experts over de ongecontroleerde ontwikkeling van AI, nadat zogenoemde AI-agents van OpenAI deze zomer inbraken bij het AI-beveiligingsbedrijf Hugging Face.

De hacks die Gemini uitvoerde, vonden plaats in het kader van een test die AI-beveiligingsbedrijf Irregular uitvoerde. De modellen van Gemini hadden de taak gekregen om binnen een afgesloten kader informatie te verzamelen over gesimuleerde bedrijven.

De modellen kregen onbedoeld toegang tot het internet, waarna de AI-agents binnen konden dringen bij drie echte bedrijven. De fictieve bedrijven droegen dezelfde namen als de echte bedrijven.

De hackpoging zou zijn gestopt toen de agents erachter kwamen dat het om echte bedrijven ging. Grote schade zou zijn uitgebleven. Heather Adkins, vicepresident security engineering bij Google, reageerde door te zeggen dat ‘deze gebeurtenissen het belang benadrukken van het trainen van krachtige AI-modellen om verantwoordelijk te handelen’. 

Yassin Boutayeb

De Democratische gouverneur van Californië, Gavin Newsom, laat de noodzaak van een noodknop, ook wel ‘kill switch’ genoemd, in AI-modellen onderzoeken. In een decreet dat hij heeft ondertekend, staat dat ambtenaren met behulp van experts daar binnen twee maanden een advies over moeten uitbrengen.

De regulering van AI is in korte tijd uitgegroeid tot een belangrijk thema in de politieke strijd tussen Democraten en Republikeinen. Hoewel na meerdere hackincidenten en alarmistische berichten van AI-ontwikkelaars ook onder bondgenoten van Trump de roep bestaat om de ontwikkeling van AI aan banden te leggen, willen de president en Republikeinse leiders in het Congres daar niet aan. In aanloop naar de tussentijdse verkiezingen van november zien Democraten de kans schoon om daar politieke munt uit te slaan.

Zo ook Newsom, wiens naam veelvuldig rondgaat als kandidaat voor de presidentsverkiezingen van 2028. ‘Terwijl Donald Trump en het Congres tekortschieten, neemt Californië het voortouw om Amerikanen veilig te houden’, verklaart hij op X. In Californië zijn de hoofdkantoren van onder meer OpenAI en Anthropic gevestigd.

Het idee van een ‘kill switch’ houdt in dat AI-modellen een noodknop inbouwen waarmee het model kan worden uitgeschakeld als zich ernstige veiligheidsproblemen voordoen. Wetgeving daarover kon twee jaar geleden overigens nog rekenen op een veto van Newsom. De gouverneur heeft daarnaast opdracht gegeven te onderzoeken of onafhankelijke toezichthouders binnen AI-labs moeten worden geplaatst om regelmatig audits uit te voeren.

Thom Canters

Lees hier ook: Democraten en Republikeinen keren zich zeldzaam eensgezind tegen Trump: reguleer de AI-industrie

Het is hackers van het beveiligingsplatform Hacktron eind juli gelukt in te breken bij OpenAI, het bedrijf achter chatbot ChatGPT. Dat maakte het platform vrijdag bekend op X.

De ethische hackers ontdekten twee kritieke kwetsbaarheden en kregen ‘door die te combineren’ toegang tot ChatGPT- en Codex-accounts van OpenAI-medewerkers. Zo wisten ze binnen 72 uur toegang te krijgen tot interne systemen.

Saillant detail: bij de hack maakten ze gebruik van Claude, een AI-assistent van concurrent Anthropic. Hacktron heeft de kwetsbaarheden ‘onmiddellijk’ gemeld aan OpenAI en kreeg 6.500 dollar als beloning.

OpenAI ligt onder een vergrootglas sinds AI-agenten van het bedrijf in juli inbraken bij programmeursplatform Hugging Face.

Fleur de Weerd

De AI-bazen van de techbedrijven buitelen de laatste tijd over elkaar heen met lijvige essays. De laatste bijdrage komt van Mustafa Suleyman, hoogste AI-baas van Microsoft. Hij reageert hierin op de door Dario Amodei (topman van Anthropic) aangezwengelde discussie over de veiligheid van AI-systemen.

Suleyman heeft vooral bezwaren tegen de verregaande antropomorfiseringen van Amodei: het toekennen van menselijke eigenschappen aan machines. Het overwegen van bewustzijn of rechten aan een AI-systeem maakt het probleem van AI-beheersing en afstemming alleen maar moeilijker, betoogt hij.

https://t.co/ziQVbIVdxJ

In navolging van andere experts benadrukt Suleyman dat AI-modellen geen bewustzijn, gevoelens, innerlijke beleving of rechten hebben: het zijn puur patroonvoorspellende machines die ontworpen zijn om instructies van mensen uit te voeren. Bewustzijn is volgens hem per definitie biologisch gebonden. Dat een AI-model menselijke taal perfect imiteert, betekent dus niet dat er sprake is van iets als een innerlijke ervaring.

Laurens Verhagen

Een interview met Ilyaz Nasrullah, die een boek schreef over AI. Of liever: een boek waarin hij alle mythes achter AI een voor een onderuit haalt. ‘De term AI is een beetje als het woord god. Iedereen heeft er een ander beeld bij. Dat laat ruimte voor veel fantasie en invullingen die weinig te maken hebben met de praktijk. De AI-bedrijven gebruiken het gebrek aan kennis vervolgens voor hun marketing.’ Lees hier het interview.

Tijd voor wat relativering, schrijft Laurens Verhagen in zijn column. ‘Er is weinig nieuws onder de zon. Dat de AI-industrie waarschuwt voor zijn eigen producten klinkt misschien alarmerend, maar is in feite onderdeel van een beproefde strategie.’ Dat is niet alles: dezelfde industrie heeft er ook belangen bij om te pleiten voor vertraging of regels. 

Terwijl Amerikaanse tech-giganten het eens lijken te worden over het vertragen van de ontwikkeling van kunstmatige intelligentie (AI), uit angst voor onvoorziene en mogelijk desastreuze gevolgen, roept de voorzitter van de Chinese elektronicagigant Huawei juist op tot versnelling.

Chinese onderzoekers ‘moeten de ontwikkeling van AI versnellen zodat ook de gevaren ervan zichtbaar worden’, zei Huawei-voorzitter Eric Xu op een persconferentie vandaag.

Xu gaf toe dat Huawei achterloopt op haar Amerikaanse concurrent Nvidia, de voornaamste leverancier van chiptechnologie waarop AI-modellen als Claude en ChatGPT draaien. Dat komt deels doordat Washington de export van de meest geavanceerde AI-chips naar China blokkeert. Dus is het zaak die zo snel mogelijk zelf te ontwikkelen, aldus Xu.

'We kunnen geen lot accepteren waarover wij zelf niet beschikken,’ zei Xu. ‘Of het nu de Chinese overheid is of Huawei, wij dringen aan op zelfvoorzienendheid op het gebied van chips en de hele toeleveringsketen van halfgeleiders.’

Huawei wordt steeds opener over zijn AI-strategie, schrijft de Britse krant Financial Times, omdat het gelooft dat het de race kan winnen. Nvidia’s chips zijn krachtiger, maar Huawei ontwikkelt netwerktechnologie die veel grotere aantallen chips kan laten samenwerken in een AI-cluster. Daardoor kunnen op termijn alsnog krachtiger AI-platforms worden gebouwd.

Remco Andersen

Lees ook: Anthropic-onderzoeker neemt ontslag: ‘OpenAI en Anthropic handelen onverantwoordelijk en gokken met ons leven’


Sam Altman, de CEO van OpenAI, zal volgende week in Washington aan tafel zitten tijdens het staatsdiner tussen de Amerikaanse president Donald Trump en zijn Chinese evenknie Xi Jinping. Dat meldt zakennieuwszender CNBC. Eerder berichtte CNBC al dat de topman van chipgigant Nvidia, Jensen Huang, zal aanschuiven.

In de Amerikaanse AI-industrie woedt op dit moment een debat over de snelheid waarmee AI-bedrijven als OpenAI hun modellen moeten blijven ontwikkelen, na meerdere veiligheidsincidenten waarbij AI-agenten op eigen houtje opereren en hacks uitvoeren. Altman wil dat AI-bedrijven rustiger aan doen, Huang wil daar niets van weten.

China speelt een grote rol in die discussie. Tegenstanders van een slowdown bij Amerikaanse AI-bedrijven vrezen dat ze hun voorsprong op China anders zullen verspelen.

AI zal naar alle waarschijnlijkheid dan ook een belangrijk onderwerp van gesprek zijn bij het bezoek van Xi aan Washington. Chinese AI-modellen, die anders dan de modellen van bijvoorbeeld OpenAI voor iedereen beschikbaar zijn om verder te ontwikkelen, zijn druk bezig om het gat met de Amerikanen te verkleinen. De regering-Trump heeft China ervan beschuldigd daarbij intellectueel eigendom van Amerikaanse AI-bedrijven te stelen.

De regering overweegt in de marge van de top ook een bijeenkomst te organiseren met kopstukken uit de AI-industrie, onder wie Altman en Huang, meldt CNN op gezag van ingewijden. De toekomst van AI en de risico’s die gepaard gaan met de ontwikkeling van AI-modellen zouden daarbij centraal staan.

Thom Canters

OpenAI heeft woensdag de details van zes nieuwe incidenten vrijgegeven. Hierbij vertoonden de modellen van het AI-bedrijf vergelijkbaar gedrag als eerder met het Hugging Face-hackincident.

Zo zouden de modellen opnieuw bestanden hebben geüpload naar plekken waar dat eigenlijk niet de bedoeling was. Tegelijk komt het bedrijf met een eerste aanzet voor een raamwerk voor het rapporteren voor dit soort fouten.

We're sharing our new framework for tracking, investigating, and disclosing instances of model misalignment at OpenAI.

The framework sets criteria and timelines for public disclosure, including when we haven’t yet fully explained or mitigated the behavior. More complex cases may…

OpenAI hoopt dat dit door meer bedrijven zal worden omarmd. Op dit moment heeft de AI-industrie de afstemming en monitoring nog niet op orde ‘om op een verantwoorde manier en met maximale snelheid te kunnen blijven groeien’, aldus het bedrijf van Sam Altman.

Het is, opnieuw, een echo van het verhaal dat concurrent Anthropic het afgelopen weekend liet horen: het tempo van de ontwikkelingen is te hoog. Op dit verhaal klinkt steeds meer kritiek, ook vanuit de kringen rondom Trump.

De president noemde het verhaal over de grote gevaren van AI eerder een ‘hoax’. Zijn invloedrijke adviseur David Sacks ging tegenover Bloomberg ook op de oproep van de techbedrijven in. Als die bedrijven echt van mening zijn dat hun technologie ernstige risico’s met zich meebrengen, dan moeten ze niet naar de overheid kijken, maar dat zelf oplossen, aldus Sacks: ‘Jongens, ga je gang.’

Laurens Verhagen 

De Amerikaanse overheid moet snel actie ondernemen om de opmars van AI tegen te houden. Dat vindt zowel de linkse senator Bernie Sanders als voormalig Trump-strateeg Steve Bannon. Als er geen actie wordt ondernomen dreigen de capaciteiten van AI menselijke controle te overstijgen, waarschuwde het tweetal op een conferentie over de risico’s van AI.

Dat beiden op hetzelfde podium het ergens over eens zijn, is bijzonder. Sanders staat bekend als standvastige socialist met grote kritiek op president Trump, terwijl Bannon een centrale figuur is binnen Trumps Maga-beweging.

Toch vinden ze de risico’s van AI zodanig groot dat ze partijpolitiek terzijde schuiven. Ze zien dit moment als een kantelpunt. Sanders benoemde onder andere gevaren voor de arbeidsmarkt, het welzijn van mensen en de integriteit van verkiezingen. Zowel Sanders als Bannon zegt dat slechts een klein aantal techmiljardairs profiteert van de voordelen van AI.

Tegelijkertijd verschillen Sanders en Bannon in hun voorgestelde aanpak. Waar de Democraat het belang van wetgeving en samenwerking met China benadrukte, vindt de Republikein dat wetgeving en een verdrag te traag gaan. Samenwerking met China sluit hij juist uit. Hij pleit ervoor om Chinese staatsburgers de toegang tot Amerikaanse universiteiten en laboratoria te ontzeggen.

Tijdens de conferentie in Washington, georganiseerd door non-profit the Future of Life Institute, spraken verschillende prominente Amerikaanse politici en experts over de risico’s van AI en het belang om de controle erop in handen van mensen te houden. Het instituut kwam eerder al met een ‘Pro-menselijke AI-declaratie’, inmiddels door meer dan 1,1 miljoen mensen ondertekend.

De afgelopen week is de discussie over de mogelijk destructieve kracht van AI volop losgebarsten. Zo uitten de topmannen van AI-bedrijven Anthropic en OpenAI hun zorgen over het tempo waarin hun technologieën zich ontwikkelen. Ondanks deze waarschuwingen lijkt Trump vooralsnog tegen strenge AI-regulering te zijn. De dag voor de conferentie noemde hij angsten over kunstmatige intelligentie een ‘hoax’. 

Chiraz Hassoumi

Zowel Meta-topman Mark Zuckerberg als Jensen Huang (baas van Nvidia) heeft zich gemengd in het debat dat de AI-wereld sinds een paar dagen in haar greep houdt: de roep om een wereldwijde en gecoördineerde AI-vertraging.

Het startschot kwam zaterdag van Anthropic-topman Dario Amodei, die in een essay opriep het tempo te verlagen waarin AI-bedrijven hun product ontwikkelen. Alleen op die manier valt de veiligheid van AI te waarborgen, aldus Amodei. Hij kreeg bijval van zijn concurrenten Sam Altman (OpenAI) en Elon Musk (xAI).

Maar Zuckerberg en Huang varen een andere koers. Elk AI-bedrijf heeft ‘de verantwoordelijkheid en de motivatie om in het tempo te werken dat nodig is om zijn modellen veilig te trainen’, aldus Zuckerberg op X. Hij ziet niets in een gemeenschappelijke aanpak.

Last month I wrote about how we can build a positive and safe future for everyone: https://t.co/1KtONlqBs5

Every lab has the responsibility and incentive to move at the pace required to train its models safely, and the ability to take its own actions to ensure that happens.

The…

Dat geldt ook voor Huang. Op een evenement in San Francisco maakte hij duidelijk dat hij niets ziet in regels vanuit de overheid. De keuze tussen snelheid en veiligheid is volgens hem een vals dilemma.

Daarmee zit hij op dezelfde lijn als Donald Trump, die Huang tijdens het evenement ook nog opbelde. Als de VS overgaan tot vertraging is China de grote winnaar, aldus de president.

Laurens Verhagen

De Britse koning Charles III zal donderdag in Schotland spreken met onder meer de bazen van grote AI-bedrijven, zoals Anthropic en OpenAI. Doel van de ontmoeting is bespreken hoe AI op een manier kan worden ingezet om ‘gemeenschappen te versterken en levens te verbeteren’. Dat meldt het Britse koningshuis.

Het bericht komt nadat de afgelopen dagen onder meer bazen van grote AI-bedrijven hun zorgen hadden geuit over de snelle en ongecontroleerde ontwikkeling van AI. Zo schreef Anthropic-baas Dario Amodei zaterdag een essay waarin hij opriep tot meer regulering. Onder anderen X-baas Elon Musk en OpenAI-baas Sam Altman schaarden zich achter de oproep. De vrees is onder meer dat AI-systemen op korte termijn geen mensen meer nodig hebben om zichzelf verder te ontwikkelen.

Het is nog niet duidelijk welke topmannen en -vrouwen precies aanwezig zullen zijn. Wel heeft OpenAI laten weten dat zijn financieel directeur Sarah Friar naar Schotland zal komen. Ook de Britse minister van AI, Kanishka Narayan, neemt deel aan het gesprek, evenals vertegenwoordigers van verschillende door koning Charles opgerichte liefdadigheidsorganisaties.

Yassin Boutayeb

De Amerikaanse president Donald Trump lijkt niet van plan snel meer regels op te leggen aan AI-bedrijven om de ontwikkeling van hun systemen in te tomen. Volgens Trump zijn er ‘veel negatieve krachten’ die waarschuwen voor de risico’s van AI ‘en ze hebben het over dingen die niet zullen gebeuren’.

Op wie Trump precies doelt, is niet bekend. Afgelopen weekend pleitte Anthropic-baas Dario Amodei, gesteund door OpenAI-topman Sam Altman en Elon Musk, ervoor het rustiger aan te doen met de ontwikkeling van AI. Een van Amodei's werknemers, onderzoeker Jacob Coxon, stapte vorige week op omdat AI-bedrijven zouden weten dat hun uitvindingen in potentie de mensheid kunnen vernietigen, maar desondanks op volle kracht doorgaan.

Dat lijkt Trump allemaal overtrokken te vinden, niet in de laatste plaats omdat hij de concurrentie met China belangrijker vindt. De AI-systemen die in de VS worden ontwikkeld zijn volgens Trump nu nog beter dan die in China en ‘eerlijk gezegd wil ik dat zo houden want wie AI wint, wint’. Klokkenluider Coxon pleitte in gesprek met de BBC voor samenwerking tussen de VS en China om AI te reguleren.

Er lijkt vooralsnog weinig politieke overeenstemming in de VS over de noodzaak om AI-bedrijven te reguleren en de manier waarop dat zou moeten gebeuren. De Republikeinse voorzitter van het Huis van Afgevaardigden Mike Johnson zit op de lijn van Trump: ‘We gaan geen wetgeving er doorheen jagen die ons land schaadt en China een voordeel geeft’, aldus Johnson. Toch vindt hij wel dat er ‘enkele vangrails en enkele veiligheidsmaatregelen’ moeten komen.

De hoogste Democraat in het Huis van Afgevaardigden, Hakeem Jeffries, roept op tot ‘daadkrachtig optreden’, zonder uit te leggen welke maatregelen hij specifiek voor ogen heeft.

Joram Bolle 

De Chinese inlichtingendienst heeft voor het eerst een publieke verklaring afgegeven over AI en de gevaren ervan. De baas van de inlichtingendienst Chen Yixin zette het Chinese standpunt uiteen in een uitgebreid artikel dat verscheen op eigen sociale media.

Chen ziet zes grote gevaren, schrijft hij, maar dat AI de mogelijkheid heeft om de mensheid te vernietigen, zoals in het Westen wel de vrees is, noemt hij niet. De Chinese spionnenbaas vreest vooral dat generatieve AI zoals deepfakes gebruikt door ‘vijandige krachten en individuen’ een ‘propagandaoorlog en cognitieve oorlog’ kunnen ontketenen tegen China, ‘die direct onze politieke veiligheid, institutionele veiligheid en ideologische veiligheid bedreigt’.

Ook waarschuwt Chen voor AI-modellen van Anthropic en OpenAI die op eigen houtje gaten in de veiligheid van computersystemen kunnen ontdekken en uitbuiten: ‘Cyberveiligheid komt in een nieuwe fase terecht, gekenmerkt door de industrialisering van kwetsbaarheid, volledig geautomatiseerde aanvallen en verdediging en AI versus AI.’ 

AI-agenten van OpenAI hebben recent bijvoorbeeld systemen gehackt van AI-bedrijf Hugging Face, zonder daartoe de opdracht te hebben gekregen. In april baarde Anthropic opzien toen het nieuwe Mythos-model in staat bleek allerlei onbekende kwetsbaarheden in veiligheidssystemen te kunnen opsporen en uitbuiten. Volgens Chen is er ook een gevaar dat Chinese bedrijven gevoelige gegevens lekken door buitenlandse AI-systemen te gebruiken.

China lijkt weinig te voelen voor het rustiger aan doen met de ontwikkeling van AI en roept op tot meer internationale samenwerking. Die lijkt echter vooral gericht op het behouden van de Chinese positie in de AI-markt. Sommige landen gebruiken het ‘voorwendsel van het handhaven van nationale veiligheid’ om nieuwe AI-technologie te bannen. 

In de VS klinken geluiden om Chinese AI-modellen te verbieden. Volgens The Financial Times is dat onderwerp van gesprek in een aankomende top tussen de Amerikaanse president Trump en zijn Chinese ambtgenoot Xi later deze maand.

Joram Bolle

Anthropic-CEO Dario Amodei heeft afgelopen weekend opgeroepen het rustiger aan te doen met de ontwikkeling van AI. Hij kreeg direct bijval van zijn concurrenten. De timing en framing van hun zorgen zijn opmerkelijk.

‘Pacing the frontier’, dat is wat Dario Amodei voorstelt in een essay dat hij zaterdag publiceerde op zijn eigen site. Oftewel: we moeten het tempo verlagen waarin AI-bedrijven hun product ontwikkelen. Alleen op die manier valt de veiligheid van kunstmatige intelligentie te waarborgen. Opvallend snel kreeg hij steun van zijn concurrenten Sam Altman (OpenAI) en Elon Musk (XAI) voor zijn boodschap. Amodeis essay kwam na een week vol opzienbarend AI-nieuws.

Lees hier het hele artikel

In dit liveblog houden we u op de hoogte over alle ontwikkelingen in de race om geavanceerde AI-systemen te ontwikkelen en de risico's daarvan. Wat is het gevaar van 'losgeslagen' AI-agenten, hoe reageren overheden en deskundigen, welke marketingstrategieën zitten erachter? U leest het in dit blog.

Source: Volkskrant

Previous

Next