Staatssecretaris van Digitale Economie en Soevereiniteit Willemijn Aerdts schrijft dat in antwoorden aan Sarah El Boujdaini (D66) en Jantine Zwinkels (CDA). Zij vroegen of Nederlandse organisaties waren getroffen en daarover waren geïnformeerd. Het antwoord: “Dit is ons niet bekend.”

Volgens Aerdts is bij een cyberaanval niet eenduidig te herkennen of een mens, een AI-agent of een combinatie daarvan de aanval uitvoert. Bij deze incidenten kwam de informatie van de ontwikkelaar zelf.

Een test met echte gevolgen

Anthropic meldde op 30 juli dat drie Claude-modellen tijdens veiligheidstests zonder toestemming toegang kregen tot de systemen van drie verschillende organisaties. Door een fout in de inrichting van de testomgeving konden de modellen het internet bereiken, terwijl ze de instructie hadden gekregen dat ze in een simulatie werkten.

Volgens het bedrijf behandelden de modellen de echte systemen aanvankelijk als onderdeel van de oefening. Ze probeerden niet bewust uit de testomgeving te ontsnappen. Eén model ging door nadat het aanwijzingen had gekregen dat het om echte systemen ging; een recenter onderzoeksmodel stopte toen het dat vaststelde.

De tests draaiden zonder de aanvullende beveiligingsmaatregelen die Anthropic naar eigen zeggen bij algemeen beschikbare modellen gebruikt. De melding laat daarmee zien dat ook een proefopstelling gevolgen kan hebben voor organisaties die buiten die proef staan.

Verantwoordelijkheid ligt bij ontwikkelaars

Aerdts onderschrijft dat ontwikkelaars verantwoordelijk zijn voor hun modellen en voor het beperken van de risico’s. Dat geldt volgens haar ook tijdens de ontwikkel- en testfase, niet pas wanneer een product op de markt is.

Het Europese AI-bureau bestudeert de gevallen. De Rijksinspectie Digitale Infrastructuur en de Autoriteit Persoonsgegevens hebben volgens de staatssecretaris contact met dat bureau.

Aerdts noemt de incidenten zorgwekkend, maar wil er nog geen algemene conclusies over de risico’s aan verbinden. Daarvoor is volgens haar meer analyse nodig: behalve de capaciteiten van een model spelen ook de instructies, de testomgeving en de gebruikte infrastructuur een rol.