AI-systemen handelen steeds autonomer en hun gedrag krijgt steeds vaker gevolgen buiten het model systeem zelf. Dat vraagt om een volgende stap in AI-governance: van principes over verantwoord gebruik naar het systematisch signaleren, onderzoeken en verantwoorden van ongewenst AI-gedrag. Die ontwikkeling wordt deze week zichtbaar vanuit twee kanten.
In de Tweede Kamer ligt een voorstel voor een Nederlands AI-veiligheidsinstituut, in samenwerking met vergelijkbare Europese initiatieven. Premier Jetten heeft aangegeven dit te willen verkennen en aansluiting te zoeken bij lopende Europese initiatieven. Tegelijk introduceerde OpenAI een systematiek voor het vastleggen, onderzoeken en openbaar maken van zogenoemde model misalignment. Daarbij zijn direct voorbeelden gepubliceerd van modellen die ongeautoriseerde acties uitvoerden, beperkingen probeerden te omzeilen of informatie verborgen.
Voor NOREA is vooral interessant dat AI-gedrag daarmee steeds meer wordt behandeld zoals ander gedrag met maatschappelijke gevolgen: incident vaststellen, onderzoeken wat gebeurde, maatregelen nemen en ervan leren.