Zo brengt OpenAI zijn veiligheid in lijn met de EU AI Act

·
Luister naar dit artikel~5 min
Zo brengt OpenAI zijn veiligheid in lijn met de EU AI Act

OpenAI stemt veiligheids- en transparantiepraktijken af op de EU AI Act. Ontdek de GPAI-Code, nieuwe kaders en het EU Cyber Actieplan voor betere AI-bescherming.

OpenAI heeft uiteengezet hoe het zijn werk op het gebied van veiligheid, beveiliging en transparantie afstemt op de GPAI-Code van de EU AI Act, nu de handhaving dichterbij komt. Het bedrijf heeft bijgedragen aan en zijn steun uitgesproken voor de EU-Code voor Algemene-Doel-AI (GPAI) en de Gedragscode voor Transparantie van AI-gegenereerde Content. Beide codes zijn voortgekomen uit processen met meerdere belanghebbenden. ### Wat betekent de GPAI-Code precies? De GPAI-Code stelt een gezamenlijke norm voor transparantie, veiligheid en beveiliging voor algemene AI-modellen die in de EU worden verkocht of ingezet. OpenAI wijst op een reeks bestaande praktijken als bewijs dat het al dicht bij die norm opereert: tests van modellen vóór de release, gepubliceerde systeemkaarten bij grote lanceringen en externe red-teaming via het zogenaamde Red Teaming Network. Het bedrijf onderhoudt ook een openbaar Model Spec-document dat beschrijft hoe het modelgedrag vormgeeft. Twee interne kaders liggen ten grondslag aan dit werk. Het Preparedness Framework bestaat al sinds 2023 en werd in 2025 geüpdatet; het beschrijft hoe OpenAI ernstige risico's van geavanceerde systemen identificeert, evalueert en beheert. Een apart Frontier Governance Framework bouwt hierop voort en legt uit hoe de veiligheids- en beveiligingspraktijken van het bedrijf aansluiten op wettelijke vereisten, waaronder specifiek de GPAI-Code. Samen beheren deze twee documenten risicobeoordeling, waarborgen, modelrapportage, beveiligingspositie, incidentrespons en de manier waarop externe experts bij het proces worden betrokken. ### Samenwerking binnen en buiten de EU OpenAI verwijst naar zijn deelname aan het Frontier Model Forum, samen met samenwerkingen met het Amerikaanse Center for AI Standards and Innovation en het Britse AI Security Institute. Daarnaast draagt het bij aan evaluatiestandaarden van derden. Het doel is gedeeld veiligheidsonderzoek en duidelijkere testbenchmarks voor de hele industrie, niet alleen binnen de muren van één bedrijf. ### Herkomst wordt lastiger naarmate modaliteiten toenemen De toezeggingen uit de Transparantie-Code richten zich op een ander probleem: mensen helpen herkennen wanneer content door AI is gemaakt of aangepast. De aanpak van OpenAI rust op twee mechanismen die elkaar moeten versterken. Content Credentials, gebaseerd op de C2PA-standaard, voegen context direct toe aan een bestand. SynthID-watermerken bieden een vangnet voor gevallen waarin die metadata onderweg verloren gaat. De dekking breidt zich uit van afbeeldingen naar audio-uitvoer, en OpenAI zegt te werken aan uitbreiding van herkomstmaatregelen naar andere modaliteiten, waaronder tekst, naarmate de onderliggende standaarden en tools volwassener worden. Het bedrijf bouwt ook signalen en richtlijnen voor ontwikkelaars die aan hun eigen transparantieverplichtingen moeten voldoen wanneer ze voortbouwen op de modellen. Dit lost herkomst niet volledig op. Metadata gaat verloren en labels overleven niet altijd een overdracht tussen platforms. Geen enkel signaal, cryptografisch of op watermerken gebaseerd, vangt alles in zijn eentje op. De reactie van OpenAI is een gelaagde aanpak, gecombineerd met voortdurend werk binnen de bredere standaardengemeenschap, in plaats van de bewering dat één mechanisme het gat dicht. ### Cybersecurity als testcase voor adaptief bestuur Capaciteiten die verdedigers helpen kwetsbaarheden te vinden en te verhelpen, zijn dezelfde capaciteiten die een aanvaller kunnen helpen ze als eerste te vinden. OpenAI gelooft dat het antwoord ligt in het Trusted Access for Cyber-programma, ontworpen om gecontroleerde verdedigers toegang te geven tot geavanceerdere cybercapaciteiten terwijl misbruik wordt beperkt. Dat programma heeft nu een Europese tak. OpenAI stelt dat het zijn EU Cyber Actieplan begin mei 2026 heeft gelanceerd, in samenwerking met EU- en nationale cyberagentschappen, private partners en infrastructuuroperators om hen toegang te geven tot de meer geavanceerde cybermodellen. Het doel is de cyberweerbaarheid op het hele continent te versterken. Of "meest geavanceerd" zich vertaalt in meetbare defensieve winst binnen deze agentschappen, is een bewering van OpenAI zelf; het bronmateriaal biedt geen onafhankelijke verificatie. - Pre-release testing van modellen - Gepubliceerde systeemkaarten bij lanceringen - Extern red-teaming via het Red Teaming Network - Openbaar Model Spec-document > De kernvraag blijft: kunnen deze maatregelen de kloof tussen belofte en praktijk echt overbruggen? De komende maanden zullen het uitwijzen.