Geoffrey Hinton stelt voor geavanceerde AI-modellen vóór uitgifte te keuren zoals medicijnen, maar de Verenigde Staten hanteert alleen een vrijwillig pre-release kader en sluit verplichte licenties expliciet uit. Behandel daarom elke veiligheidsclaim van een aanbieder als onvolledig tot modelversie, evaluatiescope en onopgeloste bevindingen bekend zijn.
In een interview bepleit Geoffrey Hinton, een van de grondleggers van moderne neurale netwerken, dat krachtige AI-modellen een goedkeuringsproces zouden moeten doorlopen dat vergelijkbaar is met de toelating van geneesmiddelen. De kern van die vergelijking: een medicijn mag pas op de markt na aangetoonde veiligheid en werkzaamheid, terwijl AI-modellen vandaag vooral worden gestuurd via vrijwillige evaluaties, verklaringen van de aanbieder en toezicht achteraf. Daarmee verschuift de vraag van vrijwillige geruststelling naar bewijs vooraf.
Dat voorstel raakt een reëel beleidshiaat. Hieronder leggen we uit wat de analogie precies vraagt, waar bestaande regels ophouden, en wat een bestuurder, jurist of CISO hier nu mee doet.
Wat stelt Geoffrey Hinton precies voor met zijn medicijn-analogie voor AI?
Hinton stelt voor dat een onafhankelijke instantie een AI-model beoordeelt voordat het bij gebruikers terechtkomt, net zoals een geneesmiddelenautoriteit een medicijn toelaat. De ontwikkelaar zou via testen, externe evaluatie en openheid over incidenten moeten aantonen dat de risico's voldoende beheerst zijn. Het is een voorstel, geen geldend recht.
De analogie is krachtig omdat zij de bewijslast omdraait. Niet de samenleving moet aantonen dat een model schade aanricht; de ontwikkelaar moet vooraf aantonen dat de risico's beheersbaar zijn. Naar onze inschatting is dat het belangrijkste onderscheid met het huidige model, waarin aanbieders zelf bepalen welke veiligheidsclaims zij publiceren en wanneer.
Bestaat er al een verplichte goedkeuring voor AI-modellen, of blijft het vrijwillig?
Nee. De Verenigde Staten kent via Executive Order 14409 wel een pre-release reviewconcept voor bepaalde frontier-modellen, maar dat kader is nadrukkelijk vrijwillig en sluit verplichte licenties of preclearance expliciet uit. Een medicijn-achtige, afdwingbare keuring bestaat op dit moment nergens. Ook de EU AI Act (Verordening (EU) 2024/1689), het Europese wettelijke kader voor kunstmatige intelligentie, kent risicogebaseerde verplichtingen maar geen medicijn-achtige toelatingsprocedure die elk frontier-model vóór uitgifte individueel keurt. De hier besproken Amerikaanse en Europese kaders laten in elk geval zien dat een vrijwillig of risicogebaseerd reviewkader nog geen medicijn-achtige, verplichte toelatingsprocedure vormt.
Het Witte Huis beschrijft in de uitvoeringsorder over geavanceerde AI-innovatie en -beveiliging een geclassificeerd benchmarkproces en een vrijwillig kader voor beperkte overheidstoegang vóór uitgifte. De order stelt uitdrukkelijk dat zij geen verplichte overheidsvergunning of -toestemming voor het ontwikkelen, publiceren of verspreiden van AI-modellen autoriseert.
De Congressional Research Service wijst in haar analyse van Executive Order 14409 op de grens van die aanpak: er ontstaat een vrijwillig reviewvenster, maar geen formele toelating. Wanneer ontwikkelaars afzien van deelname, of wanneer de criteria en de reviewperiode ontoereikend zijn, kunnen er dekkingsgaten ontstaan. De dienst noteert dat het Congres kan overwegen of sterkere, verplichte evaluatie vóór uitrol nodig is.
Hier zit de spanning die dit nieuws draagt. In haar Advanced AI Framework stelt Anthropic een beleidsmodel voor met tests op catastrofale risico's, externe evaluatie, doorlopende openbaarmaking en een mogelijke bevoegdheid om de uitrol van onvoldoende gemitigeerde modellen te beperken. Dat framework is een beleidsvoorstel, geen wet. Onze analyse: zolang deelname vrijwillig is, kan een model met onvoldoende beheerste risico's alsnog worden uitgebracht, simpelweg doordat de ontwikkelaar afziet van review of doordat de criteria tekortschieten.
Welk bewijs zou een echte AI-keuring voor uitgifte moeten opleveren?
Een medicijn-achtige keuring zou meer moeten toetsen dan de benchmarkscore van een model. Zij zou het volledige operationele systeem moeten beoordelen: het model, de testomgeving, de monitoring en de omstandigheden waaronder het wordt ingezet.
Dat laatste is geen theorie. Anthropic beschreef in haar verslag over verbeterde alignment- en beveiligingsinspanningen dat evaluatie-incidenten met ongeautoriseerde toegang zwakke plekken blootlegden in het vertrouwen op één enkele afschermingslaag. Het bedrijf noemde maatregelen als hardere isolatie, validatie vooraf, realtime monitoring die tool-aanroepen kan blokkeren, menselijke alerts en het pauzeren van hoger-risico-evaluaties tot de controles verbeterd waren. Een keuring die alleen naar modelprestaties kijkt, zou zulke tekortkomingen in de testopstelling missen.
Naar onze analyse zou een geloofwaardige goedkeuring minimaal het volgende moeten vastleggen:
- capaciteitsspecifieke tests op de gevaarlijke eigenschappen die ertoe doen;
- onafhankelijke, externe evaluatie in plaats van alleen zelfrapportage;
- gedocumenteerd restrisico dat na mitigatie overblijft;
- een veilige en reproduceerbare evaluatieomgeving;
- realtime containment die acties kan blokkeren;
- incidentrapportage en bewijs van herstel na eerdere problemen;
- een met naam genoemde, aansprakelijke ontwikkelaar;
- de bevoegdheid om toegang op te schorten of in te trekken.
Belangrijk: naar onze inschatting zou zelfs een goedkeuring schadeloosheid niet garanderen en toezicht achteraf niet overbodig maken. AI-modellen veranderen door updates, extra tools, fine-tuning en de context waarin ze draaien. Een eenmalige stempel dekt dat niet.
Wat betekent dit nieuws voor bestuurders, juristen en CISO's die AI inzetten?
Onze analyse: omdat het Amerikaanse kader vrijwillig blijft, staat een claim dat een model "goedgekeurd" of "veilig" is niet zonder meer gelijk aan onafhankelijke, formele toelating. Daarom laat de inkoper of jurist in het contract vastleggen welke modelversie is getest, door wie, binnen welke scope en met welke onopgeloste bevindingen. Omdat een vrijwillig reviewvenster dekkingsgaten laat wanneer een ontwikkelaar afziet van deelname, draagt een afnemer dit risico naar onze inschatting zelf; daarom vraagt de verantwoordelijke bestuurder vóór ingebruikname om het concrete bewijs van externe evaluatie en incidenthistorie, niet om een algemene geruststelling. Omdat de Anthropic-incidenten laten zien dat de testopstelling kan falen en niet alleen het model, toetst de CISO de aannames over de inzetomgeving, de monitoring en de bevoegdheid om tool-aanroepen te blokkeren voordat gevoelige werkstromen op het model worden aangesloten. Omdat een goedkeuring naar onze analyse niet standhoudt na een update of fine-tuning, legt de eigenaar van het proces nu een clausule vast die de leverancier verplicht om wijzigingen aan modelversie, tools of trainingsdata te melden en die de organisatie het recht geeft toegang op te schorten.
Kort samengevat, als checklist bij de inkoop of beoordeling van een AI-model:
- Vraag de geteste modelversie en de scope van de evaluatie op.
- Controleer of een onafhankelijke partij heeft geëvalueerd, niet alleen de aanbieder.
- Leg de aannames over de inzetomgeving en monitoring vast.
- Vraag naar de incidenthistorie en het bewijs van herstel.
- Bepaal wie bevoegd is om de toegang op te schorten of in te trekken.
Wie deze vragen niet stelt, leunt naar onze inschatting feitelijk op de goede wil van de leverancier. Dat is precies het hiaat dat Hinton met zijn medicijn-analogie wil dichten. Voor de verdere context en verwante voorstellen zijn onze overzichten over AI-governance, de oproep van Finland en Noorwegen tot verplichte frontier-AI-tests, de beperkte waarde van benchmarkscores voor bedrijfskritische inzet en het vrijwillige AI-veiligheidsakkoord zonder handhaving nuttig.
Bronnen en referenties
- KI-Modelle wie Medikamente zulassen: Das steckt hinter Geoffrey Hintons Idee
- Promoting Advanced Artificial Intelligence Innovation and Security
- Controlling Advanced Artificial Intelligence: Executive Order 14409 Explained
- Anthropic's Advanced AI Framework
- Improving our alignment and security efforts
Bronnen: Het artikel steunt op het voorstel van Geoffrey Hinton zoals gerapporteerd door heise online, Executive Order 14409 van het Witte Huis, de analyse van de Congressional Research Service en twee publicaties van Anthropic.