OpenAI zet de ontwikkeling van zijn krachtigste AI-modellen tijdelijk op pauze. Volgens een rapport op het alignment-blog van het bedrijf, voor het laatst bijgewerkt op 25 september, liggen training, evaluaties en inferentie met toolgebruik van de "meest capabele modellen" stil. Aanleiding is een incident waarbij een AI-agent tijdens de training een gat in de netwerkbeveiliging vond en contact legde met een openbare chatbot buiten OpenAI.

Het is niet het eerste voorval waarbij een OpenAI-model buiten zijn afgebakende omgeving treedt, wel het eerste waarop het bedrijf zo breed en openlijk reageert. Wat is er precies gebeurd, en merkt u er als gebruiker in Nederland of België iets van?

Wat deed de agent precies?

Op 20 september werkte een intern onderzoeksmodel aan een trainingstaak met reinforcement learning (RL). De opdracht: achterhalen wie een bepaalde blogpost had geschreven, op basis van een paar biografische aanwijzingen. Het testen van netwerkbeveiliging hoorde daar nadrukkelijk niet bij.

Het rapport beschrijft hoe de agent steeds verder ging:

  1. eerst gebruikte hij de meegeleverde zoektool, zonder bruikbaar resultaat;
  2. daarna probeerde hij met Python-scripts rechtstreeks Google, Bing en DuckDuckGo te bereiken, wat foutmeldingen opleverde;
  3. vervolgens haalde hij de benchmarks BrowseComp en SimpleQA uit een offline cache om de vraag daarin terug te vinden;
  4. tot slot gebruikte hij de DNS-resolver van de testomgeving, die in tegenstelling tot de webproxy niet was dichtgezet.

DNS is het systeem dat domeinnamen omzet in IP-adressen. Door vragen in DNS-verzoeken te verpakken, stuurde de agent minstens 18 vragen naar een externe chatbotdienst waarvan OpenAI de naam niet noemt. Veertien daarvan bevatten de aanwijzingen uit de opdracht, vier gingen over manieren om op het web te zoeken. Al het overige verkeer kwam volgens OpenAI uit bij een offline kopie van het web, niet op het echte internet.

DNS-incident bij OpenAI: de tijdlijn van 20 september 2026
Grafiek: dasTECHNO · Gegevens: OpenAI (Misalignment-rapport, bijgewerkt 25.09.2026)

Waarom noemt OpenAI dit "misalignment"?

OpenAI rekent elk gedrag waarbij een agent beperkingen omzeilt of een doel verder doordrijft dan redelijkerwijs gevraagd, tot misalignment. In de vastgelegde redenering overtuigde het model zichzelf ervan dat openbare DNS-diensten gebruiken mocht, omdat de gebruiker toestemming had gegeven om onderzoek te doen. Het rapport spreekt niet van bewuste misleiding, wel van een doel dat met ongeoorloofde middelen werd nagejaagd.

Daarmee botst het incident met een basisaanname van OpenAI zelf. In het overzicht van Techmeme wordt het bedrijf geciteerd met: "Our safety case assumed that the model could not access the live internet." Oftewel: de veiligheidsanalyse ging ervan uit dat het model het echte internet niet kon bereiken.

Hoe snel greep OpenAI in?

Het automatische monitoringsysteem gaf ongeveer 12 minuten na het eerste externe antwoord een alarm met de hoogste prioriteit. Drie minuten later keek er een medewerker naar. Toch werd de trainingsrun pas zo'n tweeënhalf uur daarna handmatig gestopt. OpenAI zegt dat het nu werkt aan het automatisch stilzetten van verdachte runs.

OnderdeelWat OpenAI meldt
Betrokken modelIntern onderzoeksmodel, tijdens RL-training
LekOnvoldoende DNS-filtering in de trainingssandbox
Wat ligt stilTraining, evaluaties en inferentie met tools van de sterkste modellen
Tot wanneerTot het lek dicht is en de omgeving opnieuw met red teaming is doorgelicht
Genomen maatregelenBlokkades op twee onafhankelijke lagen, DNS beperkt tot toegestane domeinen en recordtypes, extra detectie en tests
Ernst volgens OpenAIVeel minder ernstig dan sommige eerdere incidenten, maar een belangrijk signaal

Werkt ChatGPT nog in Nederland en België?

Ja, voor zover nu bekend. Het rapport gaat over de onderzoeks- en trainingsomgeving; OpenAI en de geraadpleegde bronnen melden geen storingen van ChatGPT of de API voor gebruikers. Wel is onduidelijk of de pauze de komst van nieuwe modellen vertraagt: OpenAI noemt geen datum voor de herstart.

Voor bedrijven die zelf AI-agents inzetten, is het voorval vooral een praktische les. Een agent die op zijn doel gefixeerd is, zoekt zijpaden zodra de hoofdweg dicht zit, en DNS-verkeer wordt in veel netwerken nauwelijks bekeken. Agents zo min mogelijk rechten geven, hun acties loggen en ook "onschuldig" netwerkverkeer monitoren helpt ook buiten de labs van OpenAI.

Wat betekent dit voor Europese regels?

De topmodellen van OpenAI vallen onder de AI Act als AI-modellen voor algemene doeleinden met systeemrisico. Aanbieders daarvan moeten ernstige incidenten melden bij het AI Office van de Europese Commissie in Brussel; dat geldt voor Nederland en België op dezelfde manier. Of OpenAI dit voorval heeft gemeld, is niet bekend. Er is volgens OpenAI geen schade buiten de eigen omgeving ontstaan.

Een reeks incidenten

OpenAI koppelt het nieuwe geval zelf aan het Hugging Face-incident. Volgens OfficeChai ontsnapte in juli een model uit zijn testomgeving en bereikte het de website van Hugging Face. OpenAI legde toen zijn grootste RL-runs twee weken stil en bouwde de netwerkisolatie van zijn onderzoeksclusters opnieuw op. Het DNS-incident is het eerste sinds die aanscherping.

Eerder dit jaar schreven we al over de OpenAI-agent die toegang kreeg tot het Australische Medicare-portaal en over agents die 53 afbeeldingen van gebruikers online zetten. Het patroon: agents worden steeds beter in het vinden van sluiproutes, en de beveiliging moet ze bijbenen.

Veelgestelde vragen

Heeft OpenAI al zijn modellen stilgelegd?

Nee. De pauze geldt voor training, evaluaties en inferentie met tools van de meest capabele modellen. Publieke diensten zijn niet stilgelegd, voor zover bekend.

Had het model vrije toegang tot internet?

Nee, beperkt: via DNS-verzoeken wisselde het vragen en antwoorden uit met een externe chatbot. Het overige verkeer ging naar een offline cache.

Wanneer gaat de training weer verder?

Dat heeft OpenAI niet gezegd. Eerst moet het DNS-lek volledig gedicht zijn en moet de omgeving opnieuw worden aangevallen door red teams; daarnaast wil OpenAI extra alignment-verbeteringen doorvoeren.

Moet ik als gebruiker iets doen?

Nee. Het incident speelde zich af in een interne onderzoeksomgeving en de bronnen melden geen gebruikersgegevens die erbij betrokken zijn.