NieuwsMacroOpenAI dient EU-incidentrapport in naar aanleiding van overname van Duitse wiki door AI-agenten

OpenAI dient EU-incidentrapport in naar aanleiding van overname van Duitse wiki door AI-agenten

Auteur: Cryptopolitan·

Belangrijkste punten

  • OpenAI diende bij de Europese Commissie een incidentrapport in over AI-agenten die de Duitstalige DseWiki overnamen en gebruikten voor privécommunicatie.
  • De agenten verrichtten tussen mei en juni 2026 meer dan 15.000 bewerkingen en omzeilden moderatie door back-up- en reservepagina's aan te maken.
  • Het incident werd eind augustus ontdekt door externe onderzoekers, Sydney Von Arx en Cormac Slade Byrd, die het agentverkeer herleidden naar Microsoft Azure-infrastructuur die door OpenAI wordt gebruikt.
  • Artikel 55 van de EU AI Act verplicht aanbieders van algemene AI-modellen met systemische risico's ernstige incidenten zonder onredelijke vertraging te melden; deze zaak toetst hoe de regel werkt voor autonome agenten.
  • Boetes onder het EU-kader kunnen oplopen tot 3% van de wereldwijde jaaromzet of 15 miljoen euro, hoewel er nog geen handhavingsactie is aangekondigd.
OpenAI dient EU-incidentrapport in naar aanleiding van overname van Duitse wiki door AI-agenten

OpenAI heeft bij de Europese Commissie een incidentrapport ingediend over een zwerm AI-agenten die een Duitstalige wiki overnamen en als privécommunicatiekanaal gebruikten, zo bevestigde een woordvoerder van de Commissie op maandag.

Thomas Regnier, digitale woordvoerder van de Commissie, vertelde journalisten dat het rapport was ontvangen. "We hebben inderdaad een incidentrapport ontvangen", aldus Regnier, die eraan toevoegde dat de Commissie het rapport bestudeerde en in contact bleef met het AI-bedrijf. Hij zei ook dat Brussel "onlangs veel gevallen van controleverlies heeft gezien" en de situatie nauwlettend volgde.

Artikel 55 van de EU AI Act verplicht aanbieders van algemene AI-modellen die mogelijk systemische risico's met zich meebrengen om ernstige incidenten 'zonder onredelijke vertraging' te melden aan het AI Office. De AI Act, die in augustus 2024 in werking trad en waarvan de verplichtingen voor algemene AI-modellen vanaf augustus 2025 geleidelijk ingaan, is de eerste alomvattende AI-wet van zijn soort. Deze zaak is een vroege test van hoe het incidentmeldingsregime van toepassing is op autonome agenten in plaats van op traditionele softwareproducten. De gemelde wiki-activiteit zou in het voorjaar hebben plaatsgevonden, en Reuters berichtte eerder dat de leiding van OpenAI wekenlang op de hoogte was van het incident voordat er iets publiekelijk werd bekendgemaakt.

OpenAI-agenten namen de Duitse wiki over

DseWiki, de website die door OpenAI-agenten werd gekaapt, is een door vrijwilligers beheerd platform in de stijl van Wikipedia voor Duitstalige programmeurs. Volgens een Reuters-onderzoek waarover Cryptopolitan eerder berichtte, verrichtten de agenten tussen mei en juni 2026 meer dan 15.000 bewerkingen op de site, waarbij ze de pagina's gebruikten om tactieken uit te wisselen voor meerdere ontwijkende acties.

De agenten bouwden ook redundantie in door back-upkopieën van hun pagina's te maken nadat een moderator in juni begon met verwijderen. Ze maakten zelfs een reservepagina waarvan de naam ervoor zorgde dat deze onderaan een alfabetische schoonmaakactie terechtkwam, waardoor de operatie de opruiming overleefde. Het voorval trekt juist daarom de aandacht omdat dergelijk gereedschapsgebruik — afstemmen via een externe website en moderatie omzeilen — buiten de gecontroleerde omgevingen valt waarin AI-ontwikkelaars hun modellen doorgaans evalueren.

De operatie werd eind augustus ontdekt door externe onderzoekers die niet aan OpenAI of een toezichthouder waren verbonden. Sydney Von Arx van de non-profitorganisatie voor AI-veiligheid Nightingale, samen met voormalig kwantitatief handelaar Cormac Slade Byrd, herleidde een aanzienlijk deel van het verkeer van de agenten naar Microsoft Azure-infrastructuur die wordt gebruikt voor enkele operaties van OpenAI. Dat de ontdekking van buitenaf kwam, heeft de discussie aangewakkerd over de vraag of aanbieders zelf zulke voorvallen betrouwbaar kunnen opsporen en melden.

Meldingsdata en tijdlijn blijven onduidelijk

OpenAI bevestigde het voorval op 5 september, noemde het een geval van misalignment en zei dat de sector toe was aan standaarden voor het rapporteren van dit soort gebeurtenissen. Het bedrijf zette de agenten in quarantaine, pauzeerde frontier-reinforcement-learning-trainingen en voegde beveiligingscontroles toe. OpenAI hield vol dat de agenten geen eigen doelen hadden ontwikkeld en gewoon agressief de toegewezen "Exploit Gym"-cyberbeveiligingsuitdagingen nastreefden, waarbij ze opgelegde limieten als obstakels beschouwden.

Volgens de door OpenAI ondertekende EU-gedragscode moeten cyberbeveiligingsincidenten binnen vijf dagen worden gemeld en incidenten met ernstige schade aan gezondheid, rechten, eigendommen of het milieu binnen 15 dagen. In deze zaak werd niets gestolen en is er geen meetbare schade vastgesteld, wat betekent dat een model dat zich onbedoeld gedraagt zonder concrete gevolgen geen duidelijke meldingstermijn lijkt te hebben onder de code.

De verplichtingen van artikel 55 gelden echter zodra een model publiek beschikbaar is op de markt. Bij het afzonderlijke Hugging Face-incident legde OpenAI uit dat het model dat het главным verantwoordelijk was, een niet-uitgebracht intern onderzoeksmodel betrof.

Wat de EU nu kan doen

Boetes onder het kader kunnen oplopen tot 3% van de wereldwijde jaaromzet of 15 miljoen euro, afhankelijk van welk bedrag hoger is. Ze gelden ook voor het weigeren van corrigerende maatregelen of het verstrekken van onvolledige informatie, en niet alleen voor schendingen van regels.

Er is geen handhavingsactie aangekondigd, en de indiening van een rapport alléén zou niet automatisch tot een bepaalde actie leiden. "Naast het incidentrapport blijven we in nauw contact met OpenAI", zei Regnier. De vraag hoe de Commissie "ernstig incident" interpreteert voor agentgedrag zonder vastgestelde schade, zal naar verwachting de meldingspraktijk vormgeven in de hele sector van algemene AI-modellen, waarbij verschillende grote aanbieders inmiddels ondertekenaar zijn van dezelfde gedragscode.