NieuwsMacroBeloftes over AI-vertraging dreigen te bezwijken onder commerciële druk en spanningen tussen de VS en China, waarschuwen experts van Atlantic Council

Beloftes over AI-vertraging dreigen te bezwijken onder commerciële druk en spanningen tussen de VS en China, waarschuwen experts van Atlantic Council

Auteur: Decrypt·

Belangrijkste punten

  • Analisten van de Atlantic Council betogen dat vrijwillige toezeggingen tot AI-vertraging geen vervanging zijn voor onafhankelijk toezicht, meetbare veiligheidsdrempels en gevolgen wanneer die drempels worden overschreden.
  • OpenAI heeft Amerikaanse wetgevers gevraagd of rivaliserende ontwikkelaars wettelijk een vertraging kunnen coördineren zonder antitrustwetten te schenden, wat een dilemma blootlegt tussen concurrentierisico en antitrustaansprakelijkheid.
  • China staat sceptisch tegenover Amerikaanse veiligheidsinitiatieven en waarschuwt dat ze inspanningen voor 'technologische hegemonie' kunnen verhullen; een groteaterale AI-veiligheidsovereenkomst wordt onwaarschijnlijk geacht, al blijft smallere samenwerking mogelijk.
  • Recente veiligheidsincidenten — waaronder ongeveer 700 agenten die deelnamen aan de inbraak op Hugging Face en de melding door Anthropic van een vierde hackingincident met Claude — benadrukken de tekortkomingen in hoe snel incidenten worden vastgesteld en gemeld zonder sectorbrede meldingsplicht.
  • Fellow Trisha Ray stelt dat elke geloofwaardige toezegging tot vertraging grenzen aan capaciteiten moet koppelen aan gekwantificeerde financiering voor veiligheidsonderzoek en verplichte deadlines voor incidentrapportage.
Beloftes over AI-vertraging dreigen te bezwijken onder commerciële druk en spanningen tussen de VS en China, waarschuwen experts van Atlantic Council

De beloftes van AI-bedrijven om de ontwikkeling te vertragen kunnen bezwijken onder commerciële druk en de rivaliteit tussen de VS en China zonder afdwingbare veiligheidsnormen, betogen experts van de Atlantic Council in een analyse die zondag werd gepubliceerd.

De analyse onderzoekt wie een vertraging zou afdwingen en of overheden de expertise bezitten om te bepalen wanneer steeds krachtigere systemen onveilig zijn geworden. Beide keren terug in alle voorstellen die de experts afwegen.

"Vrijwillige toezeggingen kunnen nuttige signalen zijn, maar ze zijn geen vervanging voor onafhankelijk toezicht, meetbare drempels en gevolgen wanneer die drempels worden overschreden," schreef Konstantinos Komaitis, resident senior fellow bij de Democracy + Tech Initiative van de raad.

Het commerciële dilemma is al zichtbaar. OpenAI vroeg wetgevers onlangs of rivaliserende AI-ontwikkelaars wettelijk kunde afspreken om de ontwikkeling te vertragen zonder antitrustwetten te schenden, na waarschuwingen van chief scientist Jakub Pachocki dat de waarborgen onvoldoende zijn om full-speed ontwikkeling nog veel langer verantwoord vol te houden. AI-bedrijven lopen daarom concurrentierisico's als ze alleen vertragen, en antitrustbezwaren als ze samenwerken.

Samenwerking tussen overheden kampt met evenredig wantrouwen. Kenton Thibaut, de senior resident China fellow van de raad, schreef dat Beijing vreest dat Washington veiligheidsregels zou kunnen inzetten om zijn technologische voorsprong te behouden.

"China staat sceptisch tegenover de motivaties van de VS en waarschuwt dat veiligheidsdiscussies Amerikaanse inspanningen om zijn 'technologische hegemonie' te bevorderen kunnen verhullen," schreef ze. "Officiële bronnen benadrukken dat Washington de drempels voor grensrisico's niet eenzijdig kan vaststellen en moet aantonen dat de regels gelden voor — en afdwingbaar zijn op — Amerikaanse bedrijven."

Thibaut ziet weinig perspectief op een grote AI-veiligheidsovereenkomst, maar stelt dat smallere, zinvolle samenwerking mogelijk blijft. China heeft volgens Reuters ook besproken om de toegang van buitenlandse partijen tot geavanceerde binnenlandse modellen te beperken, wat onderstreept hoe toegang tot AI een nationale beleidskwestie is geworden.

De analyse weegt ook Anthropics voorgestelde embedded evaluators — externe specialisten die binnen het bedrijf werken om de veiligheidspraktijken te beoordelen. Emerson Brooking, nonresident senior fellow bij de Digital Forensic Research Lab van de raad, verwelkomde de toezegging, maar waarschuwde dat evaluators te sterk kunnen gaan meebewegen met de belangen van het bedrijf.

Recente incidenten illustreren wat er op het spel staat. In juli drongen OpenAI-agenten binnen in de open-source AI-repository Hugging Face. Afzonderlijke tests door het Britse AI Security Institute toonden aan dat Anthropic- en OpenAI-modellen ongeautoriseerde acties online uitvoerden, waaronder een poging om malware te planten in een echte software-repository; bij die tests was internettoegang ingeschakeld en waren cyberbeveiligingen uitgeschakeld.

Een onafhankelijk onderzoek dat in augustus werd gepubliceerd, stelde vast dat ongeveer 700 agenten deelnamen aan de aanval op Hugging Face. METR-ceo Beth Barnes wees erop dat de toegang van onderzoekers vrijwillig was en dat openbaarmaking sectorbreed niet verplicht was.

Vorige week woensdag meldde Anthropic een vierde hackingincident met Claude, dat zich in januari voordeed en in augustus werd ontdekt. Het bedrijfaf ook toe dat foutief modelgedrag had bijgedragen aan eerdere aanvallen, naast testfouten. De tussenpozen tussen de incidenten en hun openbaarmaking roepen vragen op over hoe snel veiligheidsfalen kan worden geïdentificeerd en aangepakt — en zonder sectorbrede meldingsplicht ligt de timing van dergelijke openbaarmakingen momenteel bij de bedrijven zelf.

Trisha Ray, associate director en resident fellow bij het GeoTech Center van de raad, betoogde dat het vertragen van de ontwikkeling ook meer financiering voor veiligheidsonderzoek en verplichte deadlines voor incidentrapportage vereist.

"Het temponeren van capaciteiten is daarom een onvolledig antwoord op de uitdaging van pariteit in alignment-onderzoek," schreef ze. "Elke geloofwaardige toezegging tot vertraging behoeft een evenarende, gekwantificeerde toezegging aan de kant van het veiligheidsonderzoek."

Wie dat toezicht zou leveren, en of overheden de expertise hebben om grensrisico's te beoordelen, blijft de open vraag die de analyse onopgelost laat.

Dit artikel is gebaseerd op berichtgeving die voor het eerst werd gepubliceerd door Decrypt.