KI-Sicherheitswächter unter Interessenkonflikt-Verdacht, da Personal zwischen Gutachtern und Laboren wechselt
Wichtige Erkenntnisse
- •Zu den Mitarbeitenden des bekannten Gutachters METR gehören ehemalige OpenAI- und Anthropic-Beschäftigte; einige Gutachter haben persönliche oder familiäre Verbindungen zu Personal der Labore, die sie bewerten.
- •Finanzierungen für Wächter wie METR und Redwood Research fließen teilweise über Effective-Altruism-Netzwerke, die von Stiftungen mit Verbindungen zu Dustin Moskovitz gestützt werden, der Anteile an Anthropic hält.
- •Kevin Bass' Analyse dieser Verbindungen aus September 2026 erreichte nahezu 5 Millionen Aufrufe und forderte ausdrücklich eine Kongressuntersuchung struktureller Interessenkonflikte.
- •METR erklärte, kein Geld von KI-Laboren oder deren Beschäftigten zu erhalten, und hat zur Wahrung seiner Unabhängigkeit bestimmte Finanzierungsquellen abgelehnt.
- •Mehr als 100 Experten, darunter Turing-Award-Gewinner Geoffrey Hinton, unterzeichneten am 18. September 2026 einen Brief mit Forderungen nach redaktioneller Autonomie der Gutachter, voller Transparenz und Schutz vor Repressalien.

Die wachsende Kontrolle der Personaldrehtür zwischen Organisationen zur Bewertung der KI-Sicherheit und den Unternehmen, die sie überwachen sollen, hat Interessenkonflikt-Bedenken ins Zentrum gerückt. Die Personen, die die KI-Sicherheit bewerten, haben in manchen Fällen berufliche oder finanzielle Verbindungen zu genau den Laboren, die sie prüfen. Da diese Bewertungen darüber entscheiden sollen, ob Frontier-Modelle sicher genug für den Einsatz sind, erstrecken sich Fragen zur Unabhängigkeit der Gutachter nun auf die gesamte Branche.
Vorschläge von Anthropic-Chef Dario Amodei und OpenAI-Chef Sam Altman, externe Gutachter direkt in ihre Laboratorien einzubetten, haben die Debatte verschärft und ein schwelendes Anliegen zu einem prominenten öffentlichen Thema gemacht. Eine solche Struktur würde die Wächter genau in die Umgebungen versetzen, die sie kontrollieren sollen, und verschärft die Frage, wie die Unabhängigkeit gewahrt bleiben würde.
Das Netz der Verbindungen
Im Mittelpunkt der Kontroverse steht METR, kurz für Model Evaluation and Threat Research, eine der bekanntesten Organisationen, die bewerten soll, ob Frontier-KI-Modelle sicher genug für den Einsatz sind. Zu METRs Personal gehören Menschen, die zuvor bei OpenAI und Anthropic gearbeitet haben, und die Überschneidung beschränkt sich nicht auf Lebensläufe.
Das Finanzierungsgeflecht ist besonders verworren. Der Facebook-Mitgründer Dustin Moskovitz hält Anteile an Anthropic. Seine philanthropischen Stiftungen leiten Gelder über Effective-Altruism-Netzwerke, die Bewertungsorganisationen wie METR und Redwood Research erhebliche Mittel bereitgestellt haben. Das Ergebnis ist ein Ökosystem, in dem sich Geldströme zu den Sicherheitswächtern bis zu den bewerteten Unternehmen zurückverfolgen lassen – mitunter über nur ein bis zwei Zwischenschritte.
Mehrere Gutachter haben zudem persönliche oder familiäre Verbindungen zu Mitarbeitenden der Labore, die sie bewerten.
Der Forscher Kevin Bass veröffentlichte am 14.–15. September 2026 eine Analyse, die diese Verbindungen im Detail kartierte. Der Thread erreichte nahezu 5 Millionen Aufrufe und enthielt einen ausdrücklichen Appell für eine Untersuchung durch den Kongress zu dem, was Bass als strukturelle Interessenkonflikte bezeichnete.
Dieanche wehrt sich
METR hat sich direkt zu den Vorwürfen geäußert und erklärt, keine Vergütungen oder Spenden von KI-Laboren oder deren Mitarbeitenden anzunehmen. Die Organisation erklärte, sie habe bestimmte Finanzierungsquellen aktiv abgelehnt, um ihre Unabhängigkeit zu wahren, und betonte ihr Bekenntnis zur Offenlegung möglicher Interessenkonflikte.
Verteidiger der derzeitigen Regelung weisen darauf hin, dass die Bewertung von Frontier-KI-Modellen hochspezialisiertes technisches Wissen erfordert. Der Talentpool ist naturgemäß klein, und Personen mit den passenden Fähigkeiten haben fast sicher irgendwann in KI-Laboren gearbeitet oder sind von diesen finanziert worden. Diese Knappheit erklärt, warum sich Personal- und Finanzüberschneidungen auch bei Organisationen halten, die sich der Unabhängigkeit verpflichtet haben: Dieselbe kleine Gemeinschaft baut Frontier-Systeme, stellt die Gutachter und steht am Ursprung des philanthropischen Geldes, das diese finanziert.
Der Expertenbrief und was nun kommt
Am 18. September 2026 unterzeichneten mehr als 100 KI-Experten einen offenen Brief, der strukturelle Reformen fordert. Zu den Unterzeichnern gehörte Geoffrey Hinton, Träger des Turing Award, der zu einer der lautesten Stimmen der Kritik an der Selbstkontrolle der KI-Branche geworden ist.
Der Brief forderte, dass Gutachter volle redaktionelle Autonomie über ihre Ergebnisse haben, dass Methoden und Ergebnisse vollständig transparent sind und dass ausdrücklicher Schutz vor Repressalien durch die von ihnen bewerteten Unternehmen besteht.
Bislang wurden keine nennenswerten regulatorischen Änderungen beschlossen, doch der politische Druck baut sich weiter auf. Zu beobachten ist, ob der Kongress auf den in Bass' Analyse erhobenen Untersuchungsaufruf reagiert, ob Labore oder Gutachter die konkreten Forderungen des Briefes übernehmen und ob die Vorschläge von Amodei und Altman zur Einbettung von Gutachtern in irgendeiner Form Gestalt annehmen.