ActualitésMacroLes chiens de garde de la sécurité de l'IA face aux soupçons de conflits d'intérêts alors que le personnel circule entre évaluateurs et laboratoires

Les chiens de garde de la sécurité de l'IA face aux soupçons de conflits d'intérêts alors que le personnel circule entre évaluateurs et laboratoires

Auteur: CryptoBriefing·

Points clés

  • •Le personnel de METR, évaluateur de premier plan, comprend d'anciens employés d'OpenAI et d'Anthropic, et certains évaluateurs entretiennent des liens personnels ou familiaux avec le personnel des laboratoires qu'ils évaluent.
  • •Le financement de chiens de garde tels que METR et Redwood Research passe en partie par des réseaux de l'Effective Altruism soutenus par des fondations liées à Dustin Moskovitz, qui détient des parts d'Anthropic.
  • •L'analyse de Kevin Bass publiée en septembre 2026 sur ces connexions a recueilli près de 5 millions de vues et appelé explicitement à une enquête du Congrès sur les conflits d'intérêts structurels.
  • •METR a déclaré ne recevoir aucun argent des laboratoires d'IA ou de leurs employés et avoir refusé certaines sources de financement afin de préserver son indépendance.
  • •Plus de 100 experts, dont le lauréat du prix Turing Geoffrey Hinton, ont signé une lettre le 18 septembre 2026 exigeant l'autonomie éditoriale des évaluateurs, une transparence totale et une protection contre les représailles.
Les chiens de garde de la sécurité de l'IA face aux soupçons de conflits d'intérêts alors que le personnel circule entre évaluateurs et laboratoires

L'examen croissant de la porte tournante entre les organismes d'évaluation de la sécurité de l'intelligence artificielle et les entreprises qu'ils sont censés superviser a placé les préoccupations de conflits d'intérêts au premier plan. Les personnes qui évaluent la sécurité de l'IA peuvent, dans certains cas, entretenir des liens professionnels ou financiers avec les laboratoires mêmes qu'elles évaluent. Ces évaluations devant déterminer si les modèles de pointe sont suffisamment sûrs pour être déployés, les questions d'indépendance des évaluateurs s'étendent désormais à l'ensemble du secteur.

Les propositions de Dario Amodei, PDG d'Anthropic, et de Sam Altman, PDG d'OpenAI, visant à intégrer directement des évaluateurs tiers au sein de leurs laboratoires ont intensifié le débat, transformant une préoccupation sourde en un enjeu public majeur. Ce dispositif placerait les organismes de contrôle à l'intérieur même des environnements qu'ils sont censés inspecter, aiguïsant les questions sur la préservation de leur indépendance.

La toile de connexions

Au cœur de la controverse se trouve METR, ou Model Evaluation and Threat Research, l'une des organisations les plus en vue chargées d'évaluer si les modèles d'IA de pointe sont suffisamment sûrs pour être déployés. Le personnel de METR comprend des personnes ayant auparavant travaillé chez OpenAI et Anthropic, et les recoupements ne s'arrêtent pas aux CV.

Le volet du financement est particulièrement embrouillé. Dustin Moskovitz, cofondateur de Facebook, détient des parts d'Anthropic. Ses fondations philanthropiques canalisent des fonds via les réseaux de l'Effective Altruism qui ont apporté un financement substantiel à des organisations d'évaluation telles que METR et Redwood Research. Il en résulte un écosystème dans lequel l'argent qui afflue vers les chiens de garde de la sécurité peut être retracé, parfois en seulement un ou deux détours, jusqu'aux entreprises évaluées.

Plusieurs évaluateurs entretiennent également des liens personnels ou familiaux avec des employés des laboratoires qu'ils évaluent.

Le chercheur Kevin Bass a publié une analyse les 14 et 15 septembre 2026, cartographiant ces liens en détail. Le fil a attiré près de 5 millions de vues et comportait un appel explicite à une enqu du Congrès sur ce que Bass a qualifié de conflits d'intérêts structurels.

Le secteur réplique

METR a répondu directement aux allégations, déclarant n'accepter aucune rémunération ni aucun don de la part des laboratoires d'IA ou de leur personnel. L'organisation a indiqué avoir activement refusé certaines sources de financement afin de préserver son indépendance et a souligné son engagement à divulguer les conflits d'intérêts potentiels.

Les défenseurs du dispositif actuel font remarquer que l'évaluation des modèles d'IA de pointe exige un savoir-faire technique extrêmement spécialisé. Le vivier de talents est intrinsèquement restreint, et les personnes disposant des compétences appropriées ont presque certainement travaillé pour des laboratoires d'IA ou reçu leurs fonds à un moment donné. Cette rareté explique pourquoi les recoupements de personnel et de financement persistent, même parmi les organisations engagées en faveur de l'indépendance : c'est la même petite communauté qui construit les systèmes de pointe, constitue les équipes des évaluateurs et se situe en amont de l'argent philanthropique qui les finance.

La lettre d'experts et la suite

Le 18 septembre 2026, plus de 100 experts de l'IA ont signé une lettre ouverte exigeant des réformes structurelles. Parmi les signataires figurait Geoffrey Hinton, lauréat du prix Turing devenu l'un des critiques les plus virulents de l'autorégulation de l'industrie de l'IA.

La lettre demandait que les évaluateurs disposent d'une pleine autonomie éditoriale sur leurs conclusions, d'une transparence totale sur leurs méthodologies et leurs résultats, ainsi que d'une protection explicite contre les représailles des entreprises qu'ils examinent.

Aucune modification réglementaire significative n'a été adoptée à ce jour, mais la pression politique continue de monter. Les questions à surveiller incluent la possibilité que le Congrès donne suite à l'appel à l'enquête soulevé dans l'analyse de Bass, que les laboratoires ou les évaluateurs adoptent les demandes spécifiques de la lettre, et que les propositions d'évaluateurs intégrés d'Amodei et d'Altman prennent forme sous une quelconque modalité.