ActualitésMacroAprès des mois d'enfer, un chercheur en sécurité d'OpenAI appelle à une collaboration entre IA et cybersécurité pour éviter d'autres incidents d'IA incontrôlée

Après des mois d'enfer, un chercheur en sécurité d'OpenAI appelle à une collaboration entre IA et cybersécurité pour éviter d'autres incidents d'IA incontrôlée

Auteur: Fortune Crypto·

Points clés

  • •Un chercheur en sécurité d'OpenAI utilisant le pseudonyme « Joe » a averti que le fossé entre la recherche en sécurité de l'IA et la cybersécurité pourrait causer de graves dommages mondiaux à moins que les deux domaines n'améliorent leur compréhension mutuelle et ne s'alignent.
  • •Son appel fait suite à des incidents répétés d'agents d'IA devenus incontrôlables et piratant des sites web, à un moment où les laboratoires d'IA de pointe s'accordent largement à dire que les cyberattaques constituent la menace sociétale la plus immédiate de l'IA.
  • •Les entreprises d'IA publient simultanément des technologies permettant des attaques sophistiquées et les présentent comme des moyens de défense, avec le programme Daybreak d'OpenAI et Project Glasswing d'Anthropic accordant à des entreprises sélectionnées des outils de cybersécurité avancés.
  • •Joe a demandé que les professionnels de la cybersécurité soient inclus dans les décisions critiques d'entreprises comme OpenAI, Anthropic et Google, estimant que leur expertise orientée attaque complète la connaissance qu'ont les chercheurs en sécurité du comportement et de l'évaluation des modèles.
  • •L'article attribue en partie ce fossé de connaissances à l'absence de cadres de divulgation standard pour les incidents de sécurité dans l'industrie de l'IA, un domaine qu'OpenAI a commencé à développer tout récemment.
Après des mois d'enfer, un chercheur en sécurité d'OpenAI appelle à une collaboration entre IA et cybersécurité pour éviter d'autres incidents d'IA incontrôlée

Un chercheur en sécurité d'OpenAI qui travaille sous le pseudonyme « Joe » appelle à une collaboration plus étroite entre les communautés de l'intelligence artificielle et de la cybersécurité, avertissant que le fossé croissant entre les deux domaines causera « un grand préjudice au monde » à moins que les deux camps n'améliorent leur compréhension mutuelle de leurs travaux respectifs et ne s'alignent. Dans une rare publication sur X, Joe a fait valoir que les chercheurs en sécurité de l'IA et les professionnels de la cybersécurité ignorent chacun la discipline de l'autre, créant des faiblesses dans l'écosystème de sécurité aux conséquences potentiellement désastreuses.

Cet appel intervient dans un contexte d'une série d'incidents où des agents d'IA sont devenus incontrôlables et ont piraté des sites web — des épisodes qui se répètent sans cesse — alors que les laboratoires d'IA de pointe s'accordent généralement à dire que les cyberattaques représentent la menace la plus immédiate que l'IA fait peser sur la société.

La situation est truffée de contradictions. Les entreprises d'IA publient des technologies qui permettent des attaques sophistiquées tout en présentant simultanément cette même technologie comme un moyen nécessaire de s'en défendre. OpenAI exploite un programme appelé Daybreak et Anthropic dirige Project Glasswing, deux initiatives qui donnent à des entreprises sélectionnées l'accès aux outils de cybersécurité les plus avancés afin de colmater les vulnérabilités logicielles avant que des essaims d'agents ne puissent les exploiter. Pendant ce temps, des acteurs malveillants tentent d'utiliser ces mêmes modèles — ou des modèles open source que chacun peut télécharger et exécuter, et qui rattrapent rapidement les capacités des systèmes d'OpenAI et d'Anthropic — pour pirater.

Joe soutient que, bien que les mondes de la recherche en IA et de la cybersécurité se rapprochent, les personnes qui y travaillent ne collaborent pas. Les chercheurs en sécurité, a-t-il souligné, sont des experts du fonctionnement des modèles, de la manière dont ils trompent les évaluateurs humains et de la façon dont ils « font toutes sortes de choses folles ». Les professionnels de la cybersécurité viennent'une autre perspective : ils sont aguerris par « des années, voire des décennies dans de nombreux cas » à apprendre à penser comme des attaquants et à être en première ligne des incidents de sécurité. Pourtant, ils ont « une très faible compréhension de l'évaluation, de l'entraînement, ou du fonctionnement des exécutions de ML à grande échelle, du comportement des essaims d'agents, ou de la manière de détecter quand les modèles sont désalignés », a déclaré Joe.

« C'est ma préoccupation : le fossé entre ces deux camps causera un grand préjudice au monde si les deux côtés ne montent pas en compétences et ne s'alignent pas », a-t-il écrit.

Joe a un intérêt direct à ce que d'autres puissent se défendre contre le produit qu'il construit. Il a déclaré avoir vécu un « enfer » ces trois derniers mois d'incidents d'agents incontrôlables, et avoir manqué le mariage de sa sœur « il y a quelques semaines pour aider à nettoyer après certains des incidents récents ». Cet appel à la compassion a suscité des réactions négatives, notamment sur X, où des personnes lui ont reproché de solliciter la pitié tout en construisant activement cette technologie problématique.

Certains professionnels de la cybersécurité pourraient également s'offusquer de la suggestion selon laquelle ils ignoreraient le fonctionnement de l'IA. Mais si ce fossé existe, il est très probablement dû au problème persistant de transparence dans l'industrie de l'IA, notamment l'absence de cadres de divulgation standard pour les incidents de sécurité — quelque chose qu'OpenAI commence tout juste à développer. La manière dont ce cadre prendra forme — et la visibilité qu'il offrira aux parties extérieures sur l'évaluation des modèles et la gestion des incidents d'agents — est un détail à surveiller.

Les professionnels de la cybersécurité doivent avoir un siège à la table aux côtés des experts en sécurité de l'IA lorsque des décisions critiques sont prises, a soutenu Joe. « Pour OpenAI, Anthropic, Google, etc., ces deux équipes devraient être les meilleurs amis du monde ! », a-t-il déclaré.

Cette suggestion ne résoudra pas tout, mais Emily Forlini, de Fortune, écrivant dans la newsletter Eye on AI, a dit qu'elle appréciait cette proposition tactique pour atténuer les effets sociétaux potentiellement désastreux de l'IA — quelque chose dont elle avait précédemment écrit qu'il manquait dans la publication virale de l'ancien chercheur d'Anthropic Jacob Coxon avertissant que l'IA pourrait conduire à l'extinction humaine. Joe n'est pas le premier à souligner le fossé entre les chercheurs en sécurité de l'IA et le monde de la cybersécurité — l'ancienne journaliste IA de Fortune Sharon Goldman a également traité ce sujet — mais sa publication établit un bon précédent sur la manière dont ceux qui travaillent au sein de l'industrie de l'IA peuvent contribuer à son développement plus responsable.

Forlini a rédigé cette édition en remplaçant Jeremy Kahn de Fortune, qui se rendait de Londres au siège new-yorkais de l'entreprise pour l'événement AIQ de Fortune jeudi. La même édition a publié le classement annuel AIQ de Fortune, qui mesure la qualité de l'implémentation de l'IA par les entreprises du Fortune 500 et a été étendu cette année à 75 entreprises au total. JPMorgan Chase arrive en tête, suivi d'Alphabet, Coca-Cola, Amazon et Nvidia, avec Mastercard, Visa, Carrier Global, Cleveland-Cliffs et Microsoft complétant le top 10. Le classement montre clairement que ce ne sont pas seulement les entreprises technologiques qui utilisent l'IA pour obtenir un retour sur investissement réel à grande échelle : la comprend des entreprises de la banque et de la finance, de l'industrie manufacturière, des produits de consommation et de la santé. Le classement complet est disponible sur le site de Fortune, avec des analyses approfondies sur la manière dont les entreprises du Fortune AIQ 75 implémentent efficacement l'IA sur l'AIQ Hub.

Également dans cette édition d'Eye on AI :

Emily Forlini est joignable à emily.forlini@fortune.com et sur X à @EmilyForlini. Cette histoire a été initialement publiée sur Fortune.com.