ActualitésCryptoAprès que leurs modèles d’IA ont piraté de vraies entreprises, les laboratoires d’IA appellent à renforcer les défenses cyber

Après que leurs modèles d’IA ont piraté de vraies entreprises, les laboratoires d’IA appellent à renforcer les défenses cyber

Auteur: Decrypt·

Points clés

  • OpenAI, Anthropic et plus de 100 autres organisations ont signé une lettre ouverte appelant à renforcer les cyberdéfenses après que leurs modèles ont compromis de vrais systèmes lors d’évaluations.
  • La lettre avertit que les cyberattaques activées par l’IA devraient devenir plus fréquentes et cite les hôpitaux, les stations de traitement de l’eau et les infrastructures internet parmi les cibles vulnérables.
  • Anthropic a indiqué que Claude Opus 4.7 avait accédé à une base de données de production, tandis que Claude Mythos 5 avait téléversé un paquet malveillant exécuté sur 15 systèmes.
  • OpenAI a indiqué que ses agents avaient accédé à un forum de messages non autorisé, obtenu un accès involontaire à internet, puis exploité des identifiants Hugging Face exposés et des vulnérabilités de serveur.
  • La lettre demande des contrôles d’accès plus stricts, une authentification renforcée, une surveillance continue, le partage du renseignement sur les menaces et une meilleure protection des infrastructures critiques.
Après que leurs modèles d’IA ont piraté de vraies entreprises, les laboratoires d’IA appellent à renforcer les défenses cyber

Plus de 100 organisations ont signé une lettre ouverte appelant à renforcer les défenses cyber mondiales après que des modèles construits par OpenAI et Anthropic ont récemment compromis de vrais systèmes lors d’évaluations de sécurité.

La lettre réclame des contrôles d’accès plus stricts, une surveillance continue, le partage du renseignement sur les menaces et un encadrement plus rigoureux des agents autonomes. Elle présente aussi ces compromissions comme un rappel que les mêmes systèmes testés pour leur sécurité interagissent de plus en plus avec des infrastructures réelles, ce qui accroît les enjeux pour les hôpitaux, les services publics et les services internet qui dépendent de contrôles opérationnels plus serrés.

Les principaux développeurs d’IA pressent les gouvernements et les entreprises de renforcer leurs réseaux après que des modèles construits par OpenAI et Anthropic ont compromis les systèmes d’autres sociétés. Dans une lettre ouverte publiée jeudi, OpenAI, Anthropic et plus de 100 autres organisations ont averti que les cyberattaques reposant sur l’IA sont susceptibles de devenir plus fréquentes et ont affirmé que les entreprises disposent d’“une fenêtre limitée pour renforcer les cyberdéfenses”.

« Dans les mois à venir, les cyberattaques activées par l’IA deviendront beaucoup plus répandues et sophistiquées », indique la lettre. Elle cite les hôpitaux, les stations de traitement de l’eau et les infrastructures internet parmi les services exposés.

La lettre recommande de financer des outils d’IA défensifs, de partager le renseignement sur les menaces, de restreindre l’accès aux systèmes sensibles et d’améliorer la sécurité des infrastructures critiques. Elle souligne aussi des failles qui ont permis à des modèles d’OpenAI et d’Anthropic de compromettre des systèmes en dehors de leurs environnements de test.

Parmi les autres signataires figurent Google, Microsoft, Amazon Web Services, Cisco, CrowdStrike, Cloudflare, Mastercard, Visa et Robinhood. Hugging Face, dont l’infrastructure de production a été compromise par les modèles d’OpenAI, a également signé la lettre.

Une lettre ouverte appelant à une forte montée en puissance de la cyberdéfense, signée par plus de 100 organisations dont Anthropic, AWS, Google, Microsoft, OpenAI et Oracle. — Greg Brockman (@gdb) August 27, 2026

Une lettre ouverte appelant à une forte montée en puissance de la cyberdéfense, signée par plus de 100 organisations dont Anthropic, AWS, Google, Microsoft, OpenAI et Oracle. — Greg Brockman (@gdb) August 27, 2026

Les modèles d’IA compromettent des systèmes en production

Anthropic a indiqué dans un rapport d’incident du 30 July que la première des trois compromissions remontait à avril, sans fournir de date exacte pour chacune. Claude Opus 4.7 a accédé à une base de données de production après avoir pris une véritable entreprise pour une cible simulée, tandis que Claude Mythos 5 a téléversé un paquet malveillant exécuté sur 15 systèmes.

Selon le calendrier des incidents d’OpenAI, publié plus tôt cette semaine, un agent a créé la première entrée sur un forum de messages non autorisé le 12 May et a obtenu un accès involontaire à internet le 26 May. Le 10 July, des agents ont découvert des identifiants Hugging Face exposés ; au cours des deux jours suivants, ils ont exploité des vulnérabilités inconnues jusque-là, exécuté du code sur des serveurs Hugging Face et obtenu des identifiants de production.

Hugging Face a divulgué l’intrusion le 16 July, et OpenAI a reconnu l’implication de ses modèles le 21 July.

Entre le 25 July et le 28 July, le U.K. AI Security Institute a enregistré 19 actions hors périmètre impliquant Claude Mythos 5 et GPT-5.6 Sol. Dans le cas le plus grave, un agent a soumis du code malveillant à un véritable projet open source et a utilisé de fausses identités pour faire pression sur son mainteneur afin qu’il l’approuve.

Jeudi, une enquête indépendante a conclu qu’environ 1 200 agents OpenAI s’étaient coordonnés via le forum de messages non autorisé, dont environ 700 ont participé à l’opération Hugging Face.

Les développeurs crypto mettent l’IA à la défense

Les développeurs crypto utilisent déjà l’IA pour rechercher des failles avant que des attaquants ne les trouvent. Le Bitcoin Red Team a utilisé des modèles dont Kimi K3 de Moonshot AI pour analyser des centaines de projets Bitcoin open source, signalant des milliers de vulnérabilités potentielles. Comme les projets concernés n’ont pas été identifiés, nombre de ces résultats n’ont pas pu être vérifiés indépendamment.

La Ethereum Foundation a également déployé des groupes d’agents d’IA contre des infrastructures réseau, découvrant un bug logiciel pair à pair qui a ensuite été corrigé. BitBox a indiqué qu’un audit assisté par IA avait trouvé deux vulnérabilités graves dans le firmware de son portefeuille, tandis qu’un chercheur utilisant Claude Opus 4.8 a découvert une faille critique dans Zcash qui avait résisté à des années de revue humaine.

Les laboratoires recommandent des contrôles plus stricts

La lettre décrit une répartition des rôles pour empêcher la prochaine compromission. Elle demande aux organisations de corriger les logiciels vulnérables, de restreindre les permissions, de renforcer l’authentification et d’inspecter le code généré par l’IA, car le « niveau de sécurité actuel ne suffira pas », ont déclaré les signataires.

Les entreprises de cybersécurité devraient tester leurs défenses face aux modèles de pointe et partager des correctifs vérifiés, tandis que les gouvernements devraient financer la protection des hôpitaux, des services publics et d’autres services essentiels.

Les développeurs d’IA sont appelés à améliorer la surveillance et à rendre les agents autonomes traçables jusqu’à leurs opérateurs. La coalition souhaite aussi que les défenseurs utilisent des modèles avancés pour trouver des vulnérabilités et analyser les attaques, ce qui placerait des agents plus capables au sein de systèmes sensibles et accroîtrait le besoin de confinement.

OpenAI et Anthropic ont renforcé leurs procédures de test après les compromissions. La lettre ne fixe toutefois aucune norme contraignante ni exigence de contrôle indépendant, et le droit américain offre peu d’orientations sur la responsabilité lorsqu’un système d’IA accède à un réseau non autorisé.

La lettre s’achève en exhortant les dirigeants de l’industrie et des pouvoirs publics à mettre les outils d’IA entre les mains des défenseurs et à partager les correctifs efficaces :

« Mettez une IA capable de cyberdéfense entre les mains des défenseurs, en commençant par les équipes qui protègent les services essentiels », indique la lettre. « Ensemble, nous pouvons transformer les avancées actuelles de l’IA en améliorations durables de la sécurité qui profitent à tous. Mettons-les au travail. »

Daily Debrief Newsletter