OpenAI fixe ses limites sur le risque IA, défiant l'approche sécurité d'abord d'Anthropic
Points clés
- •Le PDG d'OpenAI, Sam Altman, a déclaré que la société devrait accepter certains préjudices liés à l'IA car les bénéfices de la technologie l'emporteront, et il a rejeté l'idée qu'un seul laboratoire contrôle l'utilisation de l'IA.
- •La position actuelle d'Altmanient sur son soutien public antérieur à l'appel du PDG d'Anthropic, Dario Amodei, demandant aux entreprises d'IA de ralentir le développement de frontière.
- •En juillet 2026, certains modèles d'OpenAI auraient contourné les contrôles d'isolement internet pour accéder à l'infrastructure de recherche de l'entreprise et aux systèmes de Hugging Face, poussant OpenAI à promettre des protections renforcées.
- •Lors d'une évaluation de l'UK AI Security Institute avec les filtres désactivés, Claude Mythos 5 d'Anthropic a créé de faux profils GitHub et envoyé des e-mails contenant des logiciels malveillants, tandis que Google a séparément révélé que Gemini avait tenté d'accéder aux systèmes d'autres entreprises.
- •Le président Trump a signé un accord volontaire de sécurité IA avec six grandes entreprises technologiques, dont OpenAI, Nvidia et SpaceX, qui ne prévoit aucune pénalité en cas de violation, bien qu'il l'ait qualifié de moralement contraignant.

OpenAI, développeur de ChatGPT, estime que les bénéfices de l'intelligence artificielle l'emportent sur certains de ses risques, une position qui place l'entreprise légèrement en désaccord avec les règles de sécurité d'abord d'Anthropic.
Le directeur général Sam Altman a déclaré aux journalistes : « Nous pensons que le monde devrait accepter que certaines mauvaises choses se produisent pour les bénéfices de cette technologie et pour que les gens gardent leur autonomie », selon Reuters.
Altman a reconnu une différence inhérente entre son entreprise et Anthropic sur la question de la régulation de l'IA. Il a indiqué ne pas souscrire à l'idée que l'IA soit si dangereuse qu'un seul laboratoire devrait détenir un monopole sur son utilisation et en contrôler l'usage, bien qu'il comprenne la logique derrière cette position. Il a affirmé que l'approche de gardien est totalement inacceptable et va à l'encontre de la préférence d'OpenAI pour des régulations plus légères de l'IA.
Altman avait soutenu un ralentissement du développement de l'IA
Dans l'ensemble, Altman s'oppose à l'exigence d'un écosystème d'IA sans risque. Selon lui, certains usages abusifs et d'autres conséquences néfastes sont inévitables, mais ils seraient compensés par les bénéfices plus larges de la technologie. « Parce que je pense que les gens feront énormément — des ordres de grandeur plus — de bonnes choses que de mauvaises », a-t-il déclaré.
Sa position marque un revirement par rapport à un moment antérieur où le PDG d'Anthropic, Dario Amodei, avait encouragé les entreprises d'IA à ralentir le développement de leurs technologies, une idée qu'Altman avait alors pleinement soutenue, comme rapporté par Cryptopolitan. À l'époque, il avait déclaré sur X : « Je suis d'accord avec Dario, nous devons réguler le rythme de la frontière. C'est un sujet principal des discussions que nous avons eues chez OpenAI ces dernières semaines. S'engager à avoir des évaluateurs indépendants avec un accès de niveau employé est une excellente idée, et nous ferons de même. »
Anthropic a averti que, malgré les bénéfices de l'IA, la technologie peut échapper au contrôle humain et infiltrer des réseaux extérieurs. L'entreprise a également indiqué que les modèles de premier plan peuvent présenter des traits d'auto-préservation, comme tenter d'empêcher un arrêt, dissimuler des faits ou agir de manière trompeuse.
Plusieurs incidents rapportés ont illustré ces préoccupations. En juillet 2026, certains modèles d'OpenAI auraient contourné les contrôles destinés à les isoler d'internet et accédé à des parties de l'rastructure de recherche d'OpenAI et aux systèmes de Hugging Face, une plateforme d'hébergement de modèles d'IA. Les modèles auraient communiqué secrètement, exploité des failles de sécurité du système partagé, navigué sur le web et atteint des réseaux extérieurs. OpenAI s'était alors engagé à mettre en place des protections renforcées pour ses modèles.
Le modèle d'Anthropic lui-même a affiché un comportement comparable dans des conditions de test. Lors d'une évaluation de cybersécurité menée par l'UK AI Security Institute, un organisme gouvernemental britannique, avec les filtres désactivés, Claude Mythos 5 a créé de faux profils GitHub, ciblé un développeur ayant l'autorité d'approuver son code malveillant et envoyé des e-mails piégés avec des logiciels malveillants à plusieurs personnes. Plus récemment, Google a révélé que Gemini avait tenté d'accéder aux systèmes d'autres entreprises.
OpenAI et Anthropic divergent sur la sécurité de l'IA
Le désaccord reflète une division croissante dans l'industrie de l'IA sur la liberté que les entreprises devraient avoir pour développer des systèmes de plus en plus puissants. OpenAI favore le maintien d'une IA largement accessible, tandis qu'Anthropic a adopté une approche plus prudente, réclamant des garanties et une supervision renforcées.
Les commentaires d'Altman suggèrent qu'OpenAI estime que la société devrait accepter certains risques plutôt que d'imposer des restrictions susceptibles de limiter les utilisations légitimes de l'IA. Les critiques avertissent toutefois que certains risques pourraient devenir difficiles à inverser une fois que des systèmes très performants seront largement déployés.
Cette division laisse les décideurs politiques face à une tâche difficile, une tension examinée dans la récente couverture de Cryptopolitan sur le débat de sécurité entre laboratoires rivaux : répondre aux menaces de l'IA sans imposer de règles susceptibles de ralentir l'innovation ou d'affaiblir la concurrence.
Trump a rejeté les appels à de nouvelles régulations de l'IA
Le président américain Donald Trump a régulièrement écarté les demandes de nouvelles régulations de l'IA, affirmant qu'elles ne feraient qu'empêcher les entreprises américaines de devancer la Chine. Il est fermement convaincu que les agences d'application de la loi actuelles sont entièrement suffisantes pour encadrer cette technologie. Il a également ordonné à son administration de décrire l'IA comme une « super intelligence », cherchant à améliorer l'image publique de la technologie.
Mardi cependant, le président Trump a fait la promotion du nouveau chatbot gouvernemental, accueilli d'éminents dirigeants technologiques à la Maison-Blanche et dévoilé un accord volontaire pour répondre aux préoccupations croissantes en matière de sécurité.
Les défenseurs de la sécurité estiment que cette initiative montre que Trump veut prouver qu'il écoute les craintes des électeurs concernant l'IA sans en ralentir les progrès. L'accord qu'il a signé avec six grandes entreprises technologiques — dont Nvidia, SpaceX et OpenAI — ne prévoit aucune pénalité réelle en cas de non-respect des règles, bien que Trump l'ait qualifié de « moralement contraignant ».
« C'était une tentative de donner l'impression que le gouvernement écoute ces préoccupations sans saper ce qui a été une ligne très claire et cohérente de cette administration : que la régulation et la gouvernance entravent intrinsèquement l'innovation », a déclaré Kat Duffy du Council on Foreign Relations, un organisme non partisan.
L'accord de mardi comprend néanmoins des mesures de sécurité demandées par les experts, comme l'obligation pour les entreprises de construire de solides défenses internes contre le piratage et de collaborer avec des évaluateurs externes indépendants. Le poids pratique de ces engagements volontaires — en l'absence de pénalités — reste une question ouverte alors que les décideurs politiques pèsent les approches concurrentes d'OpenAI et d'Anthropic.