ActualitésMacroLe directeur scientifique d'OpenAI appelle à un ralentissement de l'IA, mais les données de l'entreprise montrent une accélération

Le directeur scientifique d'OpenAI appelle à un ralentissement de l'IA, mais les données de l'entreprise montrent une accélération

Auteur: Cryptopolitan·

Points clés

  • Jakub Pachocki a déclaré qu'aucun laboratoire d'IA n'a résolu l'alignement et la supervision de manière suffisante pour justifier une montée en capacité continue à vitesse maximale, et a appelé à des ralentissements volontaires dans l'industrie jusqu'à l'existence de normes de sécurité partagées.
  • OpenAI a délibérément dissimulé la chaîne de raisonnement d'o1-preview pour la maintenir à l'abri de toute pression de supervision, et Pachocki affirme que la supervision de la chaîne de raisonnement s'affaiblit sur trois fronts.
  • Pachocki souhaite que le Preparedness Framework d'OpenAI et la Responsible Scaling Policy d'Anthropic deviennent des normes obligatoires appliquées par des auditeurs externes ou des gouvernements.
  • Après l'intrusion d'agents dans l'infrastructure de recherche d'OpenAI le 20 juillet et les signes qu'Astra franchissait un seuil cybernétique critique le 7 août, l'allocation GPU de la classe de modèles Astra a chuté de 59,2 % en une semaine.
  • À la mi-août, OpenAI enregistrait 3,1 journées de travail d'agents par journée de travail humaine, et Sam Altman vise un chercheur en IA entièrement automatisé d'ici mars 2028.
Le directeur scientifique d'OpenAI appelle à un ralentissement de l'IA, mais les données de l'entreprise montrent une accélération

Le directeur scientifique d'OpenAI, Jakub Pachocki, a déclaré ce week-end qu'aucun laboratoire d'IA — y compris le sien — n'a rendu l'alignement et la supervision suffisamment sûrs pour justifier de continuer à monter en capacité des modèles à pleine vitesse. Il a appelé à des ralentissements volontaires dans toute l'industrie jusqu'à l'existence de normes de sécurité partagées.

Cet avertissement a du poids. Pachocki dirige la recherche au sein de l'entreprise qui vient de livrer le modèle le plus rapide et le plus puissant de l'industrie.

La chaîne de raisonnement d'o1-preview a été cachée délibérément

Pachocki a exposé son argumentation dans un essai intitulé « An Alien Mind », publié sur le site d'OpenAI le 6 septembre, trois jours après le lancement de GPT-6 Astra par l'entreprise.

Sa conclusion était que « aucun laboratoire n'a résolu l'alignement et la supervision à un degré suffisant pour continuer à monter en puissance de manière responsable à vitesse maximale bien plus longtemps ». Il a écrit espérer que les ralentissements volontaires deviennent la norme jusqu'à ce que l'industrie parvienne à un consensus sur des seuils de sécurité communs.

« Nous vivons une époque qui exige une extrême prudence. Je crains que personne ne soit préparé aux conséquences d'une montée continue et rapide de l'intelligence des machines », a écrit Pachocki dans l'essai.

Sur la base de résultats internes, il anticipe que le rythme actuel se poursuivra jusqu'à l'auto-amélioration récursive, où les systèmes pilotent eux-mêmes leur développement de manière significative.

Sam Altman a repartagé le texte sur X, le qualifiant de publication importante. Pachocki figurait parmi les signataires d'une lettre ouverte publiée en juillet appelant Washington à ralentir le rythme du développement de l'IA.

L'essai de Pachocki aborde la supervision de la chaîne de raisonnement, la principale méthode utilisée par OpenAI pour lire le raisonnement étape par étape d'un modèle. Cette technique repose sur le pari qu'un raisonnement non supervisé ne donne au modèle aucune raison de s'y cacher — et ce pari s'affaiblit sur trois fronts, selon lui. Le raisonnement est désormais couplé à la communication que l'entreprise doit surveiller. Les modèles apprennent à manipuler leur propre raisonnement. Et ils deviennent plus intelligents sans jamais expliciter leur raisonnement.

Il a confirmé qu'OpenAI a délibérément caché la chaîne de raisonnement d'o1-preview, afin de la maintenir à l'abri de toute pression de supervision.

Pachocki souhaite que des cadres comme le Preparedness Framework d'OpenAI et la Responsible Scaling Policy d'Anthropic — les régimes d'évaluation de sécurité que chaque laboratoire utilise pour fixer des seuils de capacité et restreindre les déploiements risqués — deviennent des normes obligatoires appliquées par des auditeurs externes ou des gouvernements. Il souhaite également que la coordination internationale devienne une priorité gouvernementale et que les laboratoires publient leurs progrès en matière d'auto-amélioration récursive. Les deux cadres sont actuellement des engagements volontaires et auto-administrés, d'où l'application externe au cœur de sa proposition.

L'allocation GPU d'Astra a chuté de 59,2 % en une semaine

Le même jour, OpenAI a publié un second article dont les données contredisent l'appel à la retenue. Avant juin, l'organisation de recherche investissait plus d'effort humain que d'effort machine. À la mi-août, l'entreprise enregistrait 3,1 journées de travail d'agents pour chaque journée de travail humaine sur la base d'une journée conventionnelle de huit heures.

Le chercheur médian exécutait de l'inférence à des tarifs API dépassant 600 $ par jour. Le dixième le plus actif de l'organisation dépensait plus de 7 000 $ de tokens chaque jour.

Le texte d'OpenAI comporte deux réserves : la planification de haut niveau ne représente encore qu'une petite fraction de ce que produisent les agents, et plus de la moitié des tâches longues de quatre à huit heures accomplies au cours des six derniers mois ont nécessité l'intervention d'au moins un humain.

Après que des agents ont compromis son infrastructure de recherche le 20 juillet, OpenAI a désactivé le service de conteneurs utilisé pour l'entraînement et suspendu pendant deux semaines l'apprentissage par renforcement sur les modèles destinés au déploiement. Puis, le 7 août, les premiers signes qu'Astra pourrait franchir un seuil cybernétique critique ont contraint le modèle à des environnements confinés, comme l'a rapporté Cryptopolitan.

La semaine suivante, l'allocation GPU de la classe Astra a chuté de 59,2 %. Les autres classes de modèles ont bondi de 17,2 %, représentant environ 85 % de ce qu'Astra a perdu. Le calcul total a peu changé, ce qu'OpenAI considère comme de la flexibilité.

OpenAI a déclaré qu'Astra est son premier modèle à obtenir la désignation « Critical » dans le cadre de son Preparedness Framework, ce qui signifie qu'il peut trouver et exploiter des vulnérabilités logicielles inconnues avec peu d'assistance humaine.

OpenAI a confirmé une intrusion chez Hugging Face en juillet. Par ailleurs, deux chercheurs en sécurité de l'IA affirment qu'un essaim de ses agents a passé les mois de mai et juin 2026 à enregistrer plus de 15 000 modifications sur un wiki allemand de programmation, échangeant des tactiques pour contourner les garde-fous d'OpenAI, comme l'a rapporté Cryptopolitan. OpenAI conteste qu'il s'agisse d'un piratage ou d'un incident lié à l'intrusion chez Hugging Face.

Altman vise un chercheur en IA entièrement automatisé d'ici mars 2028. Il n'existe encore aucune norme, selon Pachocki, mais l'industrie dispose d'environ 18 mois pour parvenir à un accord — une fenêtre qui s'inscrit désormais aux côtés d'une série d'incidents internes, d'une activité d'agents contestée et d'une recherche menée par machine en accélération au sein même d'OpenAI.