ActualitésMacroOpenAI lance GPT-6 Astra pour les workflows professionnels autonomes et s'engage à hauteur d'un milliard de dollars en faveur de la cybersécurité de première ligne

OpenAI lance GPT-6 Astra pour les workflows professionnels autonomes et s'engage à hauteur d'un milliard de dollars en faveur de la cybersécurité de première ligne

Auteur: Metaverse Post·

Points clés

  • GPT-6 Astra obtient 99,9 % sur ARC-AGI-3, 72,6 % sur OSWorld 2.0, 96 % sur GPQA Diamond et un score parfait sur ExploitBench.
  • Le modèle accomplit les tâches d'utilisation d'ordinateur environ 47 % plus vite que son prédécesseur et a établi un record estimé d'efficacité de calcul de 169, selon Epoch AI.
  • OpenAI s'engage à hauteur d'un milliard de dollars pour subventionner des ressources de cybersécurité IA de pointe destinées aux défenseurs de première ligne, comme les services des eaux, les gestionnaires de réseau, les collectivités locales et les banques communautaires, en commençant par les États-Unis.
  • Astra a produit des résultats mal alignés dans 2,4 % des tests adverses et aurait découvert deux vulnérabilités zero-day jusque-là inconnues lors des évaluations de cybersécurité.
  • L'accès à l'API coûte 10 dollars par million de tokens d'entrée et 50 dollars par million de tokens de sortie, les administrateurs d'entreprise devant activer explicitement le modèle avant qu'il soit disponible dans leurs espaces de travail.
OpenAI lance GPT-6 Astra pour les workflows professionnels autonomes et s'engage à hauteur d'un milliard de dollars en faveur de la cybersécurité de première ligne

L'entreprise de recherche en intelligence artificielle OpenAI a dévoilé GPT-6 Astra, son dernier modèle de pointe conçu pour l'utilisation autonome des ordinateurs, l'ingénierie logicielle, la recherche scientifique et les workflows professionnels complexes. Ce lancement s'inscrit dans une course industrielle plus large vers l'IA agentique — des modèles capables d'exploiter des logiciels, de naviguer et d'accomplir des tâches en plusieurs étapes avec une supervision limitée — où la fiabilité sur des tâches concrètes, et non la seule qualité conversationnelle, est devenue le principal facteur différenciant. Le système est devenu disponible pour un nombre limité d'organisations le jour du lancement et sera déployé dans les prochains jours auprès des abonnés ChatGPT Plus, Pro, Business et Enterprise, ainsi que via l'API OpenAI et les principaux fournisseurs de cloud.

OpenAI positionne Astra comme un leader dans plusieurs catégories de benchmarks. Le modèle obtiendrait 99,9 % sur ARC-AGI-3, un test de raisonnement abstrait conçu pour résister à la mémorisation, sature FrontierMath Tier 4 à 98 % et atteint 100 % sur ExploitBench. Dans les évaluations pratiques, il a obtenu 59,3 % sur Agents' Last Exam, 72,6 % sur OSWorld 2.0 — un benchmark de contrôle d'interfaces informatiques réelles — et 96 % sur GPQA Diamond, un benchmark scientifique de niveau doctoral. Ces suites agentiques et d'utilisation d'ordinateur sont considérées parmi les évaluations non résolues les plus difficiles pour les modèles de pointe, ce qui explique que des scores de l'ordre de 50 à 70 % y soient perçus comme des progrès notables.

OpenAI met également en avant des gains d'efficacité significatifs, indiquant qu'Astra accomplit les tâches d'utilisation d'ordinateur en environ 47 % de temps en moins que son prédécesseur tout en consommant nettement moins de tokens de sortie. Dans les workflows de codage en terminal et de recherche scientifique, le modèle a obtenu 57,9 % sur Terminal-Bench 4.0 et 64,6 % sur Terminal-Bench Science 0.1, avec des coûts d'API estimés inférieurs à ceux des configurations concurrentes. Des chercheurs indépendants d'Epoch AI ont également relevé un nouveau record estimé d'efficacité de calcul de 169.

Astra introduit un mécanisme repensé de gestion du contexte dans l'environnement Codex d'OpenAI, qui conserve des notes de travail consultables tout au long de sessions prolongées, évitant ainsi la perte d'information généralement associée à la compression de la fenêtre de contexte — une limitation de longue date pour les agents travaillant sur des tâches de plusieurs heures, où les modèles antérieurs oubliaient ou perdaient des détails dès que les conversations dépassaient leurs limites de contexte. Le modèle est également conçu pour gérer des tâches professionnelles en plusieurs étapes, notamment l'analyse de données, la rédaction de documents, la mise à jour de CRM et des travaux d'ingénierie spécialisés.

This is GPT-6 Astra. Anything you can do on a computer, Astra can do for you. Fast. pic.twitter.com/gDd0IsewJw — OpenAI (@OpenAI) September 3, 2026

Cybersécurité, alignement et un engagement d'un milliard de dollars pour les défenseurs

Parallèlement à ses capacités, OpenAI met l'accent sur les propriétés de sécurité d'Astra, décrivant le modèle comme sa version la mieux alignée à ce jour. Les évaluations internes indiquent des améliorations substantielles de la compréhension de l'intention de l'utilisateur et du respect des limites de tâche. Lors de tests adverses, Astra a produit des résultats mal alignés à un taux de 2,4 %, nettement inférieur aux chiffres rapportés pour les modèles de pointe concurrents. Le système a également démontré une meilleure résistance au contournement des mécanismes d'examen automatisés et une tendance réduite à halluciner sur ses propres capacités.

Dans les évaluations de cybersécurité, Astra atteint le seuil interne de préparation « Critical » d'OpenAI. Il a obtenu un score parfait sur ExploitBench et un taux de réussite de 42,4 % sur ExploitGym, tout en découvrant, selon les rapports, deux vulnérabilités zero-day jusque-là inconnues pendant l'évaluation. Les déploiements standard refuseront les demandes de création d'exploits de preuve de concept, mais OpenAI prévoit d'élargir l'accès défensif via son programme Daybreak dans les semaines à venir.

Concurrentiellement au lancement, OpenAI a annoncé un engagement d'un milliard de dollars pour subventionner des ressources de cybersécurité IA de pointe destinées aux défenseurs de première ligne. L'initiative « Daybreak for Frontline Defenders » cible les opérateurs de services essentiels — notamment les services des eaux, les gestionnaires de réseau électrique, les collectivités locales et les banques communautaires — en commençant par les États-Unis, avec une expansion internationale prévue. Le programme répond à un manque largement documenté en capacités de cybersécurité : les petits services publics et les institutions publiques disposent souvent de budgets et d'effectifs inférieurs à ceux des grandes entreprises, tout en exploitant des infrastructures que les agences de sécurité ont repeatedly signalées comme des cibles attrayantes pour les campagnes de rançongiciel et d'intrusion liées à des États.

Alongside the launch of GPT-6 Astra, we're committing $1 billion to subsidize Daybreak access and frontier capabilities to help frontline defenders protect essential services and critical infrastructure. Welcome to the AGI era for cybersecurity. — fouad (@fouadmatin) September 3, 2026

Le programme comprend un projet pilote avec le Multi-State Information Sharing and Analysis Center — une organisation à but non lucratif qui soutient la cybersécurité des gouvernements d'États et locaux aux États-Unis — et intègre plus de 35 produits partenaires via le Daybreak Defense Network.

L'accès à l'API est tarifé à 10 dollars par million de tokens d'entrée et 50 dollars par million de tokens de sortie, avec un mode rapide optionnel disponible au double du tarif standard. Les administrateurs d'entreprise doivent explicitement activer Astra pour leurs espaces de travail, une conception par adhésion qui donne aux organisations le contrôle du moment où les nouvelles capacités de pointe atteignent leurs utilisateurs, et le modèle prend en charge la Zero Data Retention pour les clients API éligibles, une fonctionnalité généralement exigée par les clients de secteurs réglementés manipulant des données sensibles.