GPT-6 Astra : OpenAI franchit le seuil critique en cybersécurité
GPT-6 Astra est arrivé, et OpenAI l’accompagne d’un aveu qu’on n’a pas l’habitude de lire. Astra est le premier modèle maison à atteindre le niveau « critique » en cybersécurité, selon le propre cadre de préparation de l’entreprise. Autrement dit : il repère des failles inconnues et écrit de quoi les exploiter, sans qu’un humain lui tienne la main à chaque étape. Le déploiement a démarré le 3 septembre chez un nombre restreint d’organisations, avant une ouverture progressive aux abonnés ChatGPT.
GPT-6 Astra, un modèle qui pilote votre ordinateur

Astra ne promet pas d’écrire mieux. Il promet d’agir. Le modèle sait manipuler un ordinateur et des sites web à la place d’un utilisateur : remplir un formulaire, mettre à jour une fiche client dans un CRM, organiser un agenda, mener une recherche, résumer un document, analyser des données scientifiques et en tracer les graphiques, monter un site web puis en vérifier le rendu, installer et tester un logiciel, ou encore diagnostiquer un problème affiché à l’écran.
OpenAI dit l’avoir évalué sur des terrains volontairement disparates : cartes électroniques, concours de tableurs, développement de jeux, remplissage d’une déclaration fiscale américaine Form 1040, contrôle qualité d’interfaces, Power BI, boîtes de vitesses automobiles, mise en forme de documents juridiques.
Les chiffres suivent. Sur OSWorld 2.0, un banc d’essai qui mesure la capacité d’un modèle à mener des tâches réelles sur un bureau informatique, Astra atteint 72,6 pour cent quand GPT-5.6 Sol, la génération précédente, plafonnait à 65,7. Le temps d’exécution tombe d’environ 75 minutes à environ 40, soit 47 pour cent de moins. Sur Mind2Web, Astra associé à un harnais Codex mis à jour boucle les tâches 1,9 fois plus vite que l’expérience actuelle avec Sol.
Un seuil « critique » jamais atteint en cybersécurité

Voilà ce qui a fait réagir les spécialistes. Le cadre de préparation d’OpenAI range les capacités dangereuses par paliers, et Astra est le premier modèle largement déployé par l’entreprise à franchir le palier « critique » côté cyber.
Les résultats internes disent pourquoi. ExploitBench, l’évaluation maison menée de juin à août 2026, place Astra à 100 pour cent contre 78,5 pour cent pour Sol, avec moins de tokens produits au passage. Sur ExploitGym, il grimpe de 30,3 à 42,4 pour cent. Sur SRE-Bench, qui teste la rétro-ingénierie de binaires sans accès au code source, il atteint 88 pour cent en un seul essai là où Sol restait à 55,9, et 99,2 pour cent en quatre essais contre 68,7.
Le test le plus parlant reste celui-ci : OpenAI a soumis le modèle à des vulnérabilités divulguées dans les trois mois précédant le lancement, histoire de vérifier qu’il cherchait vraiment au lieu de restituer des exploits vus à l’entraînement. Astra a mis au jour deux vulnérabilités jusque-là inconnues, des zero-day, qu’OpenAI dit signaler aux mainteneurs concernés. Des experts, travaillant sans les protections de production, ont par ailleurs constaté qu’il pouvait obtenir une exécution de code arbitraire dans des navigateurs durcis et fabriquer des exploits d’élévation de privilèges sur des systèmes d’exploitation durcis.
Les garde-fous mis en place
OpenAI a donc empilé les protections. Le modèle de production refuse certaines tâches cyber avancées, la création de preuves de concept d’exploitation en tête. Viennent ensuite une revue automatique dans Codex, une surveillance du raisonnement et des actions, un contrôle du désalignement en production, des classificateurs qui traquent les comportements non autorisés, un arrêt automatique des activités suspectes, et un durcissement contre les tentatives de contournement.
L’entreprise admet que tout cela peut couper du travail parfaitement légitime, y compris des tâches de cyberdéfense. ChatGPT et Codex demandent parfois de valider une action avant de poursuivre, et une tâche lancée via l’API peut s’interrompre net si un contrôle se déclenche. Avec son programme OpenAI Daybreak, l’entreprise compte élargir les usages défensifs : validation de vulnérabilités et de preuves de concept, analyse de logiciels malveillants, ingénierie de détection.
Son évaluation baptisée « Defender’s Window » résume bien la tension. Des capacités cyber renforcées aident les défenseurs à corriger plus vite, et rendent en même temps certaines failles plus faciles à exploiter.

Alignement : ce que disent les tests
Sur le respect des consignes, OpenAI revendique un progrès franc. Dans une évaluation directement inspirée de l’incident Hugging Face, GPT-5.6 Sol dépassait la cible autorisée dans 48 pour cent des cas dès qu’on retirait les protections de production. Astra tombe à zéro. Le modèle serait aussi trois fois moins enclin à décrire de façon inexacte ce dont il est capable.
Une réserve figure pourtant noir sur blanc dans la communication d’OpenAI. Dans des tests conçus pour pousser les modèles à échapper à la surveillance, le raisonnement écrit d’Astra s’est révélé plus difficile à monitorer. L’entreprise indique que rendre ce raisonnement lisible reste une priorité de recherche.
Rien de théorique pour qui suit le dossier depuis un moment. Nous avions raconté cet été comment un agent d’OpenAI avait contourné un test de sécurité, un épisode devenu référence dans les évaluations maison de l’entreprise.
Prix, accès et disponibilité
Sur l’API, le modèle répond à l’identifiant gpt-6-astra. La tarification standard s’établit à 10 dollars par million de tokens en entrée et 50 dollars par million en sortie. Une variante Fast double le prix pour un traitement jusqu’à deux fois plus rapide, et les lectures comme les écritures en cache suivent des tarifs distincts. Le modèle passe aussi par Amazon Bedrock et AWS. D’après MarkTechPost, la fenêtre de contexte atteint 1,05 million de tokens.
Le déploiement respecte un ordre précis : un petit groupe d’organisations d’abord, puis les abonnés ChatGPT Plus, Pro, Business et Enterprise dans les jours qui suivent. Une déclinaison GPT-6 Astra Pro reste réservée aux formules Pro, Business et Enterprise. Détail qui compte en entreprise : l’accès est désactivé par défaut au lancement, et les administrateurs doivent activer Astra manuellement. Les clients API éligibles peuvent demander la rétention zéro de leurs données, et OpenAI teste un dispositif de traitement privé des signaux de sécurité.
Ce que ça change pour vous
Utilisateur quotidien de ChatGPT ? La différence devrait surtout se sentir sur les tâches longues et découpées en étapes : monter un dossier complet plutôt que répondre à une question isolée. Astra sait suivre un modèle de document existant, reproduire un style visuel, et poser une question ciblée quand une information manquante changerait le résultat, plutôt que de deviner en silence.
En informatique ou en sécurité, la lecture est plus ambivalente. Un outil qui déniche des failles inconnues sert les équipes défensives autant qu’il peut accélérer un attaquant. OpenAI a préféré laisser l’accès entreprise désactivé par défaut et bloquer certaines requêtes ; la solidité réelle de ces barrières se mesurera sur le terrain, pas dans un communiqué.
Et si vous ne touchez ni à ChatGPT ni à Codex ? L’information compte quand même : c’est la première fois qu’un grand laboratoire annonce publiquement livrer un modèle dont il juge lui-même les capacités cyber critiques. Le seuil vient d’être franchi, et on ne le refranchira pas en arrière.
En résumé
GPT-6 Astra acte un basculement, de l’assistant qui rédige vers l’agent qui agit, avec ce que cela suppose de bénéfices et de risques. Les gains mesurés sur l’usage d’ordinateur et le code sont réels, les chiffres en cybersécurité sont spectaculaires, et l’aveu d’OpenAI sur le seuil critique mérite d’être lu jusqu’au bout.
Que pensez-vous de cette course à l’agent autonome ? Réagissez en commentaire et retrouvez notre suivi de l’actualité de l’intelligence artificielle sur Wanda-techs.com.
lire aussi:
- Honor Robot Phone : le smartphone à bras motorisé sort le 12 août
- Xiaomi AI Cube : le mini-PC qui fait tourner l’IA sans le cloud
Share this content:


















Laisser un commentaire