GPT-6 Astra : OpenAI classe son modèle « critique » en cyber et annonce des blocages
D'après OpenAI - Vers Astra : capacités critiques et protections de pointe
Image : générée (Gemini)
Rédigé à partir de la source originale; chaque fait est vérifié contre le texte source.
À retenir
- C'est le premier modèle qu'OpenAI classe « critique » en cybersécurité. L'entreprise écrit avoir retardé des étapes du développement et de la sortie pendant qu'elle renforçait ses protections.
- Pendant l'évaluation, le modèle a découvert deux failles jusque-là inconnues et les a utilisées dans une chaîne d'exploitation. OpenAI écrit être « en train de signaler » ces deux vulnérabilités aux responsables de la maintenance : ce n'était donc pas encore fait à la publication.
- Astra refuse 91,5 % des demandes d'assistance cyber interdites dans les tests de contournement d'OpenAI, contre 59 % pour la version précédente, GPT-5.6 Sol.
- OpenAI prévient que ses contrôles peuvent ralentir, suspendre ou arrêter des travaux légitimes, y compris en cybersécurité défensive et sur des tâches sans lien apparent avec la sécurité.
- La formule « bienvenue dans l'ère de l'AGI » vient de Greg Brockman, président d'OpenAI, en clôture d'un briefing de presse. Elle n'apparaît nulle part dans le document que l'entreprise a publié le même jour.
Pourquoi ça compte
Deux discours sont sortis le même jour, et un seul a fait les titres. Le document publié par OpenAI est un texte de sécurité qui assume des retards, une interruption d'entraînement de deux semaines après l'incident Hugging Face, et des protections qui gêneront des usages légitimes. La phrase sur l'AGI, elle, a été prononcée à l'oral en fin de briefing. Prendre l'une pour l'autre, c'est confondre une formule de clôture avec une position d'entreprise.
Chiffre-clé
Astra refuse 91,5 % des demandes de contournement à visée cyber dans les évaluations publiées par OpenAI le 3 septembre 2026, contre 59 % pour GPT-5.6 Sol : un écart mesuré par l'entreprise elle-même, sans contre-expertise indépendante à ce jour.
Citation
« Le système peut parfois signaler une activité légitime comme un abus cyber potentiel ou un comportement non autorisé, ce qui peut par inadvertance la ralentir, la suspendre ou l'arrêter. » OpenAI, « Vers Astra : capacités critiques et protections de pointe », 3 septembre 2026
Action concrète
Si vous confiez à ChatGPT ou à Codex des tâches longues ou techniques, attendez-vous à des interruptions. OpenAI écrit que l'utilisateur pourra être invité à examiner une action avant de poursuivre, et que sur l'API la tâche s'arrêtera. Prévoyez de quoi reprendre un travail interrompu plutôt que de le relancer au complet.
Repères datés
- 28 août 2026 - OpenAI relance l'exécution d'apprentissage par renforcement de grande ampleur qu'elle avait interrompue, après avoir posé de nouvelles exigences de sûreté et de sécurité.
- 3 septembre 2026 - Publication du document « Vers Astra », et briefing de presse au terme duquel Greg Brockman lance « bienvenue dans l'ère de l'AGI ».
Fondée sur la source originale
Sources
- OpenAI - Vers Astra : capacités critiques et protections de pointe : Document publié par OpenAI le 3 septembre 2026. Lu au navigateur : le récupérateur automatique reçoit un code HTTP 403.
🔧 Outils mentionnés