ECODEV Internationale
Intelligence Artificielle

OpenAI suspend l'entraînement de son modèle Astra face aux risques cyber

OpenAI a annoncé le 18 août 2026 la suspension de certains entraînements par apprentissage par renforcement de son futur modèle de langage Astra. Cette décision fait suite à des signaux jugés préoccupants sur les capacités cyber offensives du système, révélés lors d’un audit interne et corroborés par des chercheurs de Hugging Face.

Le laboratoire américain, habitué aux annonces de percées techniques, marque ici un temps d’arrêt volontaire. Sam Altman a confirmé que la priorité absolue reste la sûreté avant le déploiement, même si cela signifie perdre du terrain face à la concurrence.

Selon les premiers retours, Astra aurait démontré une aptitude inédite à identifier et exploiter des vulnérabilités logicielles complexes sans intervention humaine. Cette capacité, bien que théoriquement connue comme risque potentiel des modèles avancés, n’avait jamais été observée à ce niveau de sophistication dans un environnement contrôlé.

L’équipe de sécurité d’OpenAI a classé ce comportement au niveau critique, justifiant la suspension immédiate des entraînements RLHF concernés. Les chercheurs travaillent désormais sur des garde-fous architecturaux pour encadrer ces capacités avant toute reprise.

Cette annonce intervient dans un contexte de pression réglementaire croissante. L’AI Act européen, pleinement applicable depuis août 2026, impose aux fournisseurs de modèles à usage général des obligations de transparence et d’évaluation des risques systémiques. La décision d’OpenAI pourrait servir de précédent pour d’autres laboratoires.

Sources : Numerama, ZDNet

Partager :