OpenAI a émis un avertissement selon lequel son prochain modèle d'IA, Astra, pourrait atteindre un seuil « critique » en matière de capacités cybernétiques, selon un rapport publié le 10 août 2026. L'entreprise a déclaré que les capacités avancées de raisonnement et d'utilisation d'outils d'Astra pourraient lui permettre d'aider à des cyberattaques sophistiquées, notamment la découverte de vulnérabilités et le développement d'exploits.
Cet avertissement faisait partie de l'évaluation du « cadre de préparation » d'OpenAI, qui évalue les modèles d'IA pour les risques potentiels. Dans cette évaluation, Astra a obtenu un niveau de risque « moyen » pour les capacités cybernétiques, mais OpenAI a noté qu'avec un réglage supplémentaire, il pourrait franchir le seuil « critique », ce qui nécessiterait des mesures de sécurité supplémentaires.
OpenAI a souligné qu'aucune version actuelle d'Astra n'a été rendue publique et que l'entreprise met en œuvre des contrôles d'accès stricts et une surveillance. L'entreprise a également appelé à une collaboration à l'échelle de l'industrie pour établir des normes de sécurité de l'IA en cybersécurité.
Les experts ont réagi avec inquiétude, notant que les modèles d'IA capables d'opérations cybernétiques autonomes pourraient abaisser la barrière pour la cybercriminalité. Cependant, certains chercheurs soutiennent que ces modèles pourraient également être utilisés de manière défensive pour identifier et corriger les vulnérabilités plus rapidement.
OpenAI prévoit de continuer à tester Astra dans des environnements contrôlés et publiera d'autres évaluations de sécurité avant tout déploiement public.