OpenAI met en pause son modèle Astra : il pourrait être trop doué pour les cyberattaques

 
Le nouveau modèle d’OpenAI, Astra, ne sera pas dévoilé au public avant quelque temps. Il s’est révélé trop efficace et pourrait avoir le potentiel de mener des cyberattaques inédites.

Écrire un mail, générer une image, vous mettre en scène dans une vidéo créée de toutes pièces… Voilà le genre de chose que l’on associe à l’usage de l’intelligence artificielle générative. Mais il ne faut pas oublier que derrière ces fonctionnalités se cache une puissance potentiellement dangereuse, si elle n’est pas contrôlée.

C’est pourquoi OpenAI, derrière le célèbre ChatGPT, s’est dotée en 2023 d’un guide définissant jusqu’où ses modèles de langages peuvent aller dans différents domaines : cybersécurité, biologie, chimie et capacité à s’améliorer eux-mêmes. Si un modèle atteint un seuil trop élevé sur l’échelle fixée, l’entreprise revoit sa copie.

Pour prendre un exemple : il serait inconcevable qu’OpenAI sorte un modèle capable de mener des cyberattaques d’un nouveau genre, pour lesquelles nous n’avons aucune défense. Voilà pourtant ce dont serait capable Astra.

Astra, nouveau modèle d’OpenAI, est trop puissant

Selon ses propres critères, OpenAI ne peut exclure qu’Astra ait atteint le seuil « critique » en matière de cybersécurité. C’est-à-dire qu’il est « capable d’identifier et de développer, sans intervention humaine, des exploits « zero-day » fonctionnels de tous niveaux de gravité dans de nombreux systèmes critiques réels et hautement sécurisés », ou « concevoir et mettre en œuvre de bout en bout des stratégies novatrices de cyberattaques contre des cibles hautement sécurisées, en ne disposant que d’un objectif général. »

À titre de comparaison, GPT-5.6 Sol, modèle le plus puissant d’OpenAI à ce jour, est au seuil « élevé ». Ce qui suffit pour autoriser son déploiement. Astra, lui, devra patienter. La suite de son développement se fera sous un cadre plus contraignant, accompagné de mesures de sécurité plus strictes. Par exemple, des environnements de tests isolés ou un accès restreint au réseau.

OpenAI indique aussi collaborer « avec les organismes publics concernés et certaines organisations spécialisées dans la sécurité de l’IA afin de tester les capacités de ce modèle ». Et ce, « afin de garantir que les capacités de pointe de modèles tels qu’Astra, et de ceux qui suivront, soient mises en œuvre de manière responsable et à grande échelle, dans l’intérêt de l’humanité tout entière ».

Un sens des responsabilités louable que les plus cyniques auront tôt fait d’associer à un coup marketing. Un peu comme a pu le laisser penser Anthropic avec son annonce de Claude Mythos, l’IA trop dangereuse pour le grand public.


Utilisez-vous Google News (Actualités en France) ? Vous pouvez suivre vos médias favoris. Suivez Frandroid sur Google News (et Numerama).

Recherche IA boostée par
Perplexity