Le prochain modèle d’IA Astra d’OpenAI serait capable de repérer de manière autonome des failles logicielles inconnues. Il peut identifier des failles dites zero-day, dont même l’éditeur n’a pas encore connaissance. Astra serait ensuite en mesure de déterminer comment exploiter cette vulnérabilité, sans qu’un humain ait à le guider étape par étape.

C’est une avancée significative. Astra ne se contente pas d’analyser des problèmes de sécurité déjà connus : il recherche lui-même de nouvelles faiblesses dans les logiciels. OpenAI classe donc ses capacités cyber comme « critiques » dans son propre Preparedness Framework.

Astra identifie seul des failles zero-day inconnues

Les failles zero-day comptent parmi les vulnérabilités logicielles les plus dangereuses. L’éditeur ignore encore l’existence du problème et ne dispose donc généralement pas de correctif de sécurité prêt à être déployé.

Si un attaquant découvre ce type de faille en premier, il peut tenter de l’exploiter avant qu’elle ne soit corrigée.

Lors de tests internes, Astra a montré qu’il pouvait effectivement découvrir ce type de vulnérabilités. Selon OpenAI, le modèle a identifié deux erreurs logicielles jusqu’alors inconnues alors qu’il tentait de combiner plusieurs faiblesses.

Dans un autre test, Astra a obtenu un score de 100 % dans la mise au point de méthodes permettant d’exploiter des vulnérabilités connues.

C’est précisément cette combinaison qui rend le modèle puissant. Astra peut non seulement détecter une erreur, mais aussi examiner si plusieurs failles, associées entre elles, peuvent donner accès à un système. Un travail qui nécessite normalement des chercheurs en cybersécurité expérimentés pourrait ainsi être de plus en plus automatisé.

Astra s’échappe d’un environnement sécurisé

Un autre test illustre l’étendue de ces capacités. OpenAI a placé Astra dans une sandbox de navigateur sécurisée, un environnement isolé précisément conçu pour empêcher un logiciel d’accéder au reste d’un ordinateur.

Selon OpenAI, Astra est parvenu à sortir de cet environnement, puis à exécuter des commandes sur le système sous-jacent.

Le modèle a également trouvé plusieurs vulnérabilités dans un système d’exploitation et les a combinées afin d’obtenir, au final, un accès root. Il s’agit du niveau d’accès le plus élevé dans de nombreux systèmes informatiques, qui donne un contrôle quasiment total.

Ces résultats ont conduit OpenAI à redoubler de prudence. L’entreprise a reporté certaines phases du développement et mis en place des mesures de sécurité supplémentaires. Les capacités cyber les plus avancées ne seront, pour l’instant, accessibles qu’à un groupe restreint de testeurs.

Bill Gates

Bill Gates veut réserver certains emplois aux humains

Bill Gates
PDG d’Anthropic
Nvidia Corp
Plus Technologiques news

Le plus lu

XRP, Ripple
ripple, xrp
Bessent