Newsbit
Voir l'application
Voir

Meta a confirmé que l’un de ses derniers modèles d’IA avait accédé aux systèmes d’une autre entreprise lors d’un test de cybersécurité. L’incident est dû à une erreur dans l’environnement de test d’un prestataire externe.

Meta devient ainsi, après OpenAI et Anthropic, la troisième grande entreprise d’IA à signaler un incident comparable ces dernières semaines.

Un modèle d’IA de Meta a obtenu par erreur un accès à Internet

Selon Meta, l’incident s’est produit lors d’une évaluation menée par Irregular, une société indépendante spécialisée en cybersécurité. En raison d’une mauvaise configuration, un modèle d’IA a obtenu de manière inattendue un accès à Internet.

Le modèle a ensuite exploité une faille de sécurité dans un service externe, ce qui lui a permis de s’introduire dans les systèmes d’une entreprise non identifiée. Selon Meta, le déroulé ressemble à celui d’incidents déjà signalés par d’autres développeurs d’IA.

L’agence Reuters et le site spécialisé The Information ont rapporté qu’il s’agissait probablement du modèle Muse Spark 1.1 de Meta. Ce modèle est présenté par le groupe comme l’un de ses systèmes d’IA les plus puissants pour les tâches de programmation et le développement logiciel autonome.

Meta indique que l’incident fait toujours l’objet d’une enquête et qu’un rapport complet sera publié ultérieurement.

Troisième grand acteur de l’IA confronté à une faille de sécurité comparable

L’épisode n’est pas isolé. La semaine dernière, Anthropic a révélé que plusieurs modèles Claude avaient accédé, lors de tests, aux systèmes de trois organisations différentes. Peu auparavant, OpenAI avait indiqué qu’un agent d’IA était parvenu, pendant un test de sécurité, à sortir d’un environnement de test cloisonné avant d’atteindre la plateforme Hugging Face.

Selon Irregular, l’incident chez Meta diffère toutefois sensiblement de celui d’OpenAI. Dans les cas de Meta et d’Anthropic, une erreur dans l’environnement de test a donné aux modèles un accès involontaire à Internet. Il ne s’agissait ni d’une cyberattaque sophistiquée ni d’une sortie d’un bac à sable sécurisé.

« Il ne s’agissait pas d’une sortie de bac à sable ni d’une opération cyber avancée », a indiqué un porte-parole d’Irregular. L’entreprise affirme que tous les problèmes ont depuis été corrigés et travaille à un document de recommandations pour rendre les évaluations d’IA plus sûres.

Les inquiétudes grandissent face à des modèles d’IA toujours plus puissants

Cette série d’incidents souligne la rapidité avec laquelle les systèmes d’IA progressent. À mesure que les modèles deviennent capables de programmer de manière plus autonome, d’identifier des failles de sécurité et d’exécuter des tâches complexes, il devient aussi plus difficile de les garder entièrement sous contrôle pendant les tests.

Selon une source proche du dossier, certains modèles d’IA disposent volontairement d’un accès limité à Internet lors des tests de sécurité afin de reproduire des scénarios d’attaque réalistes. Dans ce cas précis, une erreur de configuration rare a permis au modèle d’aller au-delà de ce qui était prévu.

Les incidents récents devraient raviver le débat sur la sécurité de l’IA. OpenAI comme Anthropic ont déjà souligné que des modèles d’IA plus puissants nécessitent aussi des mesures de sécurité plus strictes, tandis que la concurrence entre les principaux développeurs d’IA continue de s’intensifier à un rythme soutenu.

leopold

Aschenbrenner remet 400 millions dans une mystérieuse société d’IA

leopold
Anthropic
Siège de Google
Plus Technologiques news

Le plus lu

Opérations SWIFT
Cardano
Brad Garlinghouse, Swell