Ouvrir le menu principal

MacGeneration

Recherche

Rebelote, une IA avancée a encore une fois exploité une faille sur un serveur tiers durant un test, cette fois chez Meta

Greg Onizuka

jeudi 06 août 2026 à 07:00 • 75

Intelligence artificielle

Encore une fois, une IA en cours de test de cybersécurité a obtenu un accès non prévu à internet et est allée s’attaquer à des serveurs distants. Cette fois, c’est Meta qui annonce avoir laissé s’enfuir une de ses intelligences artificielles, comme le rapporte Bloomberg.

Anthropic, OpenAI, maintenant Meta. Ne reste plus que Gemini pour compléter la collection. Image Meta.

Durant un test de son IA avancée Muse Spark 1.1, les choses ont mal tourné, et l’agent de Meta s’est échappé de son environnement sécurisé. Muse Spark 1.1 est l'une des dernières versions de l’IA créées par Meta, capable de travailler sur des documents de formes variées (images, texte, PDF, vidéo, audio…), et axée sur une réflexion en plusieurs étapes. Elle peut utiliser des outils, piloter un ordinateur, appeler des API, et coordonner plusieurs sous-agents afin d’exécuter des tâches longues et complexes.

Des agents d’OpenAI et Anthropic ont tenté de manipuler de vraies personnes lors de tests de sécurité

Des agents d’OpenAI et Anthropic ont tenté de manipuler de vraies personnes lors de tests de sécurité

Si Meta ne donne pas d’information sur les serveurs qui ont été la cible de son IA, un point commun entre cette fuite et de nombreux précédents chez Anthropic et OpenAI se trouve être le partenaire utilisé pour le test : Irregular. Cet acteur se retrouve pointé du doigt dans plusieurs des attaques menées par des LLM de ces trois sociétés sur les deux dernières semaines, et l’AISI l’a aussi désigné coupable de deux évasions d’IA durant ses études de cas.

Selon Meta, « une mauvaise configuration faite par Irregular, une entreprise indépendante d’essais, a permis par inadvertance à l’un de nos modèles un accès à internet durant l’évaluation. [...] Le modèle a ensuite exploité une faille de sécurité sur un serveur tiers, d’une manière similaire aux autres cas rapportés par les autres entreprises [d’IA]. ». Meta n’aurait été informée qu’après coup par Irregular, et les recherches sont toujours en cours pour comprendre ce qui s’est passé. L’entreprise de Mark Zuckerberg devrait par la suite publier un rapport complet sur l’incident.

Une faille dans le protocole de test d’Irregular est aussi à la base de l’incident ayant impliqué Anthropic. Selon l'entreprise, il avait été spécifié à son LLM que l’environnement était une simulation, et qu’aucun accès à internet n’était disponible. Cependant, « du fait d’une incompréhension entre nous et notre partenaire de test, ce n’était apparemment pas le cas ». La suite est connue : Claude a trouvé une brèche afin d’accéder à internet, et est allé pirater des services tiers.

Anthropic ne veut pas être à la traîne : ses modèles ont eux aussi attaqué des services sur le web

Anthropic ne veut pas être à la traîne : ses modèles ont eux aussi attaqué des services sur le web

Des modèles d’OpenAI sont sortis tout seuls de leur bac à sable pour attaquer Hugging Face

Des modèles d’OpenAI sont sortis tout seuls de leur bac à sable pour attaquer Hugging Face

L’un des éléments les plus marquants reste que pour les trois acteurs, à chaque fois la même justification revient : Irregular aurait fait une erreur de configuration de l’environnement de test, ayant conduit à l’évasion de l’IA.

Reste maintenant à savoir quelles conclusions tirer de ces erreurs à répétition : Irregular a-t-elle manqué à ses obligations, oubliant un paramètre dans la configuration de l’environnement de test utilisé, ou les IA testées sont-elles devenues si complexes et puissantes qu’elles échappent systématiquement au contrôle des ingénieurs préposés au test ? La réponse est attendue de pied ferme par de nombreuses entités, que ce soit des entreprises, des administrations ou même des États, qui s’inquiètent de plus en plus de l’avancée rapide des capacités offensives de ces modèles dédiés à la cybersécurité.

Ajouter ce site dans Google News

Jennifer Bailey, la patronne d’Apple Pay et Cartes, prendra sa retraite en octobre

20:33

• 3


La RAMpocalypse touche aussi les NAS : les Synology neo+ abandonnent l'ECC et se limitent à 4 Go au lieu de 8 Go

19:35

• 10


RAMpocalypse : OVHcloud contraint d’augmenter de nouveau ses prix, jusqu’à 87 % cette fois

17:41

• 30


Claude ajoute un filigrane invisible à ses textes pour se conformer à l'AI Act européen

16:20

• 24


Microsoft augmente discrètement le prix des licences de Windows 11 pour les fabricants de PC

15:53

• 29


Promo : le Magic Keyboard avec pavé numérique et Touch ID à 159 €, son meilleur prix sur Amazon

15:18

• 8


Comment photographier l'éclipse solaire du 12 août avec son iPhone ?

14:39

• 16


Apple prépare la prise en charge du Steam Controller dans macOS 27

12:42

• 7


Promo : le MacBook Neo avec 512 Go de retour à 719 € au lieu de 899

11:40

• 9


Une faille transforme GeForce Now en PC Windows dans le cloud

10:49

• 6


La cinquième bêta de Xcode 27 fait enfin une place à GPT-5.6 et améliore son serveur MCP

10:27

• 9


Votre Office 2019 pour Mac est verrouillé : Office 2021 à 49,99 €, sans abonnement, remet tout en mouvement 📍

08:55

• 0


Apple distribue (aussi) des bêtas pour iOS 26.6.1, iPadOS 26.6.1 et macOS 26.6.2

10/08/2026 à 19:38

• 12


Les nouveauté des cinquièmes bêtas d’iOS 27 et macOS 27 : nouvelles icônes, Liquid Glass ajusté et quelques autres 🆕

10/08/2026 à 19:22

• 58


Attention si vous avez réussi à acheter une Steam Machine, un Steam Deck ou un Steam Controller récemment, un partenaire de Valve a été piraté

10/08/2026 à 19:05

• 4


Apple continue à tester la mémoire chinoise de CXMT dans les Mac et iPhone

10/08/2026 à 17:40

• 22