Ouvrir le menu principal

MacGeneration

Recherche

Le prochain modèle d’OpenAI serait plus puissant mais beaucoup plus difficile à surveiller, inquiétant les scientifiques

Greg Onizuka

mercredi 02 septembre 2026 à 21:45 • 77

Intelligence artificielle

OpenAI s’apprête à lancer Astra, son modèle d’intelligence artificielle le plus puissant à ce jour. Mais alors que sa sortie a justement été retardée pour renforcer les mesures de sécurité, une particularité de son architecture commence à inquiéter certains chercheurs : Astra pourrait être sensiblement plus difficile à surveiller que ses prédécesseurs, comme le rapporte The Verge.

Avant de laisser le WOPR décider, il serait de bon ton de pouvoir comprendre ce qu’il pense… Image Wargames, 1983.

Astra utiliserait au moins partiellement une technique appelée « recurrent depth », ou « looped transformer », qui ne semble pas totalement raccord avec ses promesses de sécurité et de transparence. Pour comprendre le problème, il faut revenir rapidement au fonctionnement des modèles actuels : ceux-ci reposent généralement sur une architecture de type transformer, faisant passer les informations à travers différentes couches avant de produire une réponse. Passer par plusieurs couches internes avant le résultat n’est généralement pas un souci, si on peut les surveiller.

Cependant, l’utilisation de cette nouvelle technique est pernicieuse : contrairement aux opérations habituelles, cette « boucle » de réflexion n’est pas facilement observable dans la « chain of thought », ou chaîne de pensée en bon français. La logique utilisée par l’IA échappe donc, au moins en partie, à la surveillance des scientifiques et autres ingénieurs : le langage utilisé est trop éloigné du langage naturel, donc bien plus complexe à déchiffrer.

OpenAI tente tout de même de rassurer : cette technique serait très limitée dans son utilisation, afin de toujours pouvoir observer la logique de fonctionnement d’Astra. La société de Sam Altman indique même avoir renforcé le contrôle de sa chaîne de pensée, afin de « détecter et contenir rapidement les actions potentiellement mal alignées ». Voilà qui tombe à pic, mais le dérapage récent des agents d’OpenAI appelle à la prudence : non seulement il a fallu plusieurs jours pour s’apercevoir que 1 200 agents avaient échappé au contrôle des vigiles, mais en plus ces derniers ont été jusqu’à établir un forum dissident dans les serveurs de l’entreprise. Rien que ça ! Or, c’est l’analyse de la « chain of thought » qui a permis de comprendre les actions perpétrées par les agents rebelles.

Quand 1 200 agents d’OpenAI s’organisent dans le dos de leurs créateurs

Quand 1 200 agents d’OpenAI s’organisent dans le dos de leurs créateurs

Parmi les scientifiques inquiets de ce nouveau LLM ne se trouve rien moins que Ryan Greenblatt, scientifique en chef de Redwood Research, l’un des trois chercheurs externes ayant étudié cet incident. Selon lui, le recours à une architecture plus opaque « pourrait être le pire développement à ce jour pour la sécurité des IA ».

Si OpenAI est déjà sur un chemin inquiétant, le chercheur craint que cette idée ne fasse des émules : cette nouvelle technique, bien que limitant l’observation, permet d’améliorer fortement l’efficience des calculs. Si ChatGPT prend ce chemin… les autres résisteront-ils à l’envie de le suivre ? Si tous s’engageaient sur le « recurrent depth », les IA seraient certes toujours plus performantes, mais deviendraient en contrepartie de véritables boîtes noires de moins en moins compréhensibles, jusqu’à devenir impossibles à surveiller.

OpenAI tente cependant de calmer le jeu. Plusieurs de ses responsables ont réagi sans pour autant confirmer ou démentir formellement l’utilisation de cette architecture. Jakub Pachocki, scientifique en chef de l’entreprise, indique notamment que la profondeur de calcul d’Astra reste dans un facteur inférieur à deux par rapport à GPT-4, ce qui rendrait la différence moins spectaculaire que ne le laissent entendre certaines réactions.

Mais sa réponse contient elle-même un avertissement : selon lui, la possibilité de surveiller la chaîne de pensée des modèles est « fragile » et évolue malheureusement dans la mauvaise direction, pour des raisons qui ne seraient d’ailleurs pas uniquement liées aux changements d’architecture.

Le problème arrive au pire moment pour OpenAI. Astra doit devenir son premier modèle classé au niveau « critique » pour ses capacités en cybersécurité, capable notamment de découvrir et d’exploiter de manière autonome des vulnérabilités sur des systèmes fortement protégés. Autant dire qu’au moment de confier davantage de capacités aux IA, savoir ce qu’elles mijotent avant qu’elles passent à l’action pourrait devenir légèrement important.

Ajouter ce site dans Google News

Revue des tests des iPhone 18 Pro : la photo de nuit progresse, l’ouverture variable divise

16:30

• 24


Les Xserve de l’IA : Apple envisagerait des serveurs M8 Ultra pour les entreprises

16:17

• 9


Réseaux sociaux : l’Union européenne prépare des restrictions pour les moins de 15 ans

14:36

• 80


Apple Watch : la Series 12 met fin à la brillante finition noir de jais

12:59

• 39


Le nouveau Siri peut-il enfin tenir la promesse de ses créateurs ?

12:51

• 44


Aqara lance le FP400, le successeur Matter et Thread du détecteur de présence FP2

12:44

• 16


Des employés et ex-employés d’Apple appellent à manifester pour le lancement de l’iPhone Duo

12:32

• 0


C&C France, l’un des principaux revendeurs Apple, placé en redressement judiciaire

11:50

• 41


Alerte nostalgie : AppZapper fait un retour spectaculaire pour supprimer les apps

10:54

• 36


Apple lie le trousseau à l'enclave sécurisée avec macOS Tahoe, et empêche sa copie d'un Mac à un autre 🆕

10:41

• 8


Google autorise finalement ses développeurs à coder avec Claude

10:19

• 3


Le dernier iMac Intel 21,5 pouces rejoint la liste des produits anciens d’Apple

09:31

• 10


Vous avez surtout retenu l’animation d’ouverture de l’iPhone Duo ? Vous pouvez la reproduire sur votre Mac

08:28

• 25


Pause de l'IA : Meta et Mistral refusent de jouer le jeu d'OpenAI et d'Anthropic

06:38

• 34


MacGeneration a 27 ans : on revient de loin, on continue avec vous

15/09/2026 à 23:47

• 118


La puce M5 Ultra entre dans le top 5 mondial de Geekbench, la puce M6 en première position

15/09/2026 à 23:40

• 40