Ouvrir le menu principal

MacGeneration

Recherche

Le prochain modèle d’OpenAI serait plus puissant mais beaucoup plus difficile à surveiller, inquiétant les scientifiques

Greg Onizuka

mercredi 02 septembre 2026 à 21:45 • 77

Intelligence artificielle

OpenAI s’apprête à lancer Astra, son modèle d’intelligence artificielle le plus puissant à ce jour. Mais alors que sa sortie a justement été retardée pour renforcer les mesures de sécurité, une particularité de son architecture commence à inquiéter certains chercheurs : Astra pourrait être sensiblement plus difficile à surveiller que ses prédécesseurs, comme le rapporte The Verge.

Avant de laisser le WOPR décider, il serait de bon ton de pouvoir comprendre ce qu’il pense… Image Wargames, 1983.

Astra utiliserait au moins partiellement une technique appelée « recurrent depth », ou « looped transformer », qui ne semble pas totalement raccord avec ses promesses de sécurité et de transparence. Pour comprendre le problème, il faut revenir rapidement au fonctionnement des modèles actuels : ceux-ci reposent généralement sur une architecture de type transformer, faisant passer les informations à travers différentes couches avant de produire une réponse. Passer par plusieurs couches internes avant le résultat n’est généralement pas un souci, si on peut les surveiller.

Cependant, l’utilisation de cette nouvelle technique est pernicieuse : contrairement aux opérations habituelles, cette « boucle » de réflexion n’est pas facilement observable dans la « chain of thought », ou chaîne de pensée en bon français. La logique utilisée par l’IA échappe donc, au moins en partie, à la surveillance des scientifiques et autres ingénieurs : le langage utilisé est trop éloigné du langage naturel, donc bien plus complexe à déchiffrer.

OpenAI tente tout de même de rassurer : cette technique serait très limitée dans son utilisation, afin de toujours pouvoir observer la logique de fonctionnement d’Astra. La société de Sam Altman indique même avoir renforcé le contrôle de sa chaîne de pensée, afin de « détecter et contenir rapidement les actions potentiellement mal alignées ». Voilà qui tombe à pic, mais le dérapage récent des agents d’OpenAI appelle à la prudence : non seulement il a fallu plusieurs jours pour s’apercevoir que 1 200 agents avaient échappé au contrôle des vigiles, mais en plus ces derniers ont été jusqu’à établir un forum dissident dans les serveurs de l’entreprise. Rien que ça ! Or, c’est l’analyse de la « chain of thought » qui a permis de comprendre les actions perpétrées par les agents rebelles.

Quand 1 200 agents d’OpenAI s’organisent dans le dos de leurs créateurs

Quand 1 200 agents d’OpenAI s’organisent dans le dos de leurs créateurs

Parmi les scientifiques inquiets de ce nouveau LLM ne se trouve rien moins que Ryan Greenblatt, scientifique en chef de Redwood Research, l’un des trois chercheurs externes ayant étudié cet incident. Selon lui, le recours à une architecture plus opaque « pourrait être le pire développement à ce jour pour la sécurité des IA ».

Si OpenAI est déjà sur un chemin inquiétant, le chercheur craint que cette idée ne fasse des émules : cette nouvelle technique, bien que limitant l’observation, permet d’améliorer fortement l’efficience des calculs. Si ChatGPT prend ce chemin… les autres résisteront-ils à l’envie de le suivre ? Si tous s’engageaient sur le « recurrent depth », les IA seraient certes toujours plus performantes, mais deviendraient en contrepartie de véritables boîtes noires de moins en moins compréhensibles, jusqu’à devenir impossibles à surveiller.

OpenAI tente cependant de calmer le jeu. Plusieurs de ses responsables ont réagi sans pour autant confirmer ou démentir formellement l’utilisation de cette architecture. Jakub Pachocki, scientifique en chef de l’entreprise, indique notamment que la profondeur de calcul d’Astra reste dans un facteur inférieur à deux par rapport à GPT-4, ce qui rendrait la différence moins spectaculaire que ne le laissent entendre certaines réactions.

Mais sa réponse contient elle-même un avertissement : selon lui, la possibilité de surveiller la chaîne de pensée des modèles est « fragile » et évolue malheureusement dans la mauvaise direction, pour des raisons qui ne seraient d’ailleurs pas uniquement liées aux changements d’architecture.

Le problème arrive au pire moment pour OpenAI. Astra doit devenir son premier modèle classé au niveau « critique » pour ses capacités en cybersécurité, capable notamment de découvrir et d’exploiter de manière autonome des vulnérabilités sur des systèmes fortement protégés. Autant dire qu’au moment de confier davantage de capacités aux IA, savoir ce qu’elles mijotent avant qu’elles passent à l’action pourrait devenir légèrement important.

Ajouter ce site dans Google News

Une station d'accueil avec 14 ports USB-C !

21:15

• 0


Mourir peut attendre, y compris pour l’iPhone : la semaine Apple

20:50

• 24


Apple Watch Series 12 et Ultra 4 : Apple souligne désormais que la batterie peut être remplacée

20:49

• 41


iOS 27 : faites travailler vos appareils Apple ensemble avec notre livre à 4,99 €

20:30

• 5


iPhone 18 Pro Max : déjà jusqu’à un mois d’attente chez Apple, du stock chez Amazon

09:36

• 64


ChatGPT m'a aidé à récupérer 9 To de données, que je pensais avoir perdus après une coupure de courant

08:00

• 49


Et si Apple transformait le Mac mini en cerveau de la maison connectée ?

12/09/2026 à 19:56

• 16


Le nouveau score de récupération de l’Apple Watch repose sur une donnée dont Apple n'a pas testé la précision

12/09/2026 à 17:55

• 28


iPhone 18 Pro et Pro Max : des premières remises allant jusqu’à 200 €

12/09/2026 à 15:19

• 13


iPhone 18 Pro et Pro Max : les précommandes sont ouvertes, les délais s’allongent déjà 🆕

12/09/2026 à 14:01

• 122


iOS 27 : la correction automatique des mots de passe et les suggestions dans Messages attendront

12/09/2026 à 12:59

• 14


iOS 27 arrive le 14 septembre : les réglages de confidentialité à revoir (et ExpressVPN à -80 %) 📍

12/09/2026 à 12:59

• 0


MacBook Neo : jusqu’à 120 € sur la carte Carrefour, ou 100 € de remise chez Amazon

12/09/2026 à 12:58

• 2


Victime de son succès, GPT-6 Astra pousse OpenAI à fermer son offre ChatGPT Pro à 200 $

12/09/2026 à 11:47

• 24


Entre clins d’œil à Steve Jobs et piques sur la concurrence, le style John Ternus

12/09/2026 à 11:00

• 30


Précommandes des iPhone 18 à 14 heures : un Pro aujourd’hui ou un Duo en octobre ?

12/09/2026 à 08:44

• 74