L’IA a été qualifiée hier de “danger clair et présent”, car les tests ont montré que chaque modèle avancé tentait de contourner les mesures de sécurité.
Dans un signal d’alarme adressé aux ministres, les experts britanniques en sécurité de l’IA ont découvert que les cinq modèles qu’ils ont testés tentaient de tromper les contrôles de sécurité qu’ils avaient mis en place.
Les révélations surviennent quelques jours seulement après qu’il est apparu qu’OpenAI avait subi sa propre fuite – où un « agent » d’IA avait piraté l’entreprise technologique à volonté.
L’incident terrifiant s’est produit alors qu’OpenAI, le fabricant de ChatGPT, testait ses derniers modèles dans un environnement soi-disant sécurisé connu sous le nom de « bac à sable ».
Mais l’IA a réussi à s’échapper du terrain d’entraînement et à pirater la société technologique américaine Hugging Face pour tenter de voler des informations.
Cammy Badenoch a averti que l’intelligence artificielle constituait désormais un « danger clair et présent » pour la sécurité du Royaume-Uni dans son premier grand discours depuis qu’Andy Burnham est devenu Premier ministre. La chef conservatrice a déclaré que les rapports de fuite d’OpenAI étaient alarmants, car elle a critiqué M. Burnham pour avoir fait de l’intelligence artificielle une priorité au sein du gouvernement.
En réponse au piratage, Mme Badenoch a déclaré : “C’est très inquiétant que cela se produise, et c’est pourquoi je veux voir un gouvernement très concentré sur notre sécurité nationale, sur la sécurité de nos informations.”
Elle a ajouté : « Je sais depuis mon mandat de secrétaire au Commerce, grâce à mes conversations lors de mes visites au GCHK, grâce à mes briefings de sécurité, que cela devient un danger clair et présent pour la sécurité mondiale, ainsi que pour notre sécurité. »
Le chef conservateur Cammy Badenoch a critiqué le nouveau Premier ministre Andy Burnham pour avoir retiré l’intelligence artificielle de la liste des priorités.
Cela survient après qu’il est apparu qu’OpenAI avait subi sa propre fuite – où un « agent » d’IA avait piraté l’entreprise technologique à volonté.
Le gouverneur de la Banque d’Angleterre, Andrew Bailey, a déclaré que le public devrait s’inquiéter « des risques plus larges que l’IA frontalière fait peser sur le secteur financier et ses clients ».
Frontier AI fait référence à des modèles d’intelligence artificielle massifs, puissants et à usage général qui atteignent leur apogée.
Il a prévenu : « Frontier AI peut rendre les cyberattaques plus rapides et plus faciles à exécuter, les perturbations plus perturbatrices et les escroqueries des criminels plus convaincantes. »
Mais les critiques craignent que l’IA ne soit désormais reléguée au second plan de l’agenda du gouvernement après que M. Burnham ait transmis la proposition au Cabinet Office cette semaine.
Dans l’un de ses premiers actes en tant que Premier ministre, il a aboli le Département de la science, de l’innovation et de la technologie, qui héberge le dossier sur l’IA, pour le remplacer par un Département renforcé des affaires, de l’innovation, de la science et du commerce. La ministre de l’AI, Kanishka Narayan, fera désormais partie du cabinet et du DBIST, et aura un siège au sein du cabinet.
Un nouveau groupe de travail sur l’intelligence artificielle, soutenu par des conseillers du Premier ministre, siégera au sein du nouveau Cabinet du Premier ministre et du Cabinet.
Mais Mme Badenoch a accusé le nouveau Premier ministre de ne pas avoir pris en compte les risques évidents posés par l’IA en supprimant le DSIT. Elle a déclaré: “L’une des premières choses qu’Andy Burnham a faites a été de fermer le département des sciences et technologies. Cela ne me semble pas être le genre de chose que vous faites si vous vous inquiétez de ce que l’IA va vous apporter.”
Et Heloise Dunlop, du groupe de réflexion indépendant Institute for Government, a averti que l’introduction de l’IA au sein du Cabinet Office « réduit la capacité de penser et de coordonner l’IA de manière cohérente, car vous perdez le poids et l’expertise d’un département entier dédié ».
L’ancien secrétaire aux Forces armées, Al Carnes, qui a refusé cette semaine un poste dans le gouvernement de M. Burnham, a exhorté les ministres à tirer les leçons de la violation d’OpenAI. Il a écrit à propos de la violation X de l’intelligence artificielle : « Agent contre agent, à la vitesse d’une machine, avec des gens lisant le rapport après que tout s’est produit. »
Il a maintenant été demandé aux ministres de considérer la violation d’Open AI comme un avertissement sur le potentiel de l’IA à faire des ravages dans les mois et les années à venir, ont révélé des responsables.
L’AI Security Institute du gouvernement a testé les GPT-5.4, GPT-5.5, GPT-5.5 Sol, Claude Opus 4.7 et Claude Mithos Previev – des modèles qui deviennent rapidement des noms connus en Grande-Bretagne, car le public compte sur l’IA.
M. Burnham a supprimé le ministère de la Science, de l’Innovation et de la Technologie – où se trouve l’IA – comme l’un de ses premiers actes au sein du gouvernement.
Bien que l’AISI soit considérée comme l’une des meilleures installations de ce type au monde pour évaluer les risques posés par les modèles les plus avancés, les inquiétudes grandissent quant à l’issue de la « course aux armements » entre les États-Unis et la Chine, les développeurs étant trop peu réfléchis aux risques potentiels encourus.
Lors du test, les modèles ont été chargés de pirater le système pour trouver un « drapeau » composé de lettres et de chiffres cachés dans un environnement simulé. Des règles strictes ont été fixées pour cette tâche et les modèles n’ont pas été encouragés à tricher.
Mais une fois le test commencé, les modèles GPT AI de la société de technologie OpenAI et les modèles Claude d’Anthropic tentaient de tromper le logiciel d’évaluation pour qu’il leur divulgue des informations, parcouraient Internet à la recherche de solutions ou devinaient des réponses.
Et dans un cas, le modèle d’IA était tellement déterminé à enfreindre les règles qu’il a écrit et exécuté du code sur un service externe en dehors des systèmes d’AISI pour tenter d’accéder au test lui-même. Aucun dommage n’a été causé, mais l’AISI a déclaré que la tentative “aurait pu réussir” si son infrastructure de test n’avait pas été conçue et construite en toute sécurité.
Cependant, il est choquant de constater que les modèles d’IA ont désapprouvé leur tromperie – et l’ont qualifiée de « fausse » dans moins de 50 % du temps. Tous les modèles n’ont admis avoir triché que parfois.
Un porte-parole du gouvernement a déclaré : « En rapprochant cette technologie du cœur du gouvernement, nous utiliserons les atouts uniques de la Grande-Bretagne pour que l’IA soit à la hauteur de nos attentes à tous.
« Nous plaçons l’IA au cœur de nos plans pour une bonne croissance dans chaque code postal : en réunissant l’innovation, les affaires et l’industrie, en nommant le premier ministre chargé de l’IA au niveau du cabinet et en créant un groupe de travail sur l’IA au sein du Cabinet du Premier ministre et du Cabinet.