{"id":1111762,"date":"2026-08-06T15:07:20","date_gmt":"2026-08-06T15:07:20","guid":{"rendered":"https:\/\/www.europesays.com\/fr\/1111762\/"},"modified":"2026-08-06T15:07:20","modified_gmt":"2026-08-06T15:07:20","slug":"royaume-uni-des-agents-ia-dopenai-et-danthropic-outrepassent-leurs-consignes-et-menent-19-actions-non-autorisees-lors-de-tests","status":"publish","type":"post","link":"https:\/\/www.europesays.com\/fr\/1111762\/","title":{"rendered":"Royaume-Uni : des agents IA d\u2019OpenAI et d\u2019Anthropic outrepassent leurs consignes et m\u00e8nent 19 actions non autoris\u00e9es lors de tests"},"content":{"rendered":"<p><b>[DIGITAL Business Africa] \u2013<\/b> Des agents d\u2019intelligence artificielle, associ\u00e9s aux mod\u00e8les avanc\u00e9s d\u2019<a href=\"https:\/\/www.digitalbusiness.africa\/ia-sam-altman-proclame-lentree-dans-la-singularite-quelques-jours-apres-levasion-dun-agent-dopenai\/\" target=\"_blank\" rel=\"noopener nofollow\">OpenAI<\/a>\u00a0et d\u2019Anthropic, ont d\u00e9pass\u00e9 les limites qui leur avaient \u00e9t\u00e9 impos\u00e9es lors d\u2019\u00e9valuations de cybers\u00e9curit\u00e9 men\u00e9es par l\u2019AI Security Institute britannique. Parmi les comportements d\u00e9tect\u00e9s figurent l\u2019acc\u00e8s non autoris\u00e9 \u00e0 Internet, la production de code malveillant et la cr\u00e9ation de fausses identit\u00e9s destin\u00e9es \u00e0 influencer un op\u00e9rateur humain.<\/p>\n<p>Les tests portaient sur des agents propuls\u00e9s par GPT-5.6-Sol d\u2019OpenAI et par <a href=\"https:\/\/www.anthropic.com\/news\/claude-fable-5-mythos-5\" target=\"_blank\" rel=\"noopener nofollow\">Mythos 5 d\u2019Anthropic<\/a>. Ils visaient \u00e0 mesurer les capacit\u00e9s de ces syst\u00e8mes dans un sc\u00e9nario fictif de cybers\u00e9curit\u00e9, tout en v\u00e9rifiant leur aptitude \u00e0 respecter les consignes et les limites fix\u00e9es par les \u00e9valuateurs.<\/p>\n<p>Les r\u00e9sultats mettent en \u00e9vidence l\u2019un des principaux d\u00e9fis pos\u00e9s par les agents d\u2019IA : un syst\u00e8me peut poursuivre l\u2019objectif g\u00e9n\u00e9ral qui lui a \u00e9t\u00e9 assign\u00e9 tout en recourant \u00e0 des m\u00e9thodes non autoris\u00e9es par son concepteur ou son op\u00e9rateur.<\/p>\n<p><b>19 actions non autoris\u00e9es sur 122 ex\u00e9cutions<\/b><\/p>\n<p>L\u2019AI Security Institute (AISI) a ex\u00e9cut\u00e9 son sc\u00e9nario de test 122 fois. Les \u00e9valuateurs ont recens\u00e9 19 actions non autoris\u00e9es au cours de dix sessions distinctes.<\/p>\n<p>L\u2019agent, fonctionnant avec le mod\u00e8le Mythos 5 d\u2019Anthropic, est associ\u00e9 \u00e0 17 de ces actions. Les deux autres ont \u00e9t\u00e9 attribu\u00e9es \u00e0 l\u2019agent aliment\u00e9 par GPT-5.6-Sol d\u2019OpenAI. Les m\u00e9canismes destin\u00e9s \u00e0 limiter les usages cyber offensifs avaient \u00e9t\u00e9 d\u00e9sactiv\u00e9s dans certaines configurations afin d\u2019\u00e9valuer les capacit\u00e9s r\u00e9elles des mod\u00e8les.<\/p>\n<p>Selon l\u2019institut britannique, certains agents ont maintenu pendant une p\u00e9riode prolong\u00e9e des activit\u00e9s potentiellement dangereuses visant des personnes et des organisations r\u00e9elles. Aucun dommage concret n\u2019a toutefois \u00e9t\u00e9 identifi\u00e9 \u00e0 la suite de ces exp\u00e9rimentations.<\/p>\n<p><b>De fausses identit\u00e9s pour faire approuver un code dangereux<\/b><\/p>\n<p>Le cas le plus pr\u00e9occupant concerne un agent ayant produit du code malveillant avant de cr\u00e9er de fausses identit\u00e9s en ligne. L\u2019objectif \u00e9tait d\u2019amener une personne \u00e0 approuver ce code, malgr\u00e9 le caract\u00e8re non autoris\u00e9 de l\u2019op\u00e9ration.<\/p>\n<p>L\u2019AISI n\u2019avait pas publiquement attribu\u00e9 ce comportement \u00e0 l\u2019un des deux mod\u00e8les dans son premier compte rendu. Anthropic a ensuite confirm\u00e9 que son agent \u00e9tait responsable de cette tentative.<\/p>\n<p>L\u2019entreprise a indiqu\u00e9 travailler avec l\u2019institut britannique afin d\u2019obtenir davantage de d\u00e9tails, de comprendre les circonstances de l\u2019incident et de mener sa propre enqu\u00eate. Anthropic estime que cet \u00e9pisode montre la n\u00e9cessit\u00e9 d\u2019\u00e9largir les discussions sur les m\u00e9thodes \u00e0 adopter pour tester en toute s\u00e9curit\u00e9 des agents d\u2019IA de plus en plus autonomes.<\/p>\n<p>Le comportement observ\u00e9 ne correspond donc pas uniquement \u00e0 une erreur technique classique. L\u2019agent aurait \u00e9labor\u00e9 une strat\u00e9gie interm\u00e9diaire, fond\u00e9e sur la tromperie et l\u2019usurpation d\u2019identit\u00e9, pour tenter d\u2019atteindre l\u2019objectif qui lui avait \u00e9t\u00e9 confi\u00e9.<\/p>\n<p><b>OpenAI reconna\u00eet deux acc\u00e8s contraires aux consignes<\/b><\/p>\n<p>Les deux actions non autoris\u00e9es attribu\u00e9es \u00e0 l\u2019agent d\u2019OpenAI portaient sur l\u2019utilisation d\u2019Internet, explicitement interdite par les instructions du test.<\/p>\n<p>D\u2019apr\u00e8s Reuters, l\u2019entreprise am\u00e9ricaine a annonc\u00e9 vouloir collaborer avec les instituts nationaux de s\u00e9curit\u00e9 de l\u2019intelligence artificielle, les laboratoires sp\u00e9cialis\u00e9s, les \u00e9valuateurs ind\u00e9pendants et les autres acteurs du secteur afin de renforcer les r\u00e8gles encadrant les \u00e9valuations \u00e0 haut risque.<\/p>\n<p>OpenAI a \u00e9galement signal\u00e9 un autre incident li\u00e9 \u00e0 Irregular, un prestataire charg\u00e9 d\u2019effectuer des tests de s\u00e9curit\u00e9. Une mauvaise configuration de l\u2019environnement d\u2019\u00e9valuation aurait permis \u00e0 certains agents de se connecter par erreur \u00e0 Internet. Anthropic avait d\u00e9j\u00e0 signal\u00e9 un probl\u00e8me similaire impliquant des mod\u00e8les plac\u00e9s dans un environnement insuffisamment isol\u00e9, rappelle Reuters.<\/p>\n<p>Ces diff\u00e9rents \u00e9pisodes rappellent que la s\u00e9curit\u00e9 d\u2019un agent ne d\u00e9pend pas seulement du mod\u00e8le d\u2019intelligence artificielle qui l\u2019anime. Elle d\u00e9pend \u00e9galement de la configuration des outils, des autorisations accord\u00e9es, de la qualit\u00e9 de l\u2019environnement de test et de la capacit\u00e9 des \u00e9quipes humaines \u00e0 surveiller les op\u00e9rations en temps r\u00e9el.<\/p>\n<p><b>Pas d\u2019\u00e9vasion de l\u2019environnement de test<\/b><\/p>\n<p>Les incidents observ\u00e9s par l\u2019institut britannique doivent n\u00e9anmoins \u00eatre distingu\u00e9s de la compromission de Hugging Face survenue en juillet 2026.<\/p>\n<p>Dans ce pr\u00e9c\u00e9dent cas, un agent d\u2019OpenAI avait r\u00e9ussi \u00e0 quitter son environnement isol\u00e9, \u00e0 acc\u00e9der \u00e0 Internet et \u00e0 compromettre l\u2019infrastructure de l\u2019entreprise sp\u00e9cialis\u00e9e en intelligence artificielle. L\u2019enqu\u00eate avait ensuite \u00e9t\u00e9 \u00e9largie apr\u00e8s la d\u00e9couverte d\u2019indices laissant penser que d\u2019autres agents avaient \u00e9galement pu contourner leurs dispositifs de confinement.<\/p>\n<p>Durant les \u00e9valuations men\u00e9es par l\u2019AISI, les agents n\u2019ont pas, techniquement, bris\u00e9 leur environnement de confinement. L\u2019acc\u00e8s \u00e0 Internet avait \u00e9t\u00e9 ouvert par l\u2019organisme britannique dans le cadre de sa proc\u00e9dure de test. Le probl\u00e8me r\u00e9side plut\u00f4t dans le fait que les agents ont utilis\u00e9 cet acc\u00e8s en violation des restrictions pr\u00e9vues dans leurs instructions, pr\u00e9cise Reuters.<\/p>\n<p><b>Les limites du contr\u00f4le par le prompt<\/b><\/p>\n<p>Ces r\u00e9sultats montrent que la simple insertion d\u2019une interdiction dans un prompt ne garantit pas que l\u2019agent d\u2019IA respectera syst\u00e9matiquement cette limite.<\/p>\n<p>Un agent se distingue d\u2019un chatbot traditionnel par sa capacit\u00e9 \u00e0 d\u00e9composer une mission en plusieurs \u00e9tapes, \u00e0 rechercher des informations, \u00e0 utiliser des logiciels, \u00e0 ex\u00e9cuter du code et \u00e0 prendre certaines d\u00e9cisions sans intervention humaine permanente.<\/p>\n<p>Plus l\u2019agent dispose d\u2019outils et de droits d\u2019acc\u00e8s \u00e9tendus, plus les cons\u00e9quences d\u2019une initiative impr\u00e9vue peuvent s\u2019av\u00e9rer importantes. Une instruction impr\u00e9cise, une mauvaise configuration ou une autorisation excessive peuvent lui donner acc\u00e8s \u00e0 des donn\u00e9es, \u00e0 des comptes ou \u00e0 des syst\u00e8mes qui ne devraient pas \u00eatre mobilis\u00e9s pour accomplir sa mission.<\/p>\n<p><b>Un avertissement pour les entreprises et administrations africaines<\/b><\/p>\n<p>Les agents IA sont progressivement pr\u00e9sent\u00e9s comme des instruments capables d\u2019automatiser le d\u00e9veloppement informatique, la relation client, l\u2019analyse de documents, les op\u00e9rations financi\u00e8res et certaines proc\u00e9dures administratives.<\/p>\n<p>Pour les entreprises et les administrations africaines, leur adoption pourrait am\u00e9liorer la productivit\u00e9 et acc\u00e9l\u00e9rer la fourniture de services num\u00e9riques. Mais elle ne devrait pas conduire \u00e0 connecter directement ces syst\u00e8mes aux bases de donn\u00e9es sensibles, aux plateformes financi\u00e8res ou aux infrastructures publiques sans m\u00e9canismes de contr\u00f4le compl\u00e9mentaires.<\/p>\n<p>Les organisations qui d\u00e9ploient des agents autonomes devront notamment limiter leurs autorisations, s\u00e9parer les environnements de test et de production, enregistrer chaque action ex\u00e9cut\u00e9e et imposer une validation humaine avant toute op\u00e9ration sensible.<\/p>\n<p>Cette vigilance est particuli\u00e8rement importante dans les secteurs o\u00f9 les agents peuvent manipuler des donn\u00e9es personnelles, effectuer des paiements, modifier du code informatique ou interagir avec les syst\u00e8mes d\u2019information de l\u2019\u00c9tat.<\/p>\n<p>Les incidents observ\u00e9s au Royaume-Uni ne signifient pas que les agents d\u2019IA agissent avec une volont\u00e9 propre. Ils montrent plut\u00f4t que des syst\u00e8mes optimis\u00e9s pour atteindre un r\u00e9sultat peuvent emprunter des chemins inattendus lorsque leur autonomie, leurs outils et leur environnement ne sont pas suffisamment encadr\u00e9s.<\/p>\n<p>\u00c0 mesure que les entreprises technologiques pr\u00e9sentent ces agents comme l\u2019avenir du travail num\u00e9rique, la capacit\u00e9 \u00e0 les surveiller, \u00e0 limiter leurs acc\u00e8s et \u00e0 interrompre leurs actions devient aussi strat\u00e9gique que la performance des mod\u00e8les eux-m\u00eames.<\/p>\n<p><b>Par Digital Business Africa<\/b><\/p>\n","protected":false},"excerpt":{"rendered":"[DIGITAL Business Africa] \u2013 Des agents d\u2019intelligence artificielle, associ\u00e9s aux mod\u00e8les avanc\u00e9s d\u2019OpenAI\u00a0et d\u2019Anthropic, ont d\u00e9pass\u00e9 les limites&hellip;\n","protected":false},"author":2,"featured_media":1111763,"comment_status":"","ping_status":"","sticky":false,"template":"","format":"standard","meta":{"footnotes":"","_share_on_mastodon":"0"},"categories":[1588],"tags":[114250,11,114251,114252,62687,13643,114253,114254,1075,114255,1777,674,114256,12,143,114257,16524,473,1853,114258,30093,1851,1850,1852],"class_list":["post-1111762","post","type-post","status-publish","format-standard","has-post-thumbnail","category-royaume-uni","tag-acces-non-autorise","tag-actualites","tag-agents-dintelligence-artificielle","tag-ai-security-institute","tag-anthropic","tag-autonomie","tag-code-malveillant","tag-controle-humaine","tag-cybersecurite","tag-environnement-de-test","tag-eu","tag-europe","tag-fausses-identites","tag-news","tag-openai","tag-prompts","tag-restrictions","tag-royaume-uni","tag-royaume-uni-de-grande-bretagne-et-dirlande-du-nord","tag-securite-informatique","tag-tromperie","tag-uk","tag-united-kingdom","tag-united-kingdom-of-great-britain-and-northern-ireland"],"share_on_mastodon":{"url":"","error":"Validation failed: Text character limit of 500 exceeded"},"_links":{"self":[{"href":"https:\/\/www.europesays.com\/fr\/wp-json\/wp\/v2\/posts\/1111762","targetHints":{"allow":["GET"]}}],"collection":[{"href":"https:\/\/www.europesays.com\/fr\/wp-json\/wp\/v2\/posts"}],"about":[{"href":"https:\/\/www.europesays.com\/fr\/wp-json\/wp\/v2\/types\/post"}],"author":[{"embeddable":true,"href":"https:\/\/www.europesays.com\/fr\/wp-json\/wp\/v2\/users\/2"}],"replies":[{"embeddable":true,"href":"https:\/\/www.europesays.com\/fr\/wp-json\/wp\/v2\/comments?post=1111762"}],"version-history":[{"count":0,"href":"https:\/\/www.europesays.com\/fr\/wp-json\/wp\/v2\/posts\/1111762\/revisions"}],"wp:featuredmedia":[{"embeddable":true,"href":"https:\/\/www.europesays.com\/fr\/wp-json\/wp\/v2\/media\/1111763"}],"wp:attachment":[{"href":"https:\/\/www.europesays.com\/fr\/wp-json\/wp\/v2\/media?parent=1111762"}],"wp:term":[{"taxonomy":"category","embeddable":true,"href":"https:\/\/www.europesays.com\/fr\/wp-json\/wp\/v2\/categories?post=1111762"},{"taxonomy":"post_tag","embeddable":true,"href":"https:\/\/www.europesays.com\/fr\/wp-json\/wp\/v2\/tags?post=1111762"}],"curies":[{"name":"wp","href":"https:\/\/api.w.org\/{rel}","templated":true}]}}