{"id":207218,"date":"2026-08-10T11:33:11","date_gmt":"2026-08-10T11:33:11","guid":{"rendered":"https:\/\/www.europesays.com\/be-fr\/207218\/"},"modified":"2026-08-10T11:33:11","modified_gmt":"2026-08-10T11:33:11","slug":"faut-il-sinquieter-des-ia-qui-sechappent-et-redouter-un-scenario-a-la-terminator","status":"publish","type":"post","link":"https:\/\/www.europesays.com\/be-fr\/207218\/","title":{"rendered":"Faut-il s&rsquo;inqui\u00e9ter des IA qui \u00ab\u00a0s&rsquo;\u00e9chappent\u00a0\u00bb et redouter un sc\u00e9nario \u00e0 la Terminator\u00a0?"},"content":{"rendered":"<p>Des IA sorties de leur \u00ab\u00a0bac \u00e0 sable\u00a0\u00bb<\/p>\n<p class=\"ap-StoryElement ap-StoryElement--mb ap-StoryText\">OpenAI et Anthropic soumettaient leurs mod\u00e8les \u00e0 des exercices offensifs dans des environnements contr\u00f4l\u00e9s. Leur objectif \u00e9tait de mesurer leur capacit\u00e9 \u00e0 trouver des vuln\u00e9rabilit\u00e9s et \u00e0 r\u00e9ussir des challenges informatiques.<\/p>\n<p class=\"ap-StoryElement ap-StoryElement--mb ap-StoryText\">Dans les deux cas, le confinement a \u00e9chou\u00e9, mais de mani\u00e8re diff\u00e9rente. Chez Anthropic, une mauvaise configuration avait laiss\u00e9 aux mod\u00e8les un acc\u00e8s \u00e0 Internet. Chez OpenAI, en revanche, les mod\u00e8les ne disposaient pas d&rsquo;un acc\u00e8s direct vers l&rsquo;ext\u00e9rieur : ils ont exploit\u00e9 une faille jusqu&rsquo;alors inconnue dans un syst\u00e8me interm\u00e9diaire pour sortir de l&rsquo;environnement isol\u00e9.<\/p>\n<p class=\"ap-StoryQuote-text\">\u00ab\u00a0C&rsquo;est comme dans les laboratoires o\u00f9 l&rsquo;on manipule des virus. Il faut diff\u00e9rentes couches de s\u00e9curit\u00e9.\u00a0\u00bb<\/p>\n<p class=\"ap-StoryElement ap-StoryElement--mb ap-StoryText\">Chez OpenAI, plusieurs mod\u00e8les ont ainsi exploit\u00e9 cette vuln\u00e9rabilit\u00e9, puis compromis une partie de l&rsquo;infrastructure de production de Hugging Face (plateforme new-yorkaise sp\u00e9cialis\u00e9e en IA et machine learning), o\u00f9 ils pensaient trouver des outils ou des informations utiles \u00e0 la r\u00e9solution de leur exercice.<\/p>\n<p class=\"ap-StoryElement ap-StoryElement--mb ap-StoryText\">Chez Anthropic, Claude a notamment attaqu\u00e9 une entreprise r\u00e9elle portant le m\u00eame nom que la soci\u00e9t\u00e9 fictive du sc\u00e9nario. Dans un autre cas, il a publi\u00e9 un paquet informatique contamin\u00e9 sur une plateforme publique, dans l&rsquo;objectif de forcer des employ\u00e9s (fictifs) \u00e0 le t\u00e9l\u00e9charger et ouvrir une br\u00e8che.<\/p>\n<p><a href=\"https:\/\/www.lalibre.be\/economie\/digital\/2026\/08\/08\/les-ia-commencent-elles-a-echapper-a-leurs-propres-garde-fous-UVZBWSLG35AC7HWXUBD7LLWVKI\/\" target=\"_self\" class=\"ap-StoryInterstitialLink ap-StoryElement ap-StoryElement--mb\" rel=\"nofollow noopener\">Les IA commencent-elles \u00e0 \u00e9chapper \u00e0 leurs propres garde-fous ?<\/a><\/p>\n<p class=\"ap-StoryElement ap-StoryElement--mb ap-StoryText\">Ces comportements sont interpellants, mais ils ne traduisent pas une volont\u00e9 d&rsquo;\u00e9chapper au contr\u00f4le humain. \u00ab\u00a0Ils ont utilis\u00e9 les moyens du bord pour r\u00e9ussir le challenge\u00a0\u00bb, r\u00e9sume Charles Cuvelliez, qui ne se veut pas alarmiste, mais tout de m\u00eame prudent. Les mod\u00e8les n&rsquo;ont donc pas chang\u00e9 d&rsquo;objectif en cours de route, ils ont juste cherch\u00e9 \u00e0 accomplir leur t\u00e2che sans comprendre clairement o\u00f9 s&rsquo;arr\u00eataient les limites du test.<\/p>\n<p class=\"ap-StoryElement ap-StoryElement--mb ap-StoryText\">\u00ab\u00a0On leur avait confi\u00e9 une t\u00e2che pr\u00e9cise dans un environnement suppos\u00e9ment contr\u00f4l\u00e9, une sorte de bac \u00e0 sable informatique (ou \u00ab\u00a0sandbox\u00a0\u00bb, terme r\u00e9guli\u00e8rement utilis\u00e9 par les informaticiens pour ces environnements, NdlR), mais ils sont all\u00e9s un peu plus loin\u00a0\u00bb, explique-t-il.<\/p>\n<p>Un \u00ab\u00a0marketing de la peur\u00a0\u00bb ?<\/p>\n<p class=\"ap-StoryElement ap-StoryElement--mb ap-StoryText\">La mani\u00e8re dont OpenAI et Anthropic pr\u00e9sentent ces incidents participe aussi \u00e0 une bataille d&rsquo;image. Il faut montrer que les mod\u00e8les sont assez puissants pour impressionner, montrer que les entreprises sont \u00e0 la pointe de la recherche en IA, quitte \u00e0 recourir \u00e0 un \u00ab\u00a0marketing de la peur\u00a0\u00bb pour marquer les esprits, tout en devant tout de m\u00eame rassurer sur leur capacit\u00e9 \u00e0 contr\u00f4ler ces IA.<\/p>\n<p><img loading=\"lazy\" decoding=\"async\" class=\"w-full lazyload lazyload--opacity object-contain\" style=\"aspect-ratio:150 \/ 100;opacity:1\" alt=\"FILE - Pages from the Anthropic website and the company's logo are displayed on a computer screen in New York on Feb. 26, 2026. (AP Photo\/Patrick Sison, File)\" width=\"768\" height=\"512\" fetchpriority=\"auto\" src=\"https:\/\/www.europesays.com\/be-fr\/wp-content\/uploads\/2026\/08\/1786361591_34_S5VKD3X55FFF3BW6V4SEHXNP7I.png\"  data- data-optimumx=\"1\"\/><img loading=\"lazy\" decoding=\"async\" src=\"https:\/\/www.europesays.com\/be-fr\/wp-content\/uploads\/2026\/08\/IBBKBAMHNFBZ3N3FWQQE3BKND4.jpg\" width=\"768\" height=\"512\" alt=\"FILE - Pages from the Anthropic website and the company's logo are displayed on a computer screen in New York on Feb. 26, 2026. (AP Photo\/Patrick Sison, File)\" class=\"absolute inset-0 w-full\"\/>Anthropic et OpenAI, entre autres, se livrent une concurrence forte. Sans parler des IA chinoises comme Deepseek. \u00a9Copyright 2026 The Associated Press. All rights reserved.<\/p>\n<p class=\"ap-StoryElement ap-StoryElement--mb ap-StoryText\">Anthropic a ainsi profit\u00e9 de l&rsquo;incident d&rsquo;OpenAI pour r\u00e9examiner plus de 140 000 tests et souligner que son mod\u00e8le le plus r\u00e9cent avait interrompu une attaque apr\u00e8s avoir compris que sa cible \u00e9tait r\u00e9elle. L&rsquo;entreprise se pr\u00e9sente donc \u00e0 la fois comme transparente, prudente et technologiquement avanc\u00e9e.<\/p>\n<p class=\"ap-StoryElement ap-StoryElement--mb ap-StoryText\">Mais rappelons que de vrais syst\u00e8mes ont \u00e9t\u00e9 compromis et certaines organisations n&rsquo;avaient pas d\u00e9tect\u00e9 les intrusions avant d&rsquo;\u00eatre averties.<\/p>\n<p>Les IA sont-elles dangereuses \u00e0 long terme ?<\/p>\n<p class=\"ap-StoryElement ap-StoryElement--mb ap-StoryText\">Pour Charles Cuvelliez, \u00ab\u00a0ces \u00e9v\u00e9nements n&rsquo;annoncent pas un sc\u00e9nario \u00e0 la Terminator\u00a0\u00bb. Sarah et John Connor peuvent souffler. Selon l&rsquo;expert, l&rsquo;IA n&rsquo;a pas de conscience ni d&rsquo;objectif personnel. Elle ne d\u00e9cide pas soudainement de d\u00e9truire un syst\u00e8me si personne ne lui a demand\u00e9 de le faire.<\/p>\n<p class=\"ap-StoryQuote-text\">\u00ab\u00a0Ces \u00e9v\u00e9nements n&rsquo;annoncent pas un sc\u00e9nario \u00e0 la Terminator\u00a0\u00bb<\/p>\n<p class=\"ap-StoryElement ap-StoryElement--mb ap-StoryText\">Le danger se situe plut\u00f4t dans son efficacit\u00e9. Contrairement \u00e0 un hacker humain, qui va tenter les voies de hacking les plus \u00ab\u00a0probables\u00a0\u00bb \u00e0 la r\u00e9ussite, un agent IA peut tester sans rel\u00e2che des pistes improbables, multiplier les tentatives et combiner diff\u00e9rentes vuln\u00e9rabilit\u00e9s jusqu&rsquo;\u00e0 trouver un acc\u00e8s.<\/p>\n<p class=\"ap-StoryElement ap-StoryElement--mb ap-StoryText\">Entre les mains d&rsquo;un pirate, il pourrait recevoir une consigne volontairement vague et chercher seul la meilleure mani\u00e8re de p\u00e9n\u00e9trer un r\u00e9seau. Il augmenterait ainsi fortement la vitesse et l&rsquo;ampleur des attaques.<\/p>\n<p><a href=\"https:\/\/www.lalibre.be\/economie\/digital\/2026\/07\/29\/lagent-incontrolable-dopenai-aurait-fait-une-autre-victime-IFP5QJM7CFHBVGXA7ADX5A36UY\/\" target=\"_self\" class=\"ap-StoryInterstitialLink ap-StoryElement ap-StoryElement--mb\" rel=\"nofollow noopener\">L&rsquo;agent \u00ab\u00a0incontr\u00f4lable\u00a0\u00bb d&rsquo;OpenAI aurait fait une autre victime<\/a><\/p>\n<p class=\"ap-StoryElement ap-StoryElement--mb ap-StoryText\">Mais la d\u00e9fense b\u00e9n\u00e9ficie des m\u00eames progr\u00e8s. Des agents sont d\u00e9j\u00e0 capables d&rsquo;analyser du code, de rep\u00e9rer des vuln\u00e9rabilit\u00e9s et de proposer des correctifs. La cybers\u00e9curit\u00e9 entre donc dans une course aux armements o\u00f9 attaquants et d\u00e9fenseurs utiliseront les m\u00eames technologies. Les p\u00e9riodes de \u00ab\u00a0r\u00e9pit\u00a0\u00bb risquent de diminuer, et les attaques cyber, industrialis\u00e9es \u00e0 un niveau jamais atteint jusque-l\u00e0 gr\u00e2ce aux IA, vont mettre une certaine tension sur les entreprises, comme le signalent bon nombre d&rsquo;experts depuis plusieurs ann\u00e9es.<\/p>\n<p>Le vrai probl\u00e8me : des environnements mal isol\u00e9s<\/p>\n<p class=\"ap-StoryElement ap-StoryElement--mb ap-StoryText\">Pour Charles Cuvelliez, la principale le\u00e7on est ailleurs : les entreprises IA ne savent pas encore parfaitement confiner des agents aussi performants.<\/p>\n<p class=\"ap-StoryElement ap-StoryElement--mb ap-StoryText\">Ces mod\u00e8les recevaient volontairement des missions offensives avec peu de restrictions. Dans ces conditions, la s\u00e9curit\u00e9 devait reposer sur un environnement totalement isol\u00e9. Or, chez OpenAI comme chez Anthropic, une seule faille ou erreur de configuration a suffi pour atteindre Internet.<\/p>\n<p class=\"ap-StoryQuote-text\">\u00ab\u00a0Il ne suffit pas simplement de d\u00e9brancher un c\u00e2ble internet ou d\u00e9sactiver le WiFi\u00a0\u00bb<\/p>\n<p class=\"ap-StoryElement ap-StoryElement--mb ap-StoryText\">\u00ab\u00a0C&rsquo;est plus difficile d&rsquo;isoler totalement (\u00ab\u00a0airgap\u00a0\u00bb, pour les plus avanc\u00e9s, NdlR) une machine qu&rsquo;on ne l&rsquo;imagine. Il ne suffit pas simplement de d\u00e9brancher un c\u00e2ble internet ou d\u00e9sactiver le WiFi, surtout lorsqu&rsquo;il y a recours \u00e0 des IA, qui n\u00e9cessitent des flux de communication. Toute la difficult\u00e9 consiste \u00e0 maintenir les connexions n\u00e9cessaires tout en bloquant celles qui pourraient \u00eatre exploit\u00e9es.\u00a0\u00bb, d\u00e9taille-t-il.<\/p>\n<p class=\"ap-StoryElement ap-StoryElement--mb ap-StoryText\">\u00ab\u00a0C&rsquo;est comme dans les laboratoires o\u00f9 l&rsquo;on manipule des virus. Il faut des sas, des salles \u00e0 diff\u00e9rents niveaux de pression (salles blanches par exemple, NdlR), diff\u00e9rentes couches de s\u00e9curit\u00e9, pour emp\u00eacher la moindre fuite d&rsquo;agents pathog\u00e8nes qui pourrait \u00eatre dramatique\u00a0\u00bb, \u00e9taie-t-il. Selon lui, les tests d&rsquo;IA devraient eux aussi pr\u00e9voir une v\u00e9ritable d\u00e9fense en profondeur : contr\u00f4le strict des connexions, surveillance continue, liste pr\u00e9cise des cibles autoris\u00e9es et arr\u00eat automatique en cas de comportement anormal.<\/p>\n<p><a href=\"https:\/\/www.lalibre.be\/economie\/entreprises-startup\/2026\/07\/22\/des-modeles-dopenai-createur-de-chatgpt-ont-pirate-une-entreprise-de-leur-propre-initiative-45MWICJOFRFYNOSDHUTSOETDGM\/\" target=\"_self\" class=\"ap-StoryInterstitialLink ap-StoryElement ap-StoryElement--mb\" rel=\"nofollow noopener\">\u00ab\u00a0Un cyberincident sans pr\u00e9c\u00e9dent\u00a0\u00bb : des mod\u00e8les d&rsquo;OpenAI ont pirat\u00e9 une entreprise de leur propre initiative<\/a><\/p>\n<p class=\"ap-StoryElement ap-StoryElement--mb ap-StoryText\">Il faut \u00e9galement fournir aux mod\u00e8les des consignes beaucoup plus claires. Si une IA est inform\u00e9e qu&rsquo;elle se trouve dans un environnement ferm\u00e9 alors qu&rsquo;elle peut acc\u00e9der \u00e0 Internet, elle peut logiquement consid\u00e9rer que tout ce qu&rsquo;elle atteint fait partie de l&rsquo;exercice. C&rsquo;est cela qui pourrait \u00eatre le plus inqui\u00e9tant.<\/p>\n<p class=\"ap-StoryElement ap-StoryElement--mb ap-StoryText\">\u00ab\u00a0Le danger vient plut\u00f4t d&rsquo;une consigne mal formul\u00e9e, d&rsquo;un objectif mal d\u00e9fini ou de garde-fous insuffisants. Plus on laisse de flou, plus le mod\u00e8le peut adopter des m\u00e9thodes inattendues pour obtenir le r\u00e9sultat demand\u00e9\u00a0\u00bb, explique Charles Cuvelliez.<\/p>\n<p class=\"ap-StoryElement ap-StoryElement--mb ap-StoryText\">Ces incidents ne montrent donc pas des machines qui se rebellent. Ils r\u00e9v\u00e8lent un d\u00e9calage entre les progr\u00e8s rapides des IA et notre capacit\u00e9 \u00e0 les tester en toute s\u00e9curit\u00e9, \u00e0 les monitorer. Le danger imm\u00e9diat est moins une intelligence artificielle anim\u00e9e de mauvaises intentions qu&rsquo;un outil extr\u00eamement efficace, lanc\u00e9 avec des instructions floues dans un laboratoire dont la porte ferme mal.<\/p>\n<p><img loading=\"lazy\" decoding=\"async\" class=\"w-full lazyload lazyload--opacity object-contain\" style=\"aspect-ratio:178 \/ 100;opacity:1\" alt=\"Arnold Scwharzenegger dans le r\u00f4le du T-800, robot tueur ou protecteur selon le volet, afin de sauver l'humanit\u00e9 des IA. Ici dans Terminator 2.\" width=\"768\" height=\"432\" fetchpriority=\"auto\" src=\"https:\/\/www.europesays.com\/be-fr\/wp-content\/uploads\/2026\/08\/1786361591_34_S5VKD3X55FFF3BW6V4SEHXNP7I.png\"  data- data-optimumx=\"1\"\/><img loading=\"lazy\" decoding=\"async\" src=\"https:\/\/www.europesays.com\/be-fr\/wp-content\/uploads\/2026\/08\/3AIHJNHNBJCGFG7MAT424RNDOI.jpg\" width=\"768\" height=\"432\" alt=\"Arnold Scwharzenegger dans le r\u00f4le du T-800, robot tueur ou protecteur selon le volet, afin de sauver l'humanit\u00e9 des IA. Ici dans Terminator 2.\" class=\"absolute inset-0 w-full\"\/>Arnold Scwharzenegger dans le r\u00f4le du T-800, robot tueur ou protecteur selon le volet, afin de sauver l&rsquo;humanit\u00e9 des IA. Ici dans Terminator 2. \u00a9Internet<\/p>\n","protected":false},"excerpt":{"rendered":"Des IA sorties de leur \u00ab\u00a0bac \u00e0 sable\u00a0\u00bb OpenAI et Anthropic soumettaient leurs mod\u00e8les \u00e0 des exercices offensifs&hellip;\n","protected":false},"author":2,"featured_media":207219,"comment_status":"","ping_status":"","sticky":false,"template":"","format":"standard","meta":{"footnotes":"","_share_on_mastodon":"0"},"categories":[35],"tags":[7085,33483,33484,12,13,18,17,38,37,36],"class_list":["post-207218","post","type-post","status-publish","format-standard","has-post-thumbnail","category-economie","tag-ai","tag-artificial-intelligence","tag-artificial-intelligenceai","tag-be","tag-be-fr","tag-belgique","tag-belgium","tag-business","tag-economie","tag-economy"],"share_on_mastodon":{"url":"https:\/\/pubeurope.com\/@be_fr\/117071000945052771","error":""},"_links":{"self":[{"href":"https:\/\/www.europesays.com\/be-fr\/wp-json\/wp\/v2\/posts\/207218","targetHints":{"allow":["GET"]}}],"collection":[{"href":"https:\/\/www.europesays.com\/be-fr\/wp-json\/wp\/v2\/posts"}],"about":[{"href":"https:\/\/www.europesays.com\/be-fr\/wp-json\/wp\/v2\/types\/post"}],"author":[{"embeddable":true,"href":"https:\/\/www.europesays.com\/be-fr\/wp-json\/wp\/v2\/users\/2"}],"replies":[{"embeddable":true,"href":"https:\/\/www.europesays.com\/be-fr\/wp-json\/wp\/v2\/comments?post=207218"}],"version-history":[{"count":0,"href":"https:\/\/www.europesays.com\/be-fr\/wp-json\/wp\/v2\/posts\/207218\/revisions"}],"wp:featuredmedia":[{"embeddable":true,"href":"https:\/\/www.europesays.com\/be-fr\/wp-json\/wp\/v2\/media\/207219"}],"wp:attachment":[{"href":"https:\/\/www.europesays.com\/be-fr\/wp-json\/wp\/v2\/media?parent=207218"}],"wp:term":[{"taxonomy":"category","embeddable":true,"href":"https:\/\/www.europesays.com\/be-fr\/wp-json\/wp\/v2\/categories?post=207218"},{"taxonomy":"post_tag","embeddable":true,"href":"https:\/\/www.europesays.com\/be-fr\/wp-json\/wp\/v2\/tags?post=207218"}],"curies":[{"name":"wp","href":"https:\/\/api.w.org\/{rel}","templated":true}]}}