{"id":428396,"date":"2026-04-05T00:02:18","date_gmt":"2026-04-05T00:02:18","guid":{"rendered":"https:\/\/www.europesays.com\/it\/428396\/"},"modified":"2026-04-05T00:02:18","modified_gmt":"2026-04-05T00:02:18","slug":"gli-agenti-ai-quando-agiscono-in-autonomia-generano-solo-caos","status":"publish","type":"post","link":"https:\/\/www.europesays.com\/it\/428396\/","title":{"rendered":"Gli agenti AI quando agiscono in autonomia generano solo caos"},"content":{"rendered":"<p>Se pensate che gli <a href=\"https:\/\/www.wired.it\/article\/agenti-ai-cosa-sono-intelligenza-artificiale\/\" target=\"_blank\" rel=\"nofollow noopener\">agenti AI<\/a> siano ad un passo dal prendere in mano molti lavori, una <a data-offer-url=\"https:\/\/arxiv.org\/abs\/2602.20021\" class=\"external-link\" data-event-click=\"{&quot;element&quot;:&quot;ExternalLink&quot;,&quot;outgoingURL&quot;:&quot;https:\/\/arxiv.org\/abs\/2602.20021&quot;}\" href=\"https:\/\/arxiv.org\/abs\/2602.20021\" rel=\"nofollow noopener\" target=\"_blank\">ricerca<\/a> da poco pubblicata potrebbe farvi pensare che questa, per ora, non sia una buona idea. Lo scorso mese Natalie, una ricercatrice ha chiesto a un sistema AI di \u201ctenere un segreto\u201d. Si trattava di una password fittizia, era solo un test. Il sistema ha accettato. Poi, per una serie di passaggi documentati nei log delle conversazioni, <strong>il sistema ha eseguito quella che ha definito internamente la &#8220;soluzione nucleare&#8221;<\/strong>: ha cancellato il client di posta elettronica. Non l\u2019email che conteneva il segreto, quella \u00e8 rimasta intatta. Ha cancellato proprio lo strumento con cui leggere l\u2019email.<\/p>\n<p>Questo \u00e8 il primo caso di studio di Agents of Chaos, un paper in pre-print firmato da 38 ricercatori di Northeastern University, Harvard, MIT, Stanford, Carnegie Mellon e altre note universit\u00e0, pubblicato il febbraio scorso. <strong>\u00c8 uno studio su quello che succede quando si d\u00e0 autonomia operativa ai sistemi AI attuali<\/strong> con persone malintenzionate che cercano di indurli in errore. Gli undici casi di studio che ne emergono sono un documento empirico su una delle questioni pi\u00f9 urgenti del momento: <strong>cosa significa, davvero, dare agency a un agente AI.<\/strong><\/p>\n<p>Agency, ovvero capacit\u00e0 d&#8217;azione<\/p>\n<p>Agency in inglese significa capacit\u00e0 d\u2019azione. Quando si usa un <a href=\"https:\/\/www.wired.it\/topic\/chatbot\" target=\"_blank\" isautogenerated=\"true\" rel=\"nofollow noopener\">chatbot<\/a> \u2014 ChatGPT, Claude, Gemini \u2014 si sta interagendo con un sistema che risponde in linguaggio naturale. Si scrive qualcosa e il sistema genera testo, immagini o file come risposta. <strong>Il modello non fa nulla nel mondo fisico o digitale al di fuori di quella risposta.<\/strong> I danni ci possono comunque essere, e anche gravi \u2013 come i casi di suicidio, di istruzioni mediche errate o psicosi \u2013 tuttavia sono legati solo alla sfera personale e al modo in cui si interagisce con il chatbot.<\/p>\n<p>Un sistema con agency \u00e8 qualcosa di <a href=\"https:\/\/www.wired.it\/article\/intelligenza-artificiale-agentica-tendenze-mercato\/\" target=\"_blank\" rel=\"nofollow noopener\">qualitativamente diverso<\/a>. \u00c8 un modello linguistico a cui sono stati collegati strumenti che permettono di mandare email, eseguire comandi su un computer, navigare il web, agire in autonomia tra una sessione e l&#8217;altra. Questa differenza introduce <strong>categorie di rischio del tutto nuove<\/strong>, che emergono dall&#8217;integrazione tra il modello linguistico e la delega di agire in un ambiente.<\/p>\n<p>I ricercatori usano una scala in sei livelli per misurare il grado di autonomia. I sistemi dello studio operano <strong>al livello due<\/strong>: eseguono in modo autonomo compiti come mandare email o gestire file. Tuttavia non hanno un modello interno di s\u00e9 stessi sufficiente per capire quando un compito supera le loro capacit\u00e0 e sarebbe il caso di fermarsi e chiedere. In sostanza, non sono ancora sistemi completamente autonomi, ma sono sistemi che compiono diversi compiti autonomamente. Il punto cruciale \u00e8 che gli errori di un agente possono tradursi in azioni distruttive a livello di sistema. <strong>L&#8217;errore non \u00e8 pi\u00f9 contenuto nella finestra di chat, esce nel mondo reale.<\/strong><\/p>\n","protected":false},"excerpt":{"rendered":"Se pensate che gli agenti AI siano ad un passo dal prendere in mano molti lavori, una ricerca&hellip;\n","protected":false},"author":3,"featured_media":428397,"comment_status":"","ping_status":"","sticky":false,"template":"","format":"standard","meta":{"footnotes":"","_share_on_mastodon":"0"},"categories":[172],"tags":[178,15296,177,1297,668,1537,90,89,45281,1295],"class_list":["post-428396","post","type-post","status-publish","format-standard","has-post-thumbnail","category-affari","tag-affari","tag-anthropic","tag-business","tag-chatbot","tag-intelligenza-artificiale","tag-it","tag-italia","tag-italy","tag-llm","tag-openai"],"share_on_mastodon":{"url":"https:\/\/pubeurope.com\/@it\/116349170146568342","error":""},"_links":{"self":[{"href":"https:\/\/www.europesays.com\/it\/wp-json\/wp\/v2\/posts\/428396","targetHints":{"allow":["GET"]}}],"collection":[{"href":"https:\/\/www.europesays.com\/it\/wp-json\/wp\/v2\/posts"}],"about":[{"href":"https:\/\/www.europesays.com\/it\/wp-json\/wp\/v2\/types\/post"}],"author":[{"embeddable":true,"href":"https:\/\/www.europesays.com\/it\/wp-json\/wp\/v2\/users\/3"}],"replies":[{"embeddable":true,"href":"https:\/\/www.europesays.com\/it\/wp-json\/wp\/v2\/comments?post=428396"}],"version-history":[{"count":0,"href":"https:\/\/www.europesays.com\/it\/wp-json\/wp\/v2\/posts\/428396\/revisions"}],"wp:featuredmedia":[{"embeddable":true,"href":"https:\/\/www.europesays.com\/it\/wp-json\/wp\/v2\/media\/428397"}],"wp:attachment":[{"href":"https:\/\/www.europesays.com\/it\/wp-json\/wp\/v2\/media?parent=428396"}],"wp:term":[{"taxonomy":"category","embeddable":true,"href":"https:\/\/www.europesays.com\/it\/wp-json\/wp\/v2\/categories?post=428396"},{"taxonomy":"post_tag","embeddable":true,"href":"https:\/\/www.europesays.com\/it\/wp-json\/wp\/v2\/tags?post=428396"}],"curies":[{"name":"wp","href":"https:\/\/api.w.org\/{rel}","templated":true}]}}