{"id":118183,"date":"2026-05-25T09:55:10","date_gmt":"2026-05-25T09:55:10","guid":{"rendered":"https:\/\/www.europesays.com\/be-fr\/118183\/"},"modified":"2026-05-25T09:55:10","modified_gmt":"2026-05-25T09:55:10","slug":"anthropic-veut-amener-claude-a-un-niveau-de-perpetuelle-autonomie","status":"publish","type":"post","link":"https:\/\/www.europesays.com\/be-fr\/118183\/","title":{"rendered":"Anthropic veut amener Claude \u00e0 un niveau de perp\u00e9tuelle autonomie"},"content":{"rendered":"<p class=\"app_entry_lead\">\n                                        Et si l&rsquo;IA pouvait coder, corriger ses propres erreurs et travailler des jours sans supervision\u00a0? C&rsquo;est le cap que vise Anthropic. En marge de Code with Claude, sa conf\u00e9rence d\u00e9veloppeurs \u00e0 Londres, le JDN a interrog\u00e9 Angela Jiang et Katelyn Lesse, head of product et head of engineering de la Claude Platform.<\/p>\n<p>            Je m\u2019abonne aux Infos \u00e0 ne pas rater<\/p>\n<p>                <img decoding=\"async\" alt=\"\" src=\"https:\/\/www.europesays.com\/be-fr\/wp-content\/uploads\/2026\/05\/39538683.jpg\"\/><br \/>\n\u00a9\u00a0Anthropic \/ Montage JDN<\/p>\n<p>JDN. Claude Code, Cowork, l&rsquo;app desktop : vous multipliez les produits qui semblent se recouper. Quelle est la logique de cette segmentation plut\u00f4t qu&rsquo;un outil unifi\u00e9 ?<\/p>\n<p>Angela Jiang. Tous les produits que vous mentionnez utilisent Claude. A bien des \u00e9gards, on pourrait les voir ainsi\u00a0: je ne dirais pas exactement que ce sont des wrappers, mais ils reposent tous sur des harness l\u00e9g\u00e8rement diff\u00e9rents et des interfaces l\u00e9g\u00e8rement diff\u00e9rentes, parce qu&rsquo;ils sont con\u00e7us pour des cas d&rsquo;usage distincts. Le point commun entre eux, au-del\u00e0 du mod\u00e8le, c&rsquo;est la plateforme sur laquelle ils sont construits : ils fonctionnent sur un ensemble commun de tool APIs, de harness, etc. Ce qui change d&rsquo;un produit \u00e0 l&rsquo;autre, ce sont les system prompts, optimis\u00e9s pour des usages diff\u00e9rents et associ\u00e9s \u00e0 des outils diff\u00e9rents.<\/p>\n<p>L&rsquo;intention, pour beaucoup de ces produits, c&rsquo;est d&rsquo;offrir le bon form factor \u00e0 chaque type d&rsquo;utilisateurs qui nous tient \u00e0 c\u0153ur. Claude Code, c&rsquo;est \u00e9videmment d&rsquo;abord pour les ing\u00e9nieurs. Cowork, c&rsquo;est pour les non-ing\u00e9nieurs, m\u00eame si les ing\u00e9nieurs peuvent bien s\u00fbr l&rsquo;utiliser. Mais utiliser un terminal, ce n&rsquo;est pas forc\u00e9ment simple. Chacun de ces produits est donc un form factor diff\u00e9rent au-dessus de Claude, pens\u00e9 pour r\u00e9pondre aux besoins de ses utilisateurs.<\/p>\n<p>Quelle est la diff\u00e9rence d\u2019usage entre Claude Code en CLI et Claude Code dans l&rsquo;application desktop ?<\/p>\n<p>Katelyn Lesse. La diff\u00e9rence, c&rsquo;est que Claude Code en CLI tourne localement sur votre ordinateur : il manipule les fichiers directement sur votre machine. Avec l&rsquo;application desktop, c&rsquo;est pareil, mais vous pouvez en plus envoyer des agents distants pour aller travailler. Dans ce cas, on lance en arri\u00e8re-plan des sandboxes qui ex\u00e9cutent le travail en dehors de votre machine locale, ce qui vous permet de reprendre la main plus tard. C&rsquo;est vraiment \u00e7a, la diff\u00e9rence : l&rsquo;application desktop vous laisse faire les deux, mais l&rsquo;id\u00e9e de fond, c&rsquo;est la distinction entre ex\u00e9cution locale et ex\u00e9cution distante.<\/p>\n<p>Vous lancez de nombreux nouveaux outils et fonctionnalit\u00e9s chaque semaine, voire chaque jour. Comment votre \u00e9quipe parvient-elle \u00e0 d\u00e9livrer \u00e0 un tel rythme ?<\/p>\n<p>Katelyn Lesse. Notre \u00e9quipe est tr\u00e8s AI-pilled (convaincue par l&rsquo;IA au point d&rsquo;en faire une grille de lecture quotidienne, ndlr). Nous sommes tous vraiment port\u00e9s sur la construction de solutions pour nous-m\u00eames, sur l&rsquo;utilisation de nos propres outils et sur le fait de repousser les limites de ce que ces technologies peuvent r\u00e9ellement accomplir. Et il existe tout un spectre.<\/p>\n<p>A une extr\u00e9mit\u00e9, vous avez les ing\u00e9nieurs qui d\u00e9butent peut-\u00eatre tout juste : ils promptent Claude pour corriger un bug, il se trompe, et ils font des allers-retours. A l&rsquo;autre extr\u00e9mit\u00e9, vous avez ceux qui lancent des dizaines, voire des centaines d&rsquo;agents en m\u00eame temps. Et si vous en arrivez l\u00e0, c&rsquo;est que vous avez consacr\u00e9 beaucoup de temps et d&rsquo;\u00e9nergie \u00e0 mettre en place la bonne configuration : de tr\u00e8s bons tests, une vraie capacit\u00e9 \u00e0 entrer dans une boucle d&rsquo;auto-v\u00e9rification, parce que vous pouvez vous tester dans le bon environnement. Une grande partie de notre rythme tient donc \u00e0 \u00e7a : nos \u00e9quipes ont vraiment pouss\u00e9 jusqu&rsquo;au bout de ce spectre, l\u00e0 o\u00f9 vous automatisez et repoussez les limites autant que possible.<\/p>\n<p>Sur quelles capacit\u00e9s fronti\u00e8res travaillez-vous en ce moment ? Beaucoup \u00e9voquent le contexte infini, les agents en autonomie continue&#8230; Quel est votre roadmap ?<\/p>\n<p>Angela Jiang. Nous allons continuer \u00e0 repousser les limites pour devenir vraiment bons dans la gestion du contexte. C&rsquo;est une sorte de chantier permanent. On continue aussi de progresser sur l&rsquo;autonomie : vous nous avez \u00e9videmment entendus le faire avec chaque mod\u00e8le, et on veut amener Claude au point o\u00f9 il est, litt\u00e9ralement, perp\u00e9tuellement autonome.<\/p>\n<p>Il y a ensuite quelques autres capacit\u00e9s auxquelles on pr\u00eate attention. Le computer use, par exemple. Pour revenir au principe de base, on veut que Claude soit utile, productif et serviable. Le computer use est tr\u00e8s utile, surtout dans les entreprises qui ont des UI complexes, parfois grossi\u00e8res, que vous ne pouvez tout simplement pas automatiser. Si Claude est assez malin pour s&rsquo;en charger, c&rsquo;est formidable. Je tiens beaucoup \u00e0 ces interfaces vraiment obscures : pensez aux terminaux Bloomberg, habituellement tr\u00e8s sophistiqu\u00e9s et difficiles \u00e0 manier, ou aux syst\u00e8mes EHR. Ce sont des environnements tr\u00e8s complexes, et on am\u00e8ne l&rsquo;IA \u00e0 devenir de plus en plus performante l\u00e0-dessus, tout en la rendant plus rapide.<\/p>\n<p>Le dernier volet concerne la capacit\u00e9 de Claude \u00e0 se sortir d&rsquo;affaire seul : apprendre de ses erreurs, devenir de plus en plus apte \u00e0 les g\u00e9rer. Cela peut s&rsquo;appuyer sur diff\u00e9rentes primitives, comme la m\u00e9moire. Il existe plusieurs m\u00e9canismes pour y parvenir, mais \u00e0 plus grande \u00e9chelle, le fait que Claude puisse en quelque sorte auto-apprendre et s&rsquo;am\u00e9liorer est aussi vraiment cl\u00e9.<\/p>\n<p>Pour atteindre ces nouvelles capacit\u00e9s, avez-vous besoin de davantage de compute ?<\/p>\n<p>Angela Jiang. Nous avons presque toujours besoin de davantage de compute, oui. Mais une partie des gains peut s&rsquo;obtenir au niveau du harness, sans surco\u00fbt d&rsquo;infrastructure. Sur nos deux derni\u00e8res g\u00e9n\u00e9rations de mod\u00e8les, nous avons constat\u00e9 qu&rsquo;un mod\u00e8le performant, coupl\u00e9 \u00e0 un harness bien con\u00e7u, permet d&rsquo;extraire bien plus de valeur de cette couche logicielle qu&rsquo;on ne l&rsquo;imagine g\u00e9n\u00e9ralement. Historiquement, le rapport \u00e9tait d\u00e9favorable : pour un mod\u00e8le donn\u00e9, il fallait investir massivement dans le harness pour n&rsquo;en retirer qu&rsquo;un b\u00e9n\u00e9fice marginal. La dynamique s&rsquo;est invers\u00e9e. A mesure que les mod\u00e8les montent en puissance, un harness de dimension interm\u00e9diaire suffit : d\u00e8s lors qu&rsquo;il est bien construit, le gain de performance devient nettement sup\u00e9rieur. C&rsquo;est une propri\u00e9t\u00e9 particuli\u00e8rement int\u00e9ressante que nous avons mise en \u00e9vidence.<\/p>\n<p>Au-del\u00e0 du volet cyber qui justifie son confinement, Mythos est un mod\u00e8le g\u00e9n\u00e9raliste largement plus puissant qu&rsquo;Opus. Quelles nouvelles capacit\u00e9s apportera-t-il aux entreprises?<\/p>\n<p>Angela Jiang. Mythos s&rsquo;inscrit dans la continuit\u00e9 de nos travaux sur Claude. Deux points ressortent : son endurance, avec notre meilleur r\u00e9sultat \u00e0 ce jour sur le benchmark METR, qui confirme notre focalisation sur l&rsquo;autonomie ; et ses performances excellentes en coding.<\/p>\n","protected":false},"excerpt":{"rendered":"Et si l&rsquo;IA pouvait coder, corriger ses propres erreurs et travailler des jours sans supervision\u00a0? C&rsquo;est le cap&hellip;\n","protected":false},"author":2,"featured_media":118184,"comment_status":"","ping_status":"","sticky":false,"template":"","format":"standard","meta":{"footnotes":"","_share_on_mastodon":"0"},"categories":[70],"tags":[42038,12,13,18,17,42037,435,466,452,451,470,73,71,75,72,76,74],"class_list":["post-118183","post","type-post","status-publish","format-standard","has-post-thumbnail","category-sciences-et-technologies","tag-acteurs-de-l-ia","tag-be","tag-be-fr","tag-belgique","tag-belgium","tag-cms-journaldunet-1550545","tag-controller-content","tag-format-papier","tag-ia-generative","tag-intelligence-artificielle","tag-parallaxeinfeed","tag-science","tag-science-and-technology","tag-sciences","tag-sciences-et-technologies","tag-technologies","tag-technology"],"share_on_mastodon":{"url":"https:\/\/pubeurope.com\/@be_fr\/116634617647115651","error":""},"_links":{"self":[{"href":"https:\/\/www.europesays.com\/be-fr\/wp-json\/wp\/v2\/posts\/118183","targetHints":{"allow":["GET"]}}],"collection":[{"href":"https:\/\/www.europesays.com\/be-fr\/wp-json\/wp\/v2\/posts"}],"about":[{"href":"https:\/\/www.europesays.com\/be-fr\/wp-json\/wp\/v2\/types\/post"}],"author":[{"embeddable":true,"href":"https:\/\/www.europesays.com\/be-fr\/wp-json\/wp\/v2\/users\/2"}],"replies":[{"embeddable":true,"href":"https:\/\/www.europesays.com\/be-fr\/wp-json\/wp\/v2\/comments?post=118183"}],"version-history":[{"count":0,"href":"https:\/\/www.europesays.com\/be-fr\/wp-json\/wp\/v2\/posts\/118183\/revisions"}],"wp:featuredmedia":[{"embeddable":true,"href":"https:\/\/www.europesays.com\/be-fr\/wp-json\/wp\/v2\/media\/118184"}],"wp:attachment":[{"href":"https:\/\/www.europesays.com\/be-fr\/wp-json\/wp\/v2\/media?parent=118183"}],"wp:term":[{"taxonomy":"category","embeddable":true,"href":"https:\/\/www.europesays.com\/be-fr\/wp-json\/wp\/v2\/categories?post=118183"},{"taxonomy":"post_tag","embeddable":true,"href":"https:\/\/www.europesays.com\/be-fr\/wp-json\/wp\/v2\/tags?post=118183"}],"curies":[{"name":"wp","href":"https:\/\/api.w.org\/{rel}","templated":true}]}}