{"id":206640,"date":"2026-08-09T22:17:14","date_gmt":"2026-08-09T22:17:14","guid":{"rendered":"https:\/\/www.europesays.com\/be-fr\/206640\/"},"modified":"2026-08-09T22:17:14","modified_gmt":"2026-08-09T22:17:14","slug":"on-vous-explique-le-rag-la-mecanique-invisible-derriere-chaque-source-citee-par-une-ia","status":"publish","type":"post","link":"https:\/\/www.europesays.com\/be-fr\/206640\/","title":{"rendered":"On vous explique le RAG : la m\u00e9canique invisible derri\u00e8re chaque source cit\u00e9e par une IA"},"content":{"rendered":"<p>Il y a encore trois ans, une IA qui citait ses sources tenait de l\u2019exception. Aujourd\u2019hui, c\u2019est presque devenu la norme. Entre les deux, l\u2019av\u00e8nement d\u2019une technique n\u00e9e dans un labo de recherche : le RAG.<\/p>\n<p>Ouvrez Claude, cliquez sur le petit bouton \u00ab + \u00bb \u00e0 c\u00f4t\u00e9 de la zone de texte.<\/p>\n<p>Recherche web, fichiers, connecteurs Google Drive, project knowledge : chacune de ces options fait, au fond, exactement la m\u00eame chose. Elle dit au mod\u00e8le \u00ab voici une source externe, va la consulter avant de r\u00e9pondre \u00bb.<\/p>\n<p>Cette m\u00e9canique a un nom : le RAG, pour Retrieval-Augmented Generation. <\/p>\n<p><a href=\"https:\/\/www.numerama.com\/wp-content\/uploads\/2026\/08\/capture-decran-2026-08-07-a-164513.png\" rel=\"nofollow noopener\" target=\"_blank\"><img decoding=\"async\" width=\"638\" height=\"632\" loading=\"lazy\" alt=\"Le RAG concerne tous les outils permettant de r\u00e9cup\u00e9rer des informations pour enrichir une r\u00e9ponse. \/\/ Source : Capture d'\u00e9cran Claude\" title=\"Le RAG concerne tous les outils permettant de r\u00e9cup\u00e9rer des informations pour enrichir une r\u00e9ponse. \/\/ Source : Capture d'\u00e9cran Claude\" class=\"wp-image-2308325 placeholder-default wp-image\" src=\"https:\/\/www.europesays.com\/be-fr\/wp-content\/uploads\/2026\/08\/capture-decran-2026-08-07-a-164513.png\" \/><img decoding=\"async\" width=\"638\" height=\"632\" loading=\"lazy\" alt=\"Le RAG concerne tous les outils permettant de r\u00e9cup\u00e9rer des informations pour enrichir une r\u00e9ponse. \/\/ Source : Capture d'\u00e9cran Claude\" title=\"Le RAG concerne tous les outils permettant de r\u00e9cup\u00e9rer des informations pour enrichir une r\u00e9ponse. \/\/ Source : Capture d'\u00e9cran Claude\" class=\"wp-image-2308325 placeholder-default wp-image\" src=\"https:\/\/www.europesays.com\/be-fr\/wp-content\/uploads\/2026\/08\/capture-decran-2026-08-07-a-164513.png\" \/><\/a>Le RAG concerne tout outil qui va chercher une information pour enrichir une r\u00e9ponse. \/\/ Source : Claude<\/p>\n<p>Cette appellation un peu barbare, on la doit, selon toute vraisemblance, <a rel=\"noopener nofollow\" target=\"_blank\" href=\"https:\/\/blogs.nvidia.com\/blog\/what-is-retrieval-augmented-generation\/\">\u00e0 un laboratoire londonien de Meta<\/a>, encore Facebook, \u00e0 l\u2019\u00e9poque. En 2020, Patrick Lewis, doctorant \u00e0 University College London, planche avec son \u00e9quipe sur un probl\u00e8me simple \u00e0 \u00e9noncer, complexe \u00e0 r\u00e9soudre : comment faire en sorte qu\u2019un mod\u00e8le de langage r\u00e9ponde avec des connaissances pr\u00e9cises, sans avoir \u00e0 tout stocker dans ses param\u00e8tres ?<\/p>\n<p>Le fruit de ce travail, <a rel=\"noopener nofollow\" target=\"_blank\" href=\"https:\/\/arxiv.org\/pdf\/2005.11401\">\u00ab Retrieval-Augmented Generation for Knowledge-Intensive NLP Tasks \u00bb<\/a>, publi\u00e9 le 12 avril 2021, propose de coupler un syst\u00e8me de g\u00e9n\u00e9ration de texte \u00e0 un index de r\u00e9cup\u00e9ration, de quoi produire n\u2019importe quelle r\u00e9ponse textuelle voulue, \u00e0 condition d\u2019aller la chercher au bon endroit.<\/p>\n<p>Le probl\u00e8me que le RAG est venu r\u00e9soudre<\/p>\n<p>Pour comprendre pourquoi cette probl\u00e9matique compte autant, il faut d\u2019abord comprendre la limite qu\u2019elle vise \u00e0 r\u00e9soudre. Un mod\u00e8le de langage (<a href=\"https:\/\/www.numerama.com\/tech\/2161859-quest-ce-quun-llm-large-language-model-et-comment-cela-fonctionne.html\" data-popover-target=\"definition\" data-tag=\"Qu\u2019est-ce qu\u2019un LLM (Large Language Model) et comment cela fonctionne\u00a0?\" data-chapo=\"L\u2019intelligence artificielle a pris un autre tournant avec les LLM. ChatGPT, Gemini ou encore Claude, ces LLM sont d\u00e9sormais des outils incontournables et ont chang\u00e9 notre mani\u00e8re d\u2019interagir avec la machine.\" data-image=\"https:\/\/c0.lestechnophiles.com\/www.numerama.com\/wp-content\/uploads\/2026\/01\/copie-de-ursaff-1024x576.jpg?key=b1f40ad8\" rel=\"nofollow noopener\" target=\"_blank\">LLM<\/a>) classique r\u00e9pond uniquement avec ce qu\u2019il a \u00ab en t\u00eate \u00bb, soit les connaissances fig\u00e9es au moment de son entra\u00eenement.<\/p>\n<p>Deux cons\u00e9quences directes en d\u00e9coulent. D\u2019une part, il ignore tout de ce qui s\u2019est pass\u00e9 apr\u00e8s sa date de coupure. D\u2019autre part, il n\u2019a strictement aucune id\u00e9e de vos documents priv\u00e9s, de la base de connaissances de votre entreprise, ou de l\u2019actualit\u00e9 du jour.<\/p>\n<p>Le RAG r\u00e9pond \u00e0 ce probl\u00e8me avec une id\u00e9e simple : au lieu de laisser le mod\u00e8le r\u00e9pondre seul, on lui donne d\u2019abord de quoi v\u00e9rifier. Un processus que l\u2019on peut r\u00e9sumer en trois \u00e9tapes, R.A.G :<\/p>\n<p>R\u00e9cup\u00e9ration. Quand vous posez une question, le syst\u00e8me ne l\u2019envoie pas directement au mod\u00e8le. Il va d\u2019abord chercher, dans une base de documents (un moteur de recherche web, une base interne, des PDF) les passages les plus pertinents par rapport \u00e0 votre requ\u00eate.<\/p>\n<p>Augmentation. Ces passages trouv\u00e9s sont inject\u00e9s dans le <a href=\"https:\/\/www.numerama.com\/tech\/1264452-au-fait-cest-quoi-un-prompt.html\" data-popover-target=\"definition\" data-tag=\"Au fait, c\u2019est quoi un prompt\u00a0?\" data-chapo=\"Un prompt d\u00e9signe une instruction, que l&#039;on envoie \u00e0 un algorithme d&#039;intelligence artificielle (IA) sp\u00e9cialis\u00e9e dans la g\u00e9n\u00e9ration de contenu -- comme du texte ou de l&#039;image.\" data-image=\"https:\/\/c0.lestechnophiles.com\/www.numerama.com\/wp-content\/uploads\/2023\/01\/chatgpt-2-1024x576.jpg?key=c8f73cca\" rel=\"nofollow noopener\" target=\"_blank\">prompt<\/a>, comme contexte, juste avant de soumettre votre question au chatbot.<\/p>\n<p>G\u00e9n\u00e9ration. Le mod\u00e8le r\u00e9dige sa r\u00e9ponse en s\u2019appuyant sur ces documents fournis, plut\u00f4t que sur sa seule m\u00e9moire interne.<\/p>\n<p>            Ce contenu est bloqu\u00e9 car vous n\u2019avez pas accept\u00e9 les cookies et autres traceurs. Ce contenu est fourni par YouTube.<br \/>Pour pouvoir le visualiser, vous devez accepter l\u2019usage \u00e9tant op\u00e9r\u00e9 par YouTube avec vos donn\u00e9es qui pourront \u00eatre utilis\u00e9es pour les finalit\u00e9s suivantes : vous permettre de visualiser et de partager des contenus avec des m\u00e9dias sociaux, favoriser le d\u00e9veloppement et l\u2019am\u00e9lioration des produits d\u2019Humanoid et de ses partenaires, vous afficher des publicit\u00e9s personnalis\u00e9es par rapport \u00e0 votre profil et activit\u00e9, vous d\u00e9finir un profil publicitaire personnalis\u00e9, mesurer la performance des publicit\u00e9s et du contenu de ce site et mesurer l\u2019audience de ce site <a href=\"#\" class=\"js-privacy\" target=\"_blank\">(en savoir plus)<\/a>        <\/p>\n<p>            En cliquant sur \u00ab J\u2019accepte tout \u00bb, vous consentez aux finalit\u00e9s susmentionn\u00e9es pour l\u2019ensemble des cookies et autres traceurs d\u00e9pos\u00e9s par Humanoid et ses partenaires.        <\/p>\n<p>            Vous gardez la possibilit\u00e9 de retirer votre consentement \u00e0 tout moment. Pour plus d\u2019informations, nous vous invitons \u00e0 prendre connaissance de notre <a href=\"https:\/\/www.numerama.com\/politique-cookies\" rel=\"nofollow noopener\" target=\"_blank\">Politique cookies<\/a>.        <\/p>\n<p>        J\u2019accepte tout    <\/p>\n<p class=\"embed-consent-overlay-manage-choices\">        G\u00e9rer mes choix    <\/p>\n<p>Le RAG \u00e0 l\u2019\u00e9preuve du r\u00e9el<\/p>\n<p>Pendant deux ans, le RAG reste une affaire de chercheurs. Le grand public en fait la d\u00e9couverte avec <a href=\"https:\/\/www.numerama.com\/tech\/1860136-perplexity-cest-quoi-on-vous-presente-le-moteur-de-recherche-plus-fort-que-google.html\" data-popover-target=\"definition\" data-tag=\"Perplexity, c\u2019est quoi\u00a0? On vous pr\u00e9sente le moteur de recherche plus fort que Google\" data-chapo=\"Fond\u00e9e en 2022, Perplexity est une sorte de fusion entre Google, ChatGPT et Wikip\u00e9dia. Le \u00ab\u00a0moteur de recherche IA \u00bb fait des recherches \u00e0 votre place, vous propose un r\u00e9sum\u00e9 exhaustif des pages lues et indique syst\u00e9matiquement ses sources. Il propose aussi un module \u00ab\u00a0Discover\u00a0\u00bb pour s&#039;informer avec l&#039;aide d&#039;une intelligence artificielle.\" data-image=\"https:\/\/c0.lestechnophiles.com\/www.numerama.com\/wp-content\/uploads\/2024\/12\/perplexity-ai-1024x576.jpg?key=9fa09cd1\" rel=\"nofollow noopener\" target=\"_blank\">Perplexity AI, lanc\u00e9 fin 2022<\/a>, dont toute la promesse repose sur cette m\u00e9canique : r\u00e9pondre avec des sources cliquables plut\u00f4t que des affirmations sorties de nulle part.<\/p>\n<p>Quelques mois plus tard, en f\u00e9vrier 2023, Microsoft g\u00e9n\u00e9ralise l\u2019approche \u00e0 l\u2019\u00e9chelle industrielle avec <a href=\"https:\/\/www.numerama.com\/tech\/1562042-microsoft-abandonne-bing-et-mise-sur-copilot-pour-battre-chatgpt.html\" data-type=\"link\" data-id=\"https:\/\/www.numerama.com\/tech\/1562042-microsoft-abandonne-bing-et-mise-sur-copilot-pour-battre-chatgpt.html\" rel=\"nofollow noopener\" target=\"_blank\">Bing Chat (devenu Copilot)<\/a>, qui couple GPT-4 \u00e0 une recherche web en temps r\u00e9el. Le RAG devient alors, en quelques mois, un standard que chaque grand acteur du secteur cherche \u00e0 int\u00e9grer.<\/p>\n<p>Car \u00e0 l\u2019\u00e9poque, le RAG tente \u00e9galement de r\u00e9pondre \u00e0 une probl\u00e9matique particuli\u00e8rement point\u00e9e du doigt dans les premi\u00e8res versions grand public des LLM : quand on lui demande une source pr\u00e9cise, un mod\u00e8le sans RAG g\u00e9n\u00e8re une r\u00e9ponse plausible \u00e0 partir de sa m\u00e9moire d\u2019entra\u00eenement, qui peut s\u2019av\u00e9rer floue, incompl\u00e8te, ou tout simplement fausse. Il produit alors une r\u00e9f\u00e9rence qui sonne cr\u00e9dible, sans jamais \u00eatre en mesure de justifier d\u2019o\u00f9 elle sort.<\/p>\n<p>Bien qu\u2019il limite ce risque d\u2019hallucination, le RAG n\u2019est pas pour autant un rem\u00e8de miracle. Le mod\u00e8le peut toujours mal interpr\u00e9ter un document, en d\u00e9former le sens ou m\u00e9langer plusieurs sources. Et la technique vient surtout ajouter un risque qui lui est propre : l\u2019\u00e9chec d\u00e8s l\u2019\u00e9tape de r\u00e9cup\u00e9ration. La recherche des passages pertinents reste probabiliste, et peut tout simplement rater la bonne information, sans que rien ne le signale. Le mod\u00e8le r\u00e9pond alors honn\u00eatement \u00e0 partir de ce qu\u2019on lui a transmis, un ph\u00e9nom\u00e8ne que les chercheurs <a href=\"https:\/\/arxiv.org\/pdf\/2511.04032\" data-type=\"link\" data-id=\"https:\/\/arxiv.org\/pdf\/2511.04032\" target=\"_blank\" rel=\"noreferrer noopener nofollow\">appellent la \u00ab silent failure \u00bb, l\u2019\u00e9chec silencieux<\/a>.<\/p>\n<p>L\u2019avenir du RAG<\/p>\n<p>Aujourd\u2019hui, le RAG est omnipr\u00e9sent, mais il ne repr\u00e9sente plus la solution unique pour \u00e9largir le contexte d\u2019un LLM. Le proc\u00e9d\u00e9 s\u2019est impos\u00e9 \u00e0 une \u00e9poque o\u00f9 les mod\u00e8les ne pouvaient ing\u00e9rer que quelques milliers de mots \u00e0 la fois. Depuis, les fen\u00eatres de contexte ont explos\u00e9 : certains mod\u00e8les avalent aujourd\u2019hui plusieurs centaines de milliers de mots d\u2019un coup.<\/p>\n<p>De quoi questionner <a href=\"https:\/\/www.youtube.com\/watch?v=UabBYexBD4k\" data-type=\"link\" data-id=\"https:\/\/www.youtube.com\/watch?v=UabBYexBD4k\" target=\"_blank\" rel=\"noreferrer noopener nofollow\">l\u2019utilit\u00e9 m\u00eame du RAG ?<\/a> Pas tout \u00e0 fait. Le proc\u00e9d\u00e9 garde l\u2019avantage sur les donn\u00e9es massives et reste plus \u00e9conome. Surtout, il demeure incontournable d\u00e8s qu\u2019il s\u2019agit d\u2019actualit\u00e9 ou de recherche web : aucune fen\u00eatre de contexte, aussi vaste soit-elle, ne peut contenir \u00e0 l\u2019avance une information qui n\u2019existe pas encore au moment o\u00f9 le mod\u00e8le r\u00e9pond.<\/p>\n<p>            <img decoding=\"async\" src=\"https:\/\/www.europesays.com\/be-fr\/wp-content\/uploads\/2026\/08\/1786313834_359_iPhone-16-pro-vDJtn9o4_vzSsPIGCFDc5.png\" alt=\"Toute l'actu tech en un clien d'oeil\"\/><\/p>\n<p class=\"card-install-pwa__title\">Toute l&rsquo;actu tech en un clin d&rsquo;\u0153il<\/p>\n<p class=\"card-install-pwa__description\">Ajoutez Numerama \u00e0 votre \u00e9cran d&rsquo;accueil et restez connect\u00e9s au futur !<\/p>\n<p>            <img decoding=\"async\" src=\"https:\/\/www.numerama.com\/wp-content\/themes\/numerama-next\/dist\/images\/premium\/logo-card-pwa-coupe-vCvPQ_Q_ysBNfqKp6w7gG.svg\" alt=\"Logo PWA\"\/><\/p>\n<p>       Installer Numerama<\/p>\n","protected":false},"excerpt":{"rendered":"Il y a encore trois ans, une IA qui citait ses sources tenait de l\u2019exception. Aujourd\u2019hui, c\u2019est presque&hellip;\n","protected":false},"author":2,"featured_media":206641,"comment_status":"","ping_status":"","sticky":false,"template":"","format":"standard","meta":{"footnotes":"","_share_on_mastodon":"0"},"categories":[70],"tags":[12,13,18,17,452,63761,73,71,75,72,76,74],"class_list":["post-206640","post","type-post","status-publish","format-standard","has-post-thumbnail","category-sciences-et-technologies","tag-be","tag-be-fr","tag-belgique","tag-belgium","tag-ia-generative","tag-llm-large-language-model","tag-science","tag-science-and-technology","tag-sciences","tag-sciences-et-technologies","tag-technologies","tag-technology"],"share_on_mastodon":{"url":"https:\/\/pubeurope.com\/@be_fr\/117067870750936165","error":""},"_links":{"self":[{"href":"https:\/\/www.europesays.com\/be-fr\/wp-json\/wp\/v2\/posts\/206640","targetHints":{"allow":["GET"]}}],"collection":[{"href":"https:\/\/www.europesays.com\/be-fr\/wp-json\/wp\/v2\/posts"}],"about":[{"href":"https:\/\/www.europesays.com\/be-fr\/wp-json\/wp\/v2\/types\/post"}],"author":[{"embeddable":true,"href":"https:\/\/www.europesays.com\/be-fr\/wp-json\/wp\/v2\/users\/2"}],"replies":[{"embeddable":true,"href":"https:\/\/www.europesays.com\/be-fr\/wp-json\/wp\/v2\/comments?post=206640"}],"version-history":[{"count":0,"href":"https:\/\/www.europesays.com\/be-fr\/wp-json\/wp\/v2\/posts\/206640\/revisions"}],"wp:featuredmedia":[{"embeddable":true,"href":"https:\/\/www.europesays.com\/be-fr\/wp-json\/wp\/v2\/media\/206641"}],"wp:attachment":[{"href":"https:\/\/www.europesays.com\/be-fr\/wp-json\/wp\/v2\/media?parent=206640"}],"wp:term":[{"taxonomy":"category","embeddable":true,"href":"https:\/\/www.europesays.com\/be-fr\/wp-json\/wp\/v2\/categories?post=206640"},{"taxonomy":"post_tag","embeddable":true,"href":"https:\/\/www.europesays.com\/be-fr\/wp-json\/wp\/v2\/tags?post=206640"}],"curies":[{"name":"wp","href":"https:\/\/api.w.org\/{rel}","templated":true}]}}