---
title: "Les agents IA lisent-ils le Markdown ? Nos logs le disent"
description: "Notre site sert du Markdown aux agents IA. Deux semaines de logs, septembre 2026 : qui l'a demandé, qui l'a ignoré, et ce que ça change pour vos contenus."
canonical_url: "https://fr.goodbarber.com/blog/les-agents-ia-lisent-ils-le-markdown-ce-que-disent-deux-semaines-de-logs-de-notre-propre-serveur-a1452/"
lang: fr
date: 2026-09-22
last_updated: 2026-09-22
---

# Les agents IA lisent-ils le Markdown ? Nos logs le disent

[Retour](/blog/reussir-mon-app-r13/)

# Les agents IA lisent-ils le Markdown ? Ce que disent deux semaines de logs de notre propre serveur

Ecrit par [Dumè Siacci](https://fr.goodbarber.com/blog/author/dominique-siacci/)  le Mardi 22 Septembre 2026

## Début septembre 2026, nous avons donné à chaque page de notre propre portail commercial, que vous consultez actuellement, un jumeau Markdown : demandez-le et vous recevez la page en texte propre au lieu du HTML. Puis nous avons lu les logs. Les robots d'indexation l'ont pris, les agents de code l'ont demandé par son nom, et les assistants qui répondent aux questions des gens l'ont complètement ignoré. Voici ce que nous avons mesuré, daté, et ce que vous pouvez en retenir pour vos propres contenus.

![](https://cmsphoto.ww-cdn.com/superstatic/40142/art/grande/98103975-68313442.jpg?v=1790002424.5906937)

**Under the hood** — *l'ingénierie de GoodBarber, expliquée à ceux qui font tourner des apps.*

Précisons le cadre : tout ce qui suit s'est passé sur notre propre portail commercial, et c'est notre équipe qui l'a mis en place. Ce que nous avons appris sur les machines qui lisent les pages web vaut pour tous les contenus, les nôtres comme les vôtres.

**À retenir**, mesuré sur notre portail du 4 au 18 septembre 2026 :

- Les robots d'entraînement et d'indexation des entreprises d'IA (Amazon, Meta, OpenAI) ont lu les pages Markdown par le lien `.md` : environ 80 000 requêtes en deux semaines.
- Les agents de code, Claude Code en tête, demandent le Markdown par l'en-tête `Accept: text/markdown` et le reçoivent : environ 22 000 requêtes négociées, presque toutes de moteurs de réponse pour agents et de Claude Code.
- ChatGPT, Claude sur le web et Perplexity, quand ils répondent à une personne, ont chargé le HTML plus de 13 000 fois et le Markdown une seule fois.
- Le robot de Google n'a demandé aucune page Markdown.
- Le Markdown pèse environ 80 % de moins que la page HTML dont il vient.

## Pourquoi servir du Markdown aux agents IA

GoodBarber est une plateforme de création d'applications mobiles sans code ; goodbarber.com est son site commercial, en onze langues, avec des pages marketing, un blog et un centre d'aide. Quand quelqu'un demande à un assistant IA si GoodBarber peut construire l'app qu'il a en tête, l'assistant ne lit pas notre brochure. Il va chercher nos pages, parfois des milliers par jour, et en extrait une réponse à partir du HTML. Le HTML est lourd : menus, scripts, mise en page, bandeau de cookies. Le Markdown, c'est le texte de la page et rien d'autre. Le servir quand une machine le demande, c'est lui donner le vrai contenu, plus vite, pour une fraction du poids, avec moins de risques qu'elle se trompe sur nous.

En août 2026, Pierre-Laurent avait compté [qui lit notre llms.txt](https://dev.to/pierrelaurentmedori/llmstxt-in-the-wild-1321-requests-and-not-one-ai-assistant-came-looking-3205). Un llms.txt est un fichier texte placé à la racine d'un site, qui liste ses pages importantes à l'intention des systèmes d'IA : en quatre mois, aucun assistant n'était venu le chercher de lui-même. Les mêmes logs montraient autre chose : sur la même période, les assistants et leurs robots avaient chargé nos pages ordinaires 1,6 million de fois. Personne ne lit la carte ; tout le monde arpente les rues. La question n'était donc pas « comment leur faire lire l'index », mais « que leur donne-t-on quand ils arrivent ».

## Comment goodbarber.com sert du Markdown : négociation de contenu et URL .md

Deux portes, aucun contenu dupliqué. La première est la négociation de contenu, le mécanisme standard du web par lequel un client indique dans sa requête le format qu'il préfère recevoir : un client qui envoie l'en-tête `Accept: text/markdown` reçoit la version Markdown de n'importe quelle page publique, à la même adresse. La seconde est une adresse jumelle : un client qui ajoute `.md` à l'adresse d'une page, `/pricing.md`, `/blog/<article>.md`, reçoit la même chose. Cette page a elle-même son jumeau : ajoutez `.md` à son adresse. Chaque page HTML annonce son jumeau par un lien standard, comme elle annonce ses traductions. Le Markdown est généré à partir du HTML exact que la page sert déjà, il ne peut donc jamais dire quelque chose que la page ne dit pas, et il demande aux moteurs de recherche de ne pas l'indexer : la page HTML reste la seule présente dans Google.

Avant de l'activer, le test consistait à vérifier qu'un visiteur humain ne pouvait rien remarquer : réponses comparées octet par octet avec le jumeau activé et désactivé, sur tous les types de navigateurs auxquels nous avons pensé, identiques, pour un coût de quelques microsecondes par requête.

Nous n'avons rien inventé. [Cloudflare](https://blog.cloudflare.com/markdown-for-agents/) convertit les pages en Markdown à la bordure de son réseau depuis février 2026, [Zapier](https://zapier.com/pricing.md) et [Vercel](https://vercel.com/docs/agent-resources/markdown-access) servent les deux portes sur leurs propres sites. Si vous gérez un site web et voulez la même chose, c'est une journée de travail côté serveur, une bibliothèque de conversion, un cache, et un moyen de vérifier que rien n'a changé pour les humains. Ce que presque personne ne fait, c'est l'étape suivante : compter.

## Les robots d'indexation IA lisent-ils le Markdown ?

Du 4 au 18 septembre 2026, deux logs dédiés ont enregistré chaque requête d'une page Markdown, sur nos onze sites en langue, notre propre trafic retiré. Chaque « qui » ci-dessous est un nom déclaré, vérifié contre les adresses IP que son opérateur publie, comme l'avait fait Pierre-Laurent ; quand un opérateur ne publie rien, le nom reste déclaré.

Oui, et ce sont eux qui prennent le lien `.md` : environ 80 000 requêtes en deux semaines. La moitié vient des robots des entreprises d'IA, ceux qui constituent les jeux d'entraînement et les index de recherche : ceux d'Amazon, de Meta, d'OpenAI, tous depuis leurs adresses IP publiées. Les robots d'OpenAI trouvent la version `.md` parce que notre page HTML pointe vers elle : dans 99 cas sur 100, le même robot avait chargé la page HTML dans les dix minutes précédentes. Le robot de Bing est venu aussi, mais il a passé l'essentiel de sa visite sur nos pages de recherche interne, qui répondent à n'importe quelle requête tapée par n'importe qui. Le robot de Google, lui, n'a demandé aucune page Markdown.

## Les agents de code envoient-ils Accept: text/markdown ?

Oui, presque systématiquement. L'en-tête a reçu environ 22 000 requêtes, quatre fois moins que le lien, et d'un autre public. Presque tout vient de deux moteurs de recherche conçus pour les agents IA, ShapBot et ExaSearchBot, et d'un seul agent de code : Claude Code, l'outil que les développeurs, et d'autres, font tourner sur leur propre machine. Claude Code a envoyé l'en-tête sur pratiquement chacune de ses quelque 1 400 requêtes de page et a reçu du Markdown 98 fois sur 100, aux trois quarts sur notre centre d'aide. C'est cohérent avec ce que [Checkly avait mesuré en février 2026](https://www.checklyhq.com/blog/state-of-ai-agent-content-negotation/) : Claude Code, Cursor et OpenCode envoient l'en-tête ; Codex, Gemini CLI, Copilot et Windsurf ne l'envoient pas.

## ChatGPT, Claude et Perplexity chargent-ils le Markdown ?

Non, aucune des deux portes. C'est le chiffre sur lequel nous aurions parié faux. En deux semaines, les requêtes émises parce que quelqu'un posait une question à ChatGPT ont chargé plus de 10 000 de nos pages HTML et une seule page Markdown, trois minutes après la mise en ligne, très probablement l'un de nous en train de tester. Claude sur le web : environ 2 700 pages HTML, zéro Markdown. Perplexity : environ 900, zéro. Ils chargent la page HTML et font leur propre nettoyage. Rien de ce que nous servons n'y change quoi que ce soit.

Qui lit quoi, et pour quel usage :

| Agent (déclaré)                            | Ce qu'il fait de la page                                   | HTML | Lien `.md`                                    | En-tête `Accept`                     |
| ------------------------------------------ | ---------------------------------------------------------- | ---- | --------------------------------------------- | ------------------------------------ |
| Amazonbot, Meta-ExternalAgent              | collecte pour l'entraînement                               | oui  | oui, de lui-même                              | non                                  |
| ClaudeBot                                  | collecte pour l'entraînement                               | oui  | oui, environ quatre `.md` pour dix pages HTML | non                                  |
| GPTBot                                     | collecte pour l'entraînement                               | oui  | oui, en suivant le lien de notre page         | non                                  |
| OAI-SearchBot                              | construit l'index de recherche de ChatGPT                  | oui  | oui, en suivant le lien de notre page         | non                                  |
| PerplexityBot                              | construit l'index de Perplexity                            | oui  | non                                           | non                                  |
| Bingbot, Applebot, Baidu                   | index de recherche classique                               | oui  | oui (Bing surtout sur les pages de recherche) | non                                  |
| Googlebot                                  | index de recherche classique                               | oui  | non                                           | non                                  |
| ShapBot, ExaSearchBot                      | index pour les réponses des agents IA                      | oui  | non                                           | oui, sur presque chaque requête      |
| Claude Code                                | agent de code, à la demande                                | oui  | non                                           | oui, sur pratiquement chaque requête |
| ChatGPT-User, Claude-User, Perplexity-User | charge une page pour répondre à la question d'une personne | oui  | non (une requête en deux semaines)            | non                                  |

**Deux faits plus petits.** Le Markdown pèse environ 80 % de moins que la page HTML dont il vient, près de 85 % sur le centre d'aide. Et avant que nous servions le moindre Markdown, nos logs contenaient déjà environ 900 requêtes vers des adresses `.md` qui n'existaient pas, `README.md`, `agents.md`, `CLAUDE.md`, tentées par des outils qui s'attendent à ce qu'un site web soit un dépôt de code ; l'un d'eux avait deviné les adresses exactes que nous avons publiées un mois plus tard.

## Ce que ça change pour vos contenus

Trois choses, tirées de nos logs plutôt que des slides de qui que ce soit.

**Votre HTML est ce que lisent les assistants.** ChatGPT, Claude et Perplexity chargent la page qu'une personne voit. Une page propre, à jour et bien structurée, c'est ce qui leur parvient ; un jumeau Markdown, non, du moins pas aujourd'hui. Pierre-Laurent a écrit [comment corriger les contenus que les assistants citent](https://fr.goodbarber.com/blog/les-assistants-ia-se-trompent-sur-votre-entreprise-corrigez-le-contenu-qu-ils-citent-a1447/) quand ils se trompent sur votre activité ; ce travail porte sur le HTML, et c'est celui qui paie.

**Les robots suivent les liens que vous publiez.** Les robots d'OpenAI ont pris le lien `.md` parce que la page le leur proposait. Si vous indiquez une direction aux robots, ils la prennent. C'est aussi pour ça qu'un llms.txt vaut encore la peine : depuis que nos pages pointent vers lui, les robots d'OpenAI y arrivent depuis notre propre site, là où ils passaient auparavant par des annuaires tiers.

**Les agents de code demandent le Markdown par son nom.** Si les développeurs font partie de votre public, les agents qu'ils utilisent envoient `Accept: text/markdown` et se servent de ce qu'ils reçoivent. Notre centre d'aide est l'endroit où ils sont allés.

Si vous faites tourner une app GoodBarber, sa version web est déjà la page qu'un assistant peut charger et citer, et [GoodBarber MCP](https://fr.goodbarber.com/mcp/) permet à un assistant de vous aider à garder ce contenu à jour. Les pages que les assistants lisent réellement sont celles que vous publiez déjà.

## Questions fréquentes

**Est-ce que ça concerne les apps créées avec GoodBarber ?**

Pas directement : cet article parle de notre propre portail. Ce qui s'applique déjà à votre app, c'est la leçon : les assistants lisent la page HTML qu'une personne voit, donc garder ce contenu à jour est ce qui compte.

**Le site de GoodBarber est-il lisible par les agents IA ?**

Oui. Depuis septembre 2026, chaque page publique de goodbarber.com existe en Markdown, par l'en-tête `Accept: text/markdown` ou en ajoutant `.md` à son adresse, et chaque page HTML annonce cette version par un lien standard. Le site publie aussi un llms.txt et un llms-full.txt, régénérés chaque nuit à partir des pages, et chaque page y renvoie.

**Un agent IA peut-il travailler avec une app GoodBarber ?**

Oui, par GoodBarber MCP : un assistant comme Claude ou ChatGPT peut se connecter à votre app pour lire et modifier ses contenus, publier un article ou programmer une notification, avec votre validation. C'est un autre sujet que celui de cet article, et il est décrit sur la page GoodBarber MCP.

**Les assistants IA lisent-ils les versions Markdown des pages web ?**

Pas les assistants grand public, dans nos logs de septembre 2026. ChatGPT, Claude sur le web et Perplexity ont chargé nos pages HTML plus de 13 000 fois en deux semaines, et nos pages Markdown une fois. Les robots d'indexation et les agents de code, eux, ont utilisé le Markdown.

**Servir du Markdown aide-t-il pour Google ?**

Non, et ce n'est pas le but. Nos pages Markdown demandent aux moteurs de recherche de ne pas les indexer et renvoient vers la page HTML. Le robot de Google n'en a jamais demandé une.

**Faut-il ajouter un llms.txt à mon site ?**

Ça coûte peu, et les robots le lisent bien quand vos pages pointent vers lui. Dans nos logs, il est lu par des robots, des annuaires et des outils SEO, pas par les assistants qui répondent aux questions des gens.

![Dominique Siacci](https://blog.goodbarber.com/_public/profile/ca/ca3512f4dfa95a03169c5a670a4c91a19b3077b4-default.jpg)

À propos de l'auteur[Dominique Siacci](https://fr.goodbarber.com/blog/author/dominique-siacci/)CTO

Co-fondateur et CTO de GoodBarber. Je pilote la vision technique du produit : architecture, infrastructure, et plus récemment l'intégration de l'IA au cœur de la plateforme. Développeur dans l'âme, je reste proche du code et des choix d'ingénierie qui permettent à des milliers d'utilisateurs de GoodBarber de publier leurs apps sans écrire une ligne de code.

[En savoir plus](https://fr.goodbarber.com/blog/author/dominique-siacci/)

[![LinkedIn](https://portal.ww-cdn.com/portal_static/svg/base2021/linkedin.3ed8162e2a2b.svg)](https://fr.linkedin.com/in/dsiacci/)[![X](https://portal.ww-cdn.com/portal_static/svg/base2021/x.820492c586dd.svg)](https://twitter.com/dsiacci)[![Facebook](https://portal.ww-cdn.com/portal_static/svg/base2021/fb.be37c82b8283.svg)](https://www.facebook.com/dsiacci)
