01Deux questions que l'on confond
Être cité et être consulté sont deux choses distinctes. Un assistant peut citer votre app à partir de ce qu'il a absorbé pendant son entraînement, sans jamais demander votre site. Il peut aussi consulter votre site au moment de répondre et ne pas vous citer pour autant. Mesurer l'un ne dit rien de l'autre, et la plupart des conseils sur le sujet les confondent sans le dire.
La première question, nous la mesurons et la publions déjà, zéros compris. Cette page traite de la seconde : sur une fenêtre fixe, quels crawlers ont réellement demandé des pages de ce domaine.
02Ce qui est arrivé, 14 jours jusqu'au 2026-09-21
| User agent | Opérateur | Rôle | Requêtes |
|---|---|---|---|
| Amazonbot | Amazon | index de recherche | 1140 |
| ClaudeBot | Anthropic | entraînement | 901 |
| Googlebot | index de recherche | 797 | |
| bingbot | Microsoft | index de recherche | 435 |
| Applebot | Apple | index de recherche | 121 |
| GPTBot | OpenAI | entraînement | 67 |
| PerplexityBot | Perplexity | réponse en direct | 10 |
| Bytespider | ByteDance | entraînement | 5 |
| OAI-SearchBot | OpenAI | réponse en direct | jamais |
| ChatGPT-User | OpenAI | réponse en direct | jamais |
| Claude-User | Anthropic | réponse en direct | jamais |
| CCBot | Common Crawl | entraînement | jamais |
| meta-externalagent | Meta | entraînement | jamais |
| Google-Extended | entraînement | jamais | |
| Perplexity-User | Perplexity | réponse en direct | jamais |
| Claude-SearchBot | Anthropic | réponse en direct | jamais |
| DuckAssistBot | DuckDuckGo | réponse en direct | jamais |
| MistralAI-User | Mistral | réponse en direct | jamais |
03Les agents de réponse d'OpenAI ne sont jamais venus. Celui de Perplexity, si.
Les opérateurs publient des agents distincts pour des tâches distinctes : l'un collecte des pages pour l'entraînement, un autre consulte une page pour répondre à une question en direct. Sur cette fenêtre, OAI-SearchBot, ChatGPT-User, Claude-User, Perplexity-User, Claude-SearchBot, DuckAssistBot et MistralAI-User ont enregistré zéro requête, dont les deux agents de réponse en direct d'OpenAI. PerplexityBot est bien venu, 10 fois.
La version honnête n'est donc pas « les assistants ne consultent jamais rien » : l'un d'eux le fait, à raison d'environ une requête par jour. Elle est plus étroite : pour ce domaine, sur cette fenêtre, aucun agent se présentant comme appartenant à OpenAI n'a consulté ce site pendant une réponse. Nous l'avons d'abord interprété comme « ChatGPT ne peut pas voir nos pages ». La section suivante explique pourquoi cette lecture était fausse.
L'objection évidente est que nous les avons bloqués. Ce n'est pas le cas : OAI-SearchBot, ChatGPT-User, Claude-User, Perplexity-User, Claude-SearchBot, DuckAssistBot, MistralAI-User sont chacun nommés dans notre robots.txt avec Allow: /, à côté des crawlers d'entraînement. Le zéro vient de leur comportement, pas de notre configuration : vérifiez votre propre fichier robots avant de prendre votre propre zéro pour une découverte.
04Zéro consultation, et ChatGPT nous a quand même mis en lien
Le 21 septembre 2026, nous avons demandé à ChatGPT, dans une conversation temporaire avec la mémoire désactivée, « free tool to check my iOS app's keyword ranking in the App Store ». Il a cité notre vérificateur de classement gratuit en deuxième position sur cinq et a mis un lien direct vers /tools/rank-check, avec utm_source=chatgpt.com ajouté. Notre propre journal de visites enregistrait des arrivées depuis chatgpt.com depuis deux semaines, dont deux ont ensuite créé un compte.
Le zéro du journal d'accès et la citation sont donc vrais en même temps. La réponse a été construite à partir d'un index de recherche que ChatGPT détenait déjà, pas d'une requête en direct d'un agent se présentant comme appartenant à OpenAI. Pour un propriétaire de site, la leçon est pratique : un zéro dans votre journal ne signifie pas que vous êtes invisible pour ChatGPT, et une citation ne signifie pas qu'il a lu votre page aujourd'hui.
Quel index ? Le centre d'aide d'OpenAI indique que la recherche ChatGPT « s'associe parfois à d'autres fournisseurs de recherche » et renvoie pour eux à la déclaration de confidentialité de Microsoft : c'est Bing. bingbot a demandé des pages ici 435 fois sur la fenêtre, toutes servies normalement ; pourtant le même jour, une recherche Bing sur le titre exact de notre comparatif d'outils gratuits ne renvoyait rien de ce domaine. Nous ne pouvons pas dire quel index a produit la citation ; nous pouvons dire que l'exploration et l'indexation sont deux étapes distinctes, et que c'est à la seconde qu'un nouveau site manque généralement.
05Un tiers du trafic des crawlers va vers les jumeaux en texte brut
Chaque page de ce site existe aussi en jumeau Markdown au format .md.txt, à côté de llms.txt et llms-full.txt. Sur la même fenêtre, les crawlers ont demandé ces jumeaux 788 fois sur 2244 requêtes IA au total, soit 35 % de tout ce qu'ils ont demandé. Les pages de contenu HTML en ont reçu 1083.
Nous avons construit cette couche en supposant qu'elle serait utilisée, sans preuve dans un sens ou dans l'autre. Elle est très utilisée : pas davantage que le HTML, mais dans le même ordre de grandeur, pour une couche qui ne coûte presque rien à publier. Au vu de ces éléments, elle n'est pas décorative.
06Ce que cela suggère de faire, et de ne pas faire
Ce qui vaut la peine
Publiez une copie propre en texte brut de vos pages, gardez une description factuelle de vous-même, et faites en sorte que les pages qui décrivent votre app soient celles qu'une exploration d'entraînement trouverait : des articles de tiers plus que votre propre marketing. Puis mesurez de nouveau dans un mois plutôt que de faire confiance au changement.
Entrez dans les index de recherche qu'empruntent les assistants. Vérifiez le site dans Bing Webmaster Tools comme dans Google Search Console et soumettez le sitemap aux deux : exploré ne veut pas dire indexé, et une page absente de l'index ne peut pas être récupérée pour une réponse. Cherchez ensuite les titres exacts de vos propres pages : c'est la vérification la moins chère qui soit.
Ce qui ne vaut pas la peine
Réécrire des pages chaque semaine pour courir après une consultation en direct qui n'a pas lieu. Acheter un outil qui promet d'« optimiser pour ChatGPT » sans vous dire si le moteur qu'il mesure demande un jour votre domaine. Et prendre une lecture isolée, la nôtre ou la vôtre, pour une tendance.
Questions fréquentes
ChatGPT visite-t-il mon site quand quelqu'un pose une question sur mon app ?
Parfois, et vous pouvez le vérifier au lieu de le supposer. OpenAI documente des agents distincts pour l'entraînement et pour la navigation au moment de la réponse ; ces derniers apparaissent nommément dans votre journal d'accès quand ils viennent. Sur notre propre fenêtre de mesure, ils ne sont jamais venus, et ChatGPT a quand même mis nos pages en lien, parce que sa réponse s'appuyait sur un index de recherche qu'il avait déjà plutôt que sur une visite en direct.
Bloquer les crawlers IA dans robots.txt est-il une bonne idée ?
Si vous voulez être cité dans les réponses des assistants, bloquer les crawlers d'entraînement va directement à l'encontre de cet objectif : c'est par eux que votre produit devient quelque chose que le modèle connaît. Bloquer est un choix raisonnable pour d'autres raisons, mais c'est un arbitrage, pas une précaution gratuite.
Les fichiers llms.txt et les copies Markdown des pages sont-ils vraiment lus ?
Sur ce domaine, beaucoup : 788 des 2244 requêtes de crawlers IA sont allées vers les jumeaux en texte brut sur la fenêtre mesurée, contre 1083 pour les pages HTML. C'est la preuve d'un seul site, pas une règle, mais leur publication ne coûte presque rien.
Peut-on truquer sa présence dans les réponses IA ?
Pas utilement. La réponse d'un assistant se construit à partir de ce qui a été écrit sur vous dans de nombreuses sources ; une page qui affirme que vous êtes le meilleur ne le devient pas pour autant. Ce qui la fait évoluer, c'est d'être décrit avec exactitude, ailleurs que sur votre propre domaine, dans la durée.
Vérifiez-le pour votre propre app
Collez le lien de votre app et ajoutez vos mots-clés. Position, apps au-dessus de vous et demande sont mesurées chaque jour.
Offre gratuite : 1 app, 25 mots-clés dans chacun de 2 storefronts, 30 jours d'historique, sans carte ni date de fin. Pro coûte 20 $/mois.
Commencer gratuitement →