01Duas perguntas que se confundem
Ser citado e ser buscado são coisas separadas. Um assistente pode citar o seu app pelo que absorveu no treinamento, sem nunca fazer uma requisição ao seu site. Ele também pode buscar o seu site na hora da resposta e mesmo assim não citar você. Medir uma coisa não diz nada sobre a outra, e a maioria dos conselhos sobre o assunto mistura as duas em silêncio.
A primeira pergunta nós já medimos e publicamos, incluindo os zeros. Esta página é a segunda: numa janela fixa, quais crawlers de fato pediram páginas deste domínio.
02O que chegou, 14 dias até 2026-09-21
| User agent | Operador | Função | Requisições |
|---|---|---|---|
| Amazonbot | Amazon | índice de busca | 1140 |
| ClaudeBot | Anthropic | treinamento | 901 |
| Googlebot | índice de busca | 797 | |
| bingbot | Microsoft | índice de busca | 435 |
| Applebot | Apple | índice de busca | 121 |
| GPTBot | OpenAI | treinamento | 67 |
| PerplexityBot | Perplexity | hora da resposta | 10 |
| Bytespider | ByteDance | treinamento | 5 |
| OAI-SearchBot | OpenAI | hora da resposta | nunca |
| ChatGPT-User | OpenAI | hora da resposta | nunca |
| Claude-User | Anthropic | hora da resposta | nunca |
| CCBot | Common Crawl | treinamento | nunca |
| meta-externalagent | Meta | treinamento | nunca |
| Google-Extended | treinamento | nunca | |
| Perplexity-User | Perplexity | hora da resposta | nunca |
| Claude-SearchBot | Anthropic | hora da resposta | nunca |
| DuckAssistBot | DuckDuckGo | hora da resposta | nunca |
| MistralAI-User | Mistral | hora da resposta | nunca |
03Os agentes de resposta da OpenAI nunca chegaram. O da Perplexity, sim.
Os operadores publicam agentes separados para trabalhos separados: um que coleta páginas para treinamento, outro que busca uma página enquanto responde a uma pergunta ao vivo. Nesta janela, OAI-SearchBot, ChatGPT-User, Claude-User, Perplexity-User, Claude-SearchBot, DuckAssistBot e MistralAI-User registraram zero requisições — os dois agentes de resposta da OpenAI entre eles. O PerplexityBot chegou, 10 vezes.
Então a versão honesta não é "os assistentes nunca buscam" — um deles busca, num volume de cerca de uma requisição por dia. É mais estreita que isso: para este domínio, nesta janela, nenhum agente que se identifica como da OpenAI buscou este site enquanto respondia. No início lemos isso como "o ChatGPT não consegue ver as nossas páginas". A próxima seção explica por que essa leitura estava errada.
A objeção óbvia é que nós os bloqueamos. Não bloqueamos: OAI-SearchBot, ChatGPT-User, Claude-User, Perplexity-User, Claude-SearchBot, DuckAssistBot e MistralAI-User estão cada um nomeado no nosso robots.txt com Allow: /, junto dos crawlers de treinamento. O zero é o comportamento deles, não a nossa configuração — confira o seu próprio arquivo robots antes de ler o seu próprio zero como uma descoberta.
04Zero buscas, e o ChatGPT nos linkou mesmo assim
Em 21 de setembro de 2026, perguntamos ao ChatGPT, num chat temporário com a memória desligada, "free tool to check my iOS app's keyword ranking in the App Store". Ele listou o nosso verificador de posições gratuito em segundo lugar entre cinco e linkou direto para /tools/rank-check, com utm_source=chatgpt.com no final. O nosso próprio log de visitas vinha registrando chegadas de chatgpt.com havia duas semanas — duas delas terminaram criando uma conta.
Então o zero no log de acesso e a citação são verdadeiros ao mesmo tempo. A resposta foi montada a partir de um índice de busca que o ChatGPT já tinha, não de uma requisição ao vivo de um agente que se apresenta como da OpenAI. Para quem tem um site, a lição é prática: um zero no seu log não significa que você é invisível para o ChatGPT, e uma citação não significa que ele leu a sua página hoje.
Qual índice? A central de ajuda da OpenAI diz que a busca do ChatGPT "às vezes faz parceria com outros provedores de busca" e remete à declaração de privacidade da Microsoft para eles — ou seja, o Bing. O bingbot pediu páginas daqui 435 vezes na janela, todas servidas normalmente — e mesmo assim, no mesmo dia, uma busca no Bing pelo título exato da nossa comparação de ferramentas gratuitas não devolveu nada deste domínio. Não conseguimos dizer qual índice produziu a citação; conseguimos dizer que rastreamento e indexação são etapas separadas, e que é na segunda que um site novo costuma estar ausente.
05Um terço de todo o tráfego de crawlers vai para as versões em texto puro
Cada página daqui também existe como uma versão em Markdown em .md.txt, junto com llms.txt e llms-full.txt. Na mesma janela, os crawlers pediram essas versões 788 vezes de um total de 2244 requisições de IA — 35% de tudo o que pediram. As páginas de conteúdo em HTML ficaram com 1083.
Construímos essa camada supondo que seria usada, sem evidência para um lado ou para o outro. Ela é muito usada — não mais que o HTML, mas na mesma ordem de grandeza, vinda de uma camada que quase não custa nada publicar. Por esta evidência, ela não é decorativa.
06O que isto sugere fazer e o que não sugere
Vale a pena
Publique uma cópia limpa em texto puro das suas páginas, mantenha a sua própria descrição factual e garanta que as páginas que descrevem o seu app sejam as que um rastreamento de treinamento encontraria — textos de terceiros mais do que o seu próprio marketing. Depois meça de novo em um mês em vez de confiar na mudança.
Entre nos índices de busca que os assistentes pegam emprestados. Verifique o site no Bing Webmaster Tools além do Google Search Console e envie o sitemap para os dois — rastreado não é o mesmo que indexado, e uma página que não está no índice não pode ser recuperada para uma resposta. Depois busque lá os títulos exatos das suas páginas; é a verificação mais barata que existe.
Não vale a pena
Reescrever páginas toda semana para perseguir uma busca na hora da resposta que não está acontecendo. Comprar uma ferramenta que promete "otimizar para o ChatGPT" sem dizer se o mecanismo que ela mede alguma vez pede o seu domínio. E tratar uma única leitura — a nossa ou a sua — como tendência.
Perguntas frequentes
O ChatGPT visita o meu site quando alguém pergunta sobre o meu app?
Às vezes, e você pode verificar em vez de supor. A OpenAI documenta agentes separados para treinamento e para navegação na hora da resposta; os de resposta aparecem pelo nome no seu log de acesso quando chegam. Na janela que medimos, eles nunca vieram — e o ChatGPT mesmo assim linkou as nossas páginas, porque a resposta se apoiou num índice de busca que ele já tinha, e não numa visita ao vivo.
Bloquear crawlers de IA no robots.txt é uma boa ideia?
Se você quer ser citado nas respostas dos assistentes, bloquear os crawlers de treinamento vai diretamente contra isso — eles são o caminho pelo qual o seu produto vira algo que o modelo conhece. Bloquear é uma escolha razoável por outros motivos, mas é uma troca, não uma precaução gratuita.
O llms.txt e as cópias em Markdown das páginas são mesmo lidos?
Neste domínio, bastante: 788 de 2244 requisições de crawlers de IA foram para as versões em texto puro na janela medida, contra 1083 para as páginas HTML. É a evidência de um site, não uma regra, mas o custo de publicá-las é quase zero.
Dá para forçar a entrada nas respostas de IA?
Não de um jeito útil. A resposta de um assistente é construída a partir do que foi escrito sobre você em muitas fontes; uma página afirmando que você é o melhor não vira isso. O que muda a resposta é ser descrito com precisão, em lugares além do seu próprio domínio, ao longo do tempo.
Veja isso para o seu próprio app
Cole o link da loja e adicione suas palavras-chave. Posição, apps acima de você e demanda são medidos todos os dias.
Plano grátis: 1 app, 25 palavras-chave em cada um de 2 storefronts, 30 dias de histórico, sem cartão e sem prazo. O Pro custa US$ 20/mês.
Começar grátis →