01Dos preguntas que se confunden
Ser mencionado y ser consultado son cosas distintas. Un asistente puede mencionar su app por lo que absorbió durante el entrenamiento, sin solicitar nunca su sitio. También puede consultar su sitio al responder y aun así no mencionarle. Medir una no dice nada de la otra, y la mayoría de los consejos sobre el tema las mezclan sin decirlo.
La primera pregunta ya la medimos y la publicamos, ceros incluidos. Esta página trata de la segunda: en una ventana fija, qué rastreadores solicitaron realmente páginas de este dominio.
02Qué llegó, 14 días hasta el 2026-09-21
| User agent | Operador | Función | Solicitudes |
|---|---|---|---|
| Amazonbot | Amazon | índice de búsqueda | 1140 |
| ClaudeBot | Anthropic | entrenamiento | 901 |
| Googlebot | índice de búsqueda | 797 | |
| bingbot | Microsoft | índice de búsqueda | 435 |
| Applebot | Apple | índice de búsqueda | 121 |
| GPTBot | OpenAI | entrenamiento | 67 |
| PerplexityBot | Perplexity | tiempo de respuesta | 10 |
| Bytespider | ByteDance | entrenamiento | 5 |
| OAI-SearchBot | OpenAI | tiempo de respuesta | nunca |
| ChatGPT-User | OpenAI | tiempo de respuesta | nunca |
| Claude-User | Anthropic | tiempo de respuesta | nunca |
| CCBot | Common Crawl | entrenamiento | nunca |
| meta-externalagent | Meta | entrenamiento | nunca |
| Google-Extended | entrenamiento | nunca | |
| Perplexity-User | Perplexity | tiempo de respuesta | nunca |
| Claude-SearchBot | Anthropic | tiempo de respuesta | nunca |
| DuckAssistBot | DuckDuckGo | tiempo de respuesta | nunca |
| MistralAI-User | Mistral | tiempo de respuesta | nunca |
03Los agentes de OpenAI de tiempo de respuesta nunca llegaron. Los de Perplexity, sí.
Los operadores publican agentes distintos para trabajos distintos: uno que recoge páginas para el entrenamiento y otro que consulta una página mientras responde a una pregunta en vivo. En esta ventana, OAI-SearchBot, ChatGPT-User, Claude-User, Perplexity-User, Claude-SearchBot, DuckAssistBot y MistralAI-User registraron cero solicitudes, incluidos los dos agentes de tiempo de respuesta de OpenAI. PerplexityBot sí llegó, 10 veces.
Así que la versión honesta no es "los asistentes nunca consultan": uno sí lo hace, a razón de una solicitud al día aproximadamente. Es más acotada: en este dominio, en esta ventana, ningún agente que se identificara como de OpenAI consultó este sitio mientras respondía. Al principio lo leímos como "ChatGPT no puede ver nuestras páginas". La siguiente sección explica por qué esa lectura era errónea.
La objeción obvia es que los bloqueamos. No lo hicimos: OAI-SearchBot, ChatGPT-User, Claude-User, Perplexity-User, Claude-SearchBot, DuckAssistBot y MistralAI-User figuran cada uno en nuestro robots.txt con Allow: /, junto a los rastreadores de entrenamiento. El cero es su comportamiento, no nuestra configuración: revise su propio archivo robots antes de interpretar su propio cero como un hallazgo.
04Cero consultas, y ChatGPT nos enlazó igualmente
El 21 de septiembre de 2026 preguntamos a ChatGPT, en un chat temporal con la memoria desactivada, "free tool to check my iOS app's keyword ranking in the App Store". Mencionó nuestra consulta de posición gratuita en segundo lugar de cinco y enlazó directamente a /tools/rank-check, con utm_source=chatgpt.com añadido. Nuestro propio registro de visitas llevaba dos semanas anotando llegadas desde chatgpt.com, y dos de ellas terminaron creando una cuenta.
Así que el cero del registro de accesos y la cita son ciertos a la vez. La respuesta se armó a partir de un índice de búsqueda que ChatGPT ya tenía, no de una solicitud en vivo de un agente que se anunciara como de OpenAI. Para el dueño de un sitio, la lección es práctica: un cero en su registro no significa que sea invisible para ChatGPT, y una cita no significa que haya leído su página hoy.
¿Qué índice? El centro de ayuda de OpenAI dice que la búsqueda de ChatGPT "a veces se asocia con otros proveedores de búsqueda" y remite a la declaración de privacidad de Microsoft para ellos: es Bing. bingbot solicitó páginas de aquí 435 veces en la ventana, todas servidas con normalidad; y, sin embargo, ese mismo día una búsqueda en Bing del título exacto de nuestra comparativa de herramientas gratuitas no devolvió nada de este dominio. No podemos saber qué índice produjo la cita; sí podemos decir que rastrear e indexar son pasos separados, y que el segundo es donde suele faltar un sitio nuevo.
05Un tercio de todo el tráfico de rastreadores va a los gemelos de texto plano
Cada página de aquí existe también como gemelo en Markdown en .md.txt, junto a llms.txt y llms-full.txt. En la misma ventana, los rastreadores solicitaron esos gemelos 788 veces de un total de 2244 solicitudes de IA: el 35% de todo lo que pidieron. Las páginas de contenido HTML recibieron 1083.
Construimos esa capa suponiendo que se usaría, sin evidencia en ningún sentido. Se usa mucho: no más que el HTML, pero en el mismo orden de magnitud, y es una capa que casi no cuesta publicar. Con esta evidencia, no es decorativa.
06Qué sugiere hacer esto y qué no
Vale la pena
Publicar una copia limpia en texto plano de sus páginas, mantener su propia descripción fiel a los hechos y asegurarse de que las páginas que describen su app sean las que encontraría un rastreo de entrenamiento: más artículos de terceros que su propio marketing. Después, volver a medir al cabo de un mes en lugar de dar el cambio por hecho.
Entrar en los índices de búsqueda que toman prestados los asistentes. Verificar el sitio en Bing Webmaster Tools además de en Google Search Console y enviar el sitemap a ambos: rastreado no es lo mismo que indexado, y una página que no está en el índice no puede recuperarse para una respuesta. Después, buscar allí los títulos exactos de sus propias páginas; es la comprobación más barata que existe.
No vale la pena
Reescribir páginas cada semana para perseguir una consulta en tiempo de respuesta que no está ocurriendo. Comprar una herramienta que promete "optimizar para ChatGPT" sin decirle si el motor que mide llega a solicitar su dominio alguna vez. Y tratar una sola lectura, la nuestra o la suya, como una tendencia.
Preguntas frecuentes
¿ChatGPT visita mi sitio web cuando alguien pregunta por mi app?
A veces, y puede comprobarlo en lugar de suponerlo. OpenAI documenta agentes distintos para el entrenamiento y para la navegación en tiempo de respuesta; los de tiempo de respuesta aparecen por su nombre en su registro de accesos cuando llegan. En nuestra propia ventana medida nunca llegaron, y ChatGPT aun así enlazó nuestras páginas, porque su respuesta se basó en un índice de búsqueda que ya tenía y no en una visita en vivo.
¿Es buena idea bloquear los rastreadores de IA en robots.txt?
Si quiere que le mencionen en las respuestas de los asistentes, bloquear los rastreadores de entrenamiento juega directamente en contra: son la vía por la que su producto se convierte en algo que el modelo conoce. Bloquear es una opción razonable por otros motivos, pero es un intercambio, no una precaución gratuita.
¿Se leen de verdad llms.txt y las copias en Markdown de las páginas?
En este dominio, mucho: 788 de 2244 solicitudes de rastreadores de IA fueron a los gemelos de texto plano en la ventana medida, frente a 1083 para las páginas HTML. Es la evidencia de un solo sitio, no una regla, pero el coste de publicarlos es casi cero.
¿Puedo colarme en las respuestas de IA con trucos?
No de forma útil. La respuesta de un asistente se construye con lo que se ha escrito sobre usted en muchas fuentes; una página que afirma que usted es el mejor no le convierte en ello. Lo que la mueve es que le describan con precisión, en lugares distintos de su propio dominio, a lo largo del tiempo.
Compruébalo con tu propia app
Pega el enlace de tu app y añade tus palabras clave. Cada día se miden la posición, las apps por encima de ti y la demanda.
Plan gratuito: 1 app, 25 palabras clave en cada uno de 2 storefronts, 30 días de historial, sin tarjeta y sin fecha de fin. Pro cuesta $20/mes.
Empezar gratis →