Storelift

Storelift › Guías › ¿ChatGPT lee su sitio antes de responder?

Medición

¿ChatGPT lee su sitio antes de responder?

"¿ChatGPT recomendará mi app?" suele tratarse como una cuestión de contenido. En parte es una cuestión de fontanería, y la fontanería se puede medir en su propio registro de accesos. Lo hicimos con nuestro propio sitio y el resultado fue más claro de lo esperado.

Empezar gratis →Plan gratuito: 1 app, 25 palabras clave en cada uno de 2 storefronts, 30 días de historial, sin tarjeta y sin fecha de fin. Pro cuesta $20/mes.

Por Traducido del original en inglés con ayuda de IAActualizado: 6 secciones1 fuentes

01Dos preguntas que se confunden

Ser mencionado y ser consultado son cosas distintas. Un asistente puede mencionar su app por lo que absorbió durante el entrenamiento, sin solicitar nunca su sitio. También puede consultar su sitio al responder y aun así no mencionarle. Medir una no dice nada de la otra, y la mayoría de los consejos sobre el tema las mezclan sin decirlo.

La primera pregunta ya la medimos y la publicamos, ceros incluidos. Esta página trata de la segunda: en una ventana fija, qué rastreadores solicitaron realmente páginas de este dominio.

02Qué llegó, 14 días hasta el 2026-09-21

User agentOperadorFunciónSolicitudes
AmazonbotAmazoníndice de búsqueda1140
ClaudeBotAnthropicentrenamiento901
GooglebotGoogleíndice de búsqueda797
bingbotMicrosoftíndice de búsqueda435
ApplebotAppleíndice de búsqueda121
GPTBotOpenAIentrenamiento67
PerplexityBotPerplexitytiempo de respuesta10
BytespiderByteDanceentrenamiento5
OAI-SearchBotOpenAItiempo de respuestanunca
ChatGPT-UserOpenAItiempo de respuestanunca
Claude-UserAnthropictiempo de respuestanunca
CCBotCommon Crawlentrenamientonunca
meta-externalagentMetaentrenamientonunca
Google-ExtendedGoogleentrenamientonunca
Perplexity-UserPerplexitytiempo de respuestanunca
Claude-SearchBotAnthropictiempo de respuestanunca
DuckAssistBotDuckDuckGotiempo de respuestanunca
MistralAI-UserMistraltiempo de respuestanunca
Una cadena de user agent se puede falsificar y no verificamos las IP de las solicitudes frente a los rangos publicados. Lea cada fila como "un cliente que se identificó así", no como una visita confirmada de esa empresa.

03Los agentes de OpenAI de tiempo de respuesta nunca llegaron. Los de Perplexity, sí.

Los operadores publican agentes distintos para trabajos distintos: uno que recoge páginas para el entrenamiento y otro que consulta una página mientras responde a una pregunta en vivo. En esta ventana, OAI-SearchBot, ChatGPT-User, Claude-User, Perplexity-User, Claude-SearchBot, DuckAssistBot y MistralAI-User registraron cero solicitudes, incluidos los dos agentes de tiempo de respuesta de OpenAI. PerplexityBot sí llegó, 10 veces.

Así que la versión honesta no es "los asistentes nunca consultan": uno sí lo hace, a razón de una solicitud al día aproximadamente. Es más acotada: en este dominio, en esta ventana, ningún agente que se identificara como de OpenAI consultó este sitio mientras respondía. Al principio lo leímos como "ChatGPT no puede ver nuestras páginas". La siguiente sección explica por qué esa lectura era errónea.

La objeción obvia es que los bloqueamos. No lo hicimos: OAI-SearchBot, ChatGPT-User, Claude-User, Perplexity-User, Claude-SearchBot, DuckAssistBot y MistralAI-User figuran cada uno en nuestro robots.txt con Allow: /, junto a los rastreadores de entrenamiento. El cero es su comportamiento, no nuestra configuración: revise su propio archivo robots antes de interpretar su propio cero como un hallazgo.

Un sitio, una ventana. No es una afirmación sobre cómo se comportan los asistentes en general, y un sitio distinto (uno que se cita a menudo o que se posiciona en el índice de búsqueda en que se apoyan esos agentes) bien podría ver lo contrario. Lo importante es que puede comprobar el suyo en lugar de suponer.

04Cero consultas, y ChatGPT nos enlazó igualmente

El 21 de septiembre de 2026 preguntamos a ChatGPT, en un chat temporal con la memoria desactivada, "free tool to check my iOS app's keyword ranking in the App Store". Mencionó nuestra consulta de posición gratuita en segundo lugar de cinco y enlazó directamente a /tools/rank-check, con utm_source=chatgpt.com añadido. Nuestro propio registro de visitas llevaba dos semanas anotando llegadas desde chatgpt.com, y dos de ellas terminaron creando una cuenta.

Así que el cero del registro de accesos y la cita son ciertos a la vez. La respuesta se armó a partir de un índice de búsqueda que ChatGPT ya tenía, no de una solicitud en vivo de un agente que se anunciara como de OpenAI. Para el dueño de un sitio, la lección es práctica: un cero en su registro no significa que sea invisible para ChatGPT, y una cita no significa que haya leído su página hoy.

¿Qué índice? El centro de ayuda de OpenAI dice que la búsqueda de ChatGPT "a veces se asocia con otros proveedores de búsqueda" y remite a la declaración de privacidad de Microsoft para ellos: es Bing. bingbot solicitó páginas de aquí 435 veces en la ventana, todas servidas con normalidad; y, sin embargo, ese mismo día una búsqueda en Bing del título exacto de nuestra comparativa de herramientas gratuitas no devolvió nada de este dominio. No podemos saber qué índice produjo la cita; sí podemos decir que rastrear e indexar son pasos separados, y que el segundo es donde suele faltar un sitio nuevo.

Una consulta, un día. Las respuestas varían entre sesiones: una pregunta similar el 13 de septiembre ("free ASO keyword rank tracker") no nos mencionó, y las preguntas amplias del tipo "best ASO tool" siguen sin hacerlo. Tómelo como evidencia de que el camino existe, no como un ranking.

05Un tercio de todo el tráfico de rastreadores va a los gemelos de texto plano

Cada página de aquí existe también como gemelo en Markdown en .md.txt, junto a llms.txt y llms-full.txt. En la misma ventana, los rastreadores solicitaron esos gemelos 788 veces de un total de 2244 solicitudes de IA: el 35% de todo lo que pidieron. Las páginas de contenido HTML recibieron 1083.

Construimos esa capa suponiendo que se usaría, sin evidencia en ningún sentido. Se usa mucho: no más que el HTML, pero en el mismo orden de magnitud, y es una capa que casi no cuesta publicar. Con esta evidencia, no es decorativa.

06Qué sugiere hacer esto y qué no

Vale la pena

Publicar una copia limpia en texto plano de sus páginas, mantener su propia descripción fiel a los hechos y asegurarse de que las páginas que describen su app sean las que encontraría un rastreo de entrenamiento: más artículos de terceros que su propio marketing. Después, volver a medir al cabo de un mes en lugar de dar el cambio por hecho.

Entrar en los índices de búsqueda que toman prestados los asistentes. Verificar el sitio en Bing Webmaster Tools además de en Google Search Console y enviar el sitemap a ambos: rastreado no es lo mismo que indexado, y una página que no está en el índice no puede recuperarse para una respuesta. Después, buscar allí los títulos exactos de sus propias páginas; es la comprobación más barata que existe.

No vale la pena

Reescribir páginas cada semana para perseguir una consulta en tiempo de respuesta que no está ocurriendo. Comprar una herramienta que promete "optimizar para ChatGPT" sin decirle si el motor que mide llega a solicitar su dominio alguna vez. Y tratar una sola lectura, la nuestra o la suya, como una tendencia.

Preguntas frecuentes

¿ChatGPT visita mi sitio web cuando alguien pregunta por mi app?

A veces, y puede comprobarlo en lugar de suponerlo. OpenAI documenta agentes distintos para el entrenamiento y para la navegación en tiempo de respuesta; los de tiempo de respuesta aparecen por su nombre en su registro de accesos cuando llegan. En nuestra propia ventana medida nunca llegaron, y ChatGPT aun así enlazó nuestras páginas, porque su respuesta se basó en un índice de búsqueda que ya tenía y no en una visita en vivo.

¿Es buena idea bloquear los rastreadores de IA en robots.txt?

Si quiere que le mencionen en las respuestas de los asistentes, bloquear los rastreadores de entrenamiento juega directamente en contra: son la vía por la que su producto se convierte en algo que el modelo conoce. Bloquear es una opción razonable por otros motivos, pero es un intercambio, no una precaución gratuita.

¿Se leen de verdad llms.txt y las copias en Markdown de las páginas?

En este dominio, mucho: 788 de 2244 solicitudes de rastreadores de IA fueron a los gemelos de texto plano en la ventana medida, frente a 1083 para las páginas HTML. Es la evidencia de un solo sitio, no una regla, pero el coste de publicarlos es casi cero.

¿Puedo colarme en las respuestas de IA con trucos?

No de forma útil. La respuesta de un asistente se construye con lo que se ha escrito sobre usted en muchas fuentes; una página que afirma que usted es el mejor no le convierte en ello. Lo que la mueve es que le describan con precisión, en lugares distintos de su propio dominio, a lo largo del tiempo.

Compruébalo con tu propia app

Pega el enlace de tu app y añade tus palabras clave. Cada día se miden la posición, las apps por encima de ti y la demanda.

Plan gratuito: 1 app, 25 palabras clave en cada uno de 2 storefronts, 30 días de historial, sin tarjeta y sin fecha de fin. Pro cuesta $20/mes.

Empezar gratis →

Sigue leyendo

Fuentes