Datos originales
¿Cada cuánto releen las IA tu web? Nuestros números, bot a bot
Durante 90 días medimos cada cuánto vuelve realmente cada bot de IA a releer una página — en 17.850 pares página-bot, con la identidad de cada bot verificada por IP. Perplexity vuelve cada 5 días y medio. ChatGPT cada 14. Claude cada 23 y medio. Aquí están los números, el método, y lo que cambia si tus páginas se mueven.
Cambia un precio hoy. ¿Cuánto tiempo sigue viviendo el precio antiguo en las respuestas de las IA?
Nadie puede responder con exactitud a esa pregunta — la memoria de un asistente no es observable desde fuera. Pero la mitad de la pregunta sí se mide muy bien: cada cuánto vuelve realmente cada bot de IA a releer tus páginas. Entre dos visitas, pase lo que pase, un bot no puede aprender nada nuevo sobre una página. Ese ciclo de relectura es por tanto un suelo físico: tu cambio no puede propagarse más rápido que él.
Medimos ese ciclo durante 90 días. Esto es lo que salió.
El método, antes de los números
Snorklee mide el tráfico en el servidor, incluidas las visitas de los bots. Cada hit de bot se coteja con los rangos IP publicados por los operadores: un GPTBot falso queda descartado. Sobre esa base:
- Ventana: 90 días, cerrados el 6 de agosto de 2026.
- Material: 17.850 pares página-bot releídos en al menos 3 días distintos, procedentes de los sitios que medimos en producción. Son datos de observación reales — no un panel representativo de toda la web.
- Cálculo: por cada par, ciclo = (última visita − primera) ÷ (número de días de visita − 1); después la mediana por bot.
- Excluidos: los bots suplantados, y las familias vistas en menos de 100 pares (DuckDuckGo AI, CommonCrawl) — demasiado pocos para una mediana honesta.
- Límite asumido: un crawl no es una actualización del índice ni de la memoria del modelo. Medimos la relectura, no lo que muestra el asistente. Pero sin relectura no hay actualización posible: estos ciclos son suelos.
Los números: de 5 días y medio a más de tres semanas
Ciclo mediano de relectura de una misma página, por bot (90 días)
| Bot | Pares observados | Ciclo mediano | En la práctica |
|---|---|---|---|
| Perplexity | 464 | 5,5 d | Tu cambio puede releerse dentro de la semana |
| Huawei AI | 3.230 | 6,5 d | Relectura semanal |
| ByteDance AI | 2.447 | 8 d | Relectura semanal |
| Meta AI | 647 | 11 d | Una o dos relecturas por quincena |
| ChatGPT | 8.231 | 14 d | Dos semanas entre dos lecturas de fondo |
| Amazon AI | 2.661 | 18 d | Casi tres semanas |
| Claude | 158 | 23,5 d | Más de tres semanas: el más lento medido |
Tres cosas nos llamaron la atención en estos números.
Perplexity es el más fresco. Coherente con su posicionamiento de motor de respuestas: un índice que quiere estar al día tiene que releer a menudo. Si tu contenido cambia mucho, probablemente sea en Perplexity donde la versión servida está más cerca de la realidad.
Los crawlers de los que nadie habla están entre los más constantes. PetalBot (Huawei) y Bytespider (ByteDance) releen más rápido que ChatGPT — en nuestros datos, juntos representan casi un tercio de los pares observados. La conversación pública sobre los crawlers de IA se reduce a menudo a OpenAI y Anthropic; el tráfico real cuenta otra historia.
Claude es el más lento, con diferencia. Más de tres semanas entre dos lecturas de fondo de una misma página. Una información caducada vive por tanto más tiempo en Anthropic que en ningún otro sitio — con el matiz de la lectura en directo, ahora llegamos.
Las dos velocidades de ChatGPT
La mediana de 14 días esconde una realidad de dos pisos, muy visible en nuestras propias páginas.
Nuestra página de precios — el tipo de página cuyo contenido importa económicamente — fue releída por ChatGPT 41 veces en 90 días, es decir, cada 2-3 días aproximadamente. Mientras tanto, la mediana de su crawl de fondo sobre el conjunto de las páginas se mantiene en 14 días. Dicho de otro modo: las IA mantienen una lista de páginas calientes, releídas muy a menudo, mientras el resto del sitio vive al ritmo lento.
A eso se suma un tercer mecanismo: ChatGPT-User, la lectura en directo. Cuando un usuario hace una pregunta que afecta a tu página, el asistente puede ir a releerla en ese mismo instante — puenteando todos los ciclos de arriba. Pero esa lectura bajo demanda solo cubre las páginas que el asistente decide ir a buscar: para todo lo demás, manda el ciclo de fondo.
La consecuencia práctica importa: la verdadera pregunta no es «a qué velocidad crawlean las IA la web», sino «¿están mis páginas críticas en la lista caliente?». La respuesta se mide, página a página — no en promedio.
Qué cambia si tus páginas se mueven
Si tu web es un escaparate estable, estos ciclos son pura anécdota. Si tus páginas llevan información que caduca — precios, disponibilidad, promociones, versiones, planes de suscripción — se convierten en una restricción de calendario:
- Una promoción de 5 días puede caer entre dos lecturas. En ChatGPT (14 d), Amazon (18 d) y Claude (23,5 d), una campaña corta tiene todas las papeletas de empezar y terminar sin que ningún crawl de fondo la vea. Para uno de cada dos bots de nuestra tabla, tu promoción simplemente nunca existió.
- Un cambio de precio vive por duplicado durante una a tres semanas. El precio antiguo sigue siendo la última versión leída por una parte de los bots hasta su siguiente visita. Si un asistente cita un precio caducado a alguien que compara ofertas, nunca lo sabrás — la venta se pierde sin dejar rastro.
- La información perecedera debe ser legible a la primera. Precio y disponibilidad en el HTML y en el marcado
schema.org/Offer, no solo en un JavaScript que los crawlers no ejecutan. Un bot que vuelve cada 14 días y no puede leer el precio se marcha otros 14 días sin nada. - No bloquees los bots que te traen tráfico. El reflejo de «bloqueo todos los bots de IA» corta precisamente las relecturas que mantienen fresca tu información — y el tráfico de asistentes que viene con ellas. Si quieres una política fina, separa el entrenamiento de la búsqueda: contamos cómo en «Crawlers de IA: ¿bloquear o permitir?».
- Programa tus operaciones según el ciclo observado de tus páginas, no según una media de la web. Nuestras medianas son referencias, no tu realidad: tu página de inicio no lleva el ritmo de tus páginas profundas. El único valor que cuenta para decidir es el medido en tus páginas.
Mídelo en tu propia web
Todo lo que muestra este artículo sale de la pestaña Tráfico IA de Snorklee: qué bots leen qué páginas y cuándo (identidad verificada por IP, impostores señalados), cuáles de tus páginas se leen sin que ningún humano las visite jamás, y qué autoriza realmente tu robots.txt. La medición es pasiva, en el servidor, sin cookies ni banner — tus visitantes no ven nada, y los bots tampoco.
Ver tus propios ciclos: prueba gratuita de 14 días, sin tarjeta — la primera visita de un bot suele aparecer en el mismo día.
¿Cada cuánto crawlea ChatGPT un sitio?
En nuestros datos (90 días, identidad verificada por IP), la mediana del crawl de fondo es una relectura cada 14 días por página. Pero las páginas consideradas importantes se releen mucho más a menudo — nuestra página de precios cada 2-3 días — y ChatGPT-User puede leer una página en directo en el momento en que un usuario hace una pregunta. La frecuencia depende de la página, no solo del sitio.
¿Un crawl significa que la IA está al día?
No. Un crawl es una lectura, no una garantía de actualización del índice ni de la memoria del modelo. En cambio, la lógica inversa sí se cumple: sin relectura, ninguna actualización es posible. El ciclo de crawl es por tanto un suelo — tu cambio no puede propagarse más rápido.
¿Hay que bloquear estos bots para protegerse?
Bloquear todos los bots de IA corta también los que alimentan los motores de respuestas y te envían visitantes. La distinción útil es por finalidad: bloquear el entrenamiento es una elección defendible; bloquear la búsqueda y los asistentes es salirse de los resultados de mañana. Un robots.txt puede hacer lo uno sin lo otro.