Données originales
À quelle vitesse les IA relisent-elles votre site ? Nos chiffres, robot par robot
Pendant 90 jours, nous avons mesuré la fréquence à laquelle chaque robot d'IA revient réellement lire une page — sur 17 850 paires page-robot, avec l'identité de chaque robot vérifiée par IP. Perplexity repasse tous les 5 jours et demi. ChatGPT tous les 14. Claude tous les 23 et demi. Voici les chiffres, la méthode, et ce que ça change si vos pages bougent.
Changez un prix aujourd'hui. Combien de temps l'ancien prix continue-t-il de vivre dans les réponses des IA ?
Personne ne peut répondre exactement à cette question — la mémoire d'un assistant n'est pas observable de l'extérieur. Mais la moitié de la question, elle, se mesure très bien : à quelle fréquence chaque robot d'IA revient réellement relire vos pages. Entre deux passages, quoi qu'il arrive, un robot ne peut rien apprendre de nouveau sur une page. Ce cycle de relecture est donc un plancher physique : votre changement ne peut pas se propager plus vite que lui.
Nous avons mesuré ce cycle pendant 90 jours. Voici ce que ça donne.
La méthode, avant les chiffres
Snorklee mesure le trafic côté serveur, y compris les passages de robots. Chaque hit de robot est confronté aux plages IP publiées par les éditeurs : un faux GPTBot est écarté. Sur cette base :
- Fenêtre : 90 jours, arrêtés au 6 août 2026.
- Matière : 17 850 paires page-robot relues au moins 3 jours distincts, issues des sites que nous mesurons en production. Ce sont des données d'observation réelles — pas un panel représentatif de tout le web.
- Calcul : pour chaque paire, cycle = (dernier passage − premier) ÷ (nombre de jours de passage − 1) ; puis médiane par robot.
- Exclus : les robots usurpés, et les familles vues sur moins de 100 paires (DuckDuckGo AI, CommonCrawl) — trop peu pour une médiane honnête.
- Limite assumée : un crawl n'est pas une mise à jour de l'index ni de la mémoire du modèle. On mesure la relecture, pas ce que l'assistant affiche. Mais sans relecture, aucune mise à jour n'est possible : ces cycles sont des planchers.
Les chiffres : de 5 jours et demi à plus de trois semaines
Cycle médian de relecture d'une même page, par robot (90 jours)
| Robot | Paires observées | Cycle médian | Concrètement |
|---|---|---|---|
| Perplexity | 464 | 5,5 j | Votre changement peut être relu dans la semaine |
| Huawei AI | 3 230 | 6,5 j | Relecture hebdomadaire |
| ByteDance AI | 2 447 | 8 j | Relecture hebdomadaire |
| Meta AI | 647 | 11 j | Une à deux relectures par quinzaine |
| ChatGPT | 8 231 | 14 j | Deux semaines entre deux lectures de fond |
| Amazon AI | 2 661 | 18 j | Presque trois semaines |
| Claude | 158 | 23,5 j | Plus de trois semaines : le plus lent mesuré |
Trois choses nous ont frappés dans ces chiffres.
Perplexity est le plus frais. C'est cohérent avec son positionnement moteur de réponse : un index qui se veut à jour doit relire souvent. Si votre contenu bouge beaucoup, c'est probablement chez Perplexity que la version servie est la plus proche de la réalité.
Les crawlers dont personne ne parle sont parmi les plus assidus. PetalBot (Huawei) et Bytespider (ByteDance) relisent plus vite que ChatGPT — sur nos données, ils représentent ensemble presque un tiers des paires observées. La conversation publique sur les crawlers IA se résume souvent à OpenAI et Anthropic ; le trafic réel raconte autre chose.
Claude est le plus lent, et de loin. Plus de trois semaines entre deux lectures de fond d'une même page. Une information périmée vit donc plus longtemps chez Anthropic qu'ailleurs — à nuancer par la lecture en direct, on y vient.
Les deux vitesses de ChatGPT
La médiane de 14 jours cache une réalité à deux étages, très visible sur nos propres pages.
Notre page de tarifs — le genre de page dont le contenu compte financièrement — a été relue par ChatGPT 41 fois en 90 jours, soit environ tous les 2 à 3 jours. Pendant ce temps, la médiane de son crawl de fond sur l'ensemble des pages reste à 14 jours. Autrement dit : les IA tiennent une liste de pages chaudes, relues très souvent, pendant que le reste du site vit au rythme lent.
S'y ajoute un troisième mécanisme : ChatGPT-User, la lecture en direct. Quand un utilisateur pose une question qui concerne votre page, l'assistant peut aller la relire à l'instant même — et court-circuiter tous les cycles ci-dessus. Mais cette lecture à la demande ne concerne que les pages que l'assistant décide d'aller chercher : pour tout le reste, le cycle de fond fait loi.
La conséquence pratique est importante : la vraie question n'est pas « à quelle vitesse les IA crawlent-elles le web », mais « mes pages critiques sont-elles dans la liste chaude ». La réponse se mesure, page par page — pas en moyenne.
Ce que ça change si vos pages bougent
Si votre site est une vitrine stable, ces cycles sont anecdotiques. Si vos pages portent des informations qui périment — prix, disponibilité, promotions, versions, tarifs d'abonnement — ils deviennent une contrainte de calendrier :
- Une promo de 5 jours peut passer entre deux lectures. Chez ChatGPT (14 j), Amazon (18 j) et Claude (23,5 j), une opération courte a toutes les chances de commencer et finir sans qu'aucun crawl de fond ne la voie. Pour un robot sur deux de notre tableau, votre promo n'a simplement jamais existé.
- Un changement de prix vit en double pendant une à trois semaines. L'ancien prix reste la dernière version lue par une partie des robots jusqu'à leur prochain passage. Si un assistant cite un prix périmé à quelqu'un qui compare des offres, vous ne le saurez jamais — la vente se perd sans laisser de trace.
- Les informations périssables doivent être lisibles au premier passage. Prix et disponibilité dans le HTML et le balisage
schema.org/Offer, pas uniquement dans un JavaScript que les crawlers n'exécutent pas. Un robot qui repasse tous les 14 jours et ne peut pas lire le prix repart pour 14 jours avec rien. - Ne bloquez pas les robots qui vous envoient du trafic. Le réflexe « je bloque tous les bots IA » coupe précisément les relectures qui gardent vos informations fraîches — et le trafic d'assistants qui va avec. Si vous voulez une politique fine, distinguez l'entraînement de la recherche : on a détaillé comment dans « Crawlers IA : bloquer ou autoriser ? ».
- Calez vos opérations sur le cycle observé de vos pages, pas sur une moyenne du web. Nos médianes sont des repères, pas votre réalité : votre page d'accueil n'a pas le rythme de vos pages profondes. La seule valeur qui compte pour décider est celle mesurée sur vos pages.
Mesurez-le sur votre propre site
Tout ce que montre cet article sort de l'onglet Trafic IA de Snorklee : quels robots lisent quelles pages et à quelle date (identité vérifiée par IP, usurpateurs signalés), lesquelles de vos pages sont lues sans jamais être visitées par un humain, et ce que votre robots.txt autorise réellement. La mesure est passive, côté serveur, sans cookie ni bannière — vos visiteurs ne voient rien, vos robots non plus.
Voir vos propres cycles : essai gratuit de 14 jours, sans carte bancaire — le premier passage de robot apparaît en général dans la journée.
À quelle fréquence ChatGPT crawle-t-il un site ?
Sur nos données (90 jours, identité vérifiée par IP), la médiane du crawl de fond est d'une relecture tous les 14 jours par page. Mais les pages jugées importantes sont relues bien plus souvent — notre page de tarifs l'est tous les 2 à 3 jours — et ChatGPT-User peut lire une page en direct au moment où un utilisateur pose une question. La fréquence dépend de la page, pas seulement du site.
Un crawl signifie-t-il que l'IA est à jour ?
Non. Un crawl est une lecture, pas une garantie de mise à jour de l'index ni de la mémoire du modèle. En revanche, la logique inverse tient : sans relecture, aucune mise à jour n'est possible. Le cycle de crawl est donc un plancher — votre changement ne peut pas se propager plus vite.
Faut-il bloquer ces robots pour se protéger ?
Bloquer tous les robots IA coupe aussi ceux qui alimentent les moteurs de réponse et vous envoient des visiteurs. La distinction utile est par finalité : bloquer l'entraînement est un choix défendable ; bloquer la recherche et les assistants revient à sortir des résultats de demain. Un robots.txt peut faire l'un sans l'autre.