Capter les crawlers IA
Les robots IA (GPTBot, ClaudeBot, PerplexityBot…) récupèrent votre HTML sans exécuter le JavaScript. Le tag w.js ne peut donc pas les voir : pour compter l'étage « Exploré » du parcours IA, il faut un petit module côté serveur. Cette page explique comment l'installer.
Pourquoi un module côté serveur
Un tag de mesure classique s'exécute dans le navigateur du visiteur. Un robot, lui, demande la page et repart : aucun JavaScript n'est joué, aucun événement n'est envoyé. Le module serveur comble ce trou. Il regarde le user-agent de chaque requête, et uniquement quand il reconnaît un robot IA, il signale la page à Snorklee.
Il ne touche jamais au trafic humain : vos visiteurs restent mesurés par w.js seul, sans double comptage.
Installer le module de votre plateforme
Chaque fichier est prêt à l'emploi, sans dépendance :
- WordPress — rien à faire, le module est inclus dans le plugin officiel et actif par défaut.
- Cloudflare —
cloudflare-worker.js, à déployer en Worker. Fonctionne devant n'importe quel site proxifié par Cloudflare, y compris Shopify, Webflow ou Wix. - Next.js / Vercel —
vercel-middleware.js, à déposer enmiddleware.jsà la racine du projet. - Netlify —
netlify-edge.js, à déposer dansnetlify/edge-functions/avec le path/*. - Node / Express —
node-express.js, middleware à monter avant vos routes. - PHP —
php-generic.php, à inclure en tête de page hors WordPress.
Le module est non bloquant : il n'attend jamais la réponse de Snorklee, et une panne réseau de notre côté ne ralentit ni ne casse votre page.
Régler votre domaine
En tête de chaque fichier, une seule valeur est à renseigner : votre domaine. Il doit être identique à l'attribut data-site de votre snippet w.js.
Une valeur différente désigne un site que Snorklee ne connaît pas : les signalements sont alors refusés et rien n'apparaît dans votre dashboard, sans message d'erreur visible côté site. C'est la première chose à vérifier si le compteur reste à zéro.
Vérifier que les robots sont bien détectés
Ouvrez l'onglet Trafic IA. Les passages de robots apparaissent dans la carte Crawlers IA et dans la console Qui lit quoi.
Ne vous inquiétez pas si rien ne s'affiche dans l'heure : les robots passent à leur propre rythme, parfois une fois par semaine sur un petit site. Comptez plusieurs jours avant de conclure à un problème.
« L'adresse du robot ne nous est pas parvenue »
Un user-agent se falsifie en une ligne de code. Quand l'éditeur d'un robot publie ses plages d'adresses IP, Snorklee y confronte chaque passage — c'est ce qui distingue un vrai GPTBot d'un aspirateur qui se fait passer pour lui.
Cette vérification a besoin de l'adresse du robot, que le module transmet dans un en-tête dédié. Si votre dashboard signale des passages « non confrontables », c'est que cette adresse n'arrive pas : le module est en place, mais une version ancienne, ou un proxy intermédiaire, a perdu l'information. Reprenez le fichier ci-dessus dans sa version courante — ce n'est pas une usurpation, juste une intégration à rafraîchir.
Là où ce n'est pas possible
Sur Wix, Squarespace, Webflow ou Framer en hébergement natif, aucun code ne peut s'exécuter côté serveur sur la requête de page : la captation des crawlers y est impossible. Le dashboard vous le dit clairement plutôt que d'afficher un zéro trompeur.
La seule parade est de placer le domaine derrière Cloudflare et d'utiliser le Worker. Les visites humaines venues des chats IA, elles, restent mesurées normalement sur toutes ces plateformes.