Aller au contenu
Offre de rentrée · −50 % à vie sur la plateforme, pour toute souscription avant le 30 septembre. Voir l’offre
Recherche CiteMe

Ce qui vous crawle vraiment

385 057 requêtes d'agents IA sur vingt sites. Sept pour cent ne sont pas des agents IA, le plus gros crawler n'a jamais lu votre robots.txt, et aucune mesure d'efficacité ne classe les moteurs deux fois de la même façon.

Maxime Mansiet, Mael Bourdin, Alex Teillet · 15 septembre 2026

7.0%
du trafic « crawler IA » vise des chemins d’identifiants
0
robots.txt récupérés par Meta sur 71 547 requêtes
3,228
visites humaines attribuées à un moteur

Résumé

Nous avons enregistré chaque requête d'agent IA vers vingt sites pendant huit mois, en classant chacune selon ce que faisait l'agent : indexation, récupération d'une page pour répondre à quelqu'un, ou envoi d'une personne vers le site. Une part mesurable de ce que tous les outils GEO comptent comme trafic de crawler IA n'en est pas un.

Ce que contient le rapport

  1. 01Une part mesurable du trafic de crawler IA est du scan d'identifiants
  2. 02Deux signaux indépendants concordent, et l'un montre que la regex en manque la majeure partie
  3. 03Meta n'a jamais lu robots.txt. Anthropic le lit plus que le contenu
  4. 04Volume de crawl, couverture et référents sont trois classements différents
  5. 05Ce que les moteurs récupèrent en répondant n'est pas ce qu'ils crawlent
  6. 06Pourquoi les taux de citation par moteur s’inversent quand on contrôle les prompts

L'échantillon n'est pas un échantillon du web. Ce sont des sites qui ont acheté un produit de generative engine optimisation, ce qui biaise vers les organisations qui soupçonnaient déjà que la visibilité IA comptait pour elles. Agrégats uniquement : aucun site n'est identifié.385 057 requêtes, 20 sites, janvier à septembre 2026