list_ai_crawler_visits

Tool MCP list_ai_crawler_visits : les visites brutes des robots IA depuis Cloudflare AI Crawl Control, une ligne par jour, chemin, robot et statut HTTP. Filtres par date, robot, entreprise, type, chemin ou codes de statut.

Mis à jour le 2026-09-29

list_ai_crawler_visits renvoie les visites brutes des robots IA stockées pour le projet, une ligne par jour, chemin d'URL, robot et statut HTTP, avec le nombre de visites. C'est la donnée derrière les autres tools Robots IA, pour les analyses qu'ils ne couvrent pas.

Les visites viennent de Cloudflare AI Crawl Control, synchronisées chaque nuit jusqu'à hier une fois le projet connecté à Cloudflare depuis sa page Robots IA. L'historique commence 7 jours avant la connexion.

Quand l'utiliser

Quand les tools agrégés ne suffisent pas : exporter un mois de visites dans un tableur, lister toutes les 404 servies aux robots IA, suivre un robot sur une page jour par jour, ou construire votre propre graphique dans un agent.

Pour les totaux, les tendances et le classement des pages, get_ai_crawler_overview et list_ai_crawler_pages répondent en un appel, sans pagination. Le tool lit des données déjà stockées et ne consomme aucun crédit.

Input

Champ Type Défaut Description
projectId string (CUID) requis Projet interrogé.
cursor string Curseur opaque issu d'un pageInfo.nextCursor précédent.
limit entier 20 De 1 à 100.
filters.dateRange { from?, to? } 30 derniers jours complets Jours UTC, bornes incluses. to vaut hier par défaut, le dernier jour synchronisé.
filters.crawlers string[] Identifiants de robots, par exemple chatgpt-user, gptbot, claudebot.
filters.operators string[] OpenAI, Anthropic, Perplexity, Mistral, DuckDuckGo, Apple, Amazon, Meta, ByteDance, Common Crawl.
filters.kinds string[] user (lectures pour répondre), search (indexation recherche), training (collecte entraînement).
filters.path string Chemin d'URL exact, qui commence par /, 500 caractères au plus.
filters.pathContains string Portion du chemin d'URL, sensible à la casse, 200 caractères au plus. Ignoré quand path est renseigné.
filters.statuses entier[] Codes de statut HTTP, par exemple [404, 500].
sortBy enum date_desc date_desc (jour le plus récent d'abord, puis le plus de visites), visits_desc.

Les identifiants de robots, entreprises et types sont listés sur get_ai_crawler_overview. Tous les filtres se cumulent.

Réponse

data contient une ligne par jour, chemin, robot et statut, pageInfo l'enveloppe de pagination habituelle, et summary la période réellement lue et le dernier jour synchronisé.

{
  "data": [
    {
      "id": "cmg4k2x9p0004l20812hd7fqa",
      "date": "2026-09-28",
      "path": "/blog/anciens-tarifs",
      "crawler": "chatgpt-user",
      "label": "ChatGPT-User",
      "operator": "OpenAI",
      "kind": "user",
      "status": 404,
      "visits": 6
    },
    {
      "id": "cmg4k2x9p0005l208a3kq1zte",
      "date": "2026-09-27",
      "path": "/blog/anciens-tarifs",
      "crawler": "gptbot",
      "label": "GPTBot",
      "operator": "OpenAI",
      "kind": "training",
      "status": 404,
      "visits": 4
    }
  ],
  "pageInfo": { "hasMore": true, "nextCursor": "cmg4k2x9p0005l208a3kq1zte", "totalCount": 23 },
  "summary": {
    "connected": true,
    "dateRange": { "from": "2026-08-30", "to": "2026-09-28" },
    "syncedThrough": "2026-09-28"
  }
}
  • date : le jour UTC des visites (YYYY-MM-DD).
  • path : le chemin d'URL, sans le domaine et sans barre oblique finale.
  • crawler, label, operator, kind : l'identifiant du robot et de quoi le lire. kind vaut user (lecture pour répondre), search (indexation recherche) ou training (collecte entraînement).
  • status : le statut HTTP servi par le site.
  • visits : le nombre de visites ce jour-là pour ce chemin, ce robot et ce statut.

pageInfo.totalCount compte toutes les lignes qui passent les filtres. Quand le projet n'est pas connecté à Cloudflare, le tool renvoie un data vide avec summary: { "connected": false }. Une période invalide (from après to) ou des filtres qui ne correspondent à aucun robot renvoient un data vide avec summary: { "connected": true }.

Conseils et patterns

  • filters: { statuses: [404, 410, 500, 502, 503] } avec sortBy: "visits_desc" liste les URL cassées que les robots IA touchent le plus. Redirigez-les ou corrigez-les en premier.
  • filters: { path: "/tarifs", kinds: ["user"] } suit les lectures pour répondre d'une page jour par jour.
  • Les lignes sont déjà regroupées par jour. Additionnez visits côté agent pour regrouper par semaine, par entreprise ou par rubrique.
  • Pour un gros export, gardez limit: 100 et suivez nextCursor jusqu'à ce que hasMore vaille false.

Tools liés

Vous pouvez voir où vous en êtes dès aujourd'hui.

Essai gratuit. Lancez le suivi de votre visibilité IA, sans carte.