list_ai_crawler_visits
Tool MCP list_ai_crawler_visits : les visites brutes des robots IA depuis Cloudflare AI Crawl Control, une ligne par jour, chemin, robot et statut HTTP. Filtres par date, robot, entreprise, type, chemin ou codes de statut.
Mis à jour le 2026-09-29
list_ai_crawler_visits renvoie les visites brutes des robots IA stockées pour le projet, une ligne par jour, chemin d'URL, robot et statut HTTP, avec le nombre de visites. C'est la donnée derrière les autres tools Robots IA, pour les analyses qu'ils ne couvrent pas.
Les visites viennent de Cloudflare AI Crawl Control, synchronisées chaque nuit jusqu'à hier une fois le projet connecté à Cloudflare depuis sa page Robots IA. L'historique commence 7 jours avant la connexion.
Quand l'utiliser
Quand les tools agrégés ne suffisent pas : exporter un mois de visites dans un tableur, lister toutes les 404 servies aux robots IA, suivre un robot sur une page jour par jour, ou construire votre propre graphique dans un agent.
Pour les totaux, les tendances et le classement des pages, get_ai_crawler_overview et list_ai_crawler_pages répondent en un appel, sans pagination. Le tool lit des données déjà stockées et ne consomme aucun crédit.
Input
| Champ | Type | Défaut | Description |
|---|---|---|---|
projectId |
string (CUID) | requis | Projet interrogé. |
cursor |
string | Curseur opaque issu d'un pageInfo.nextCursor précédent. |
|
limit |
entier | 20 | De 1 à 100. |
filters.dateRange |
{ from?, to? } |
30 derniers jours complets | Jours UTC, bornes incluses. to vaut hier par défaut, le dernier jour synchronisé. |
filters.crawlers |
string[] | Identifiants de robots, par exemple chatgpt-user, gptbot, claudebot. |
|
filters.operators |
string[] | OpenAI, Anthropic, Perplexity, Mistral, DuckDuckGo, Apple, Amazon, Meta, ByteDance, Common Crawl. |
|
filters.kinds |
string[] | user (lectures pour répondre), search (indexation recherche), training (collecte entraînement). |
|
filters.path |
string | Chemin d'URL exact, qui commence par /, 500 caractères au plus. |
|
filters.pathContains |
string | Portion du chemin d'URL, sensible à la casse, 200 caractères au plus. Ignoré quand path est renseigné. |
|
filters.statuses |
entier[] | Codes de statut HTTP, par exemple [404, 500]. |
|
sortBy |
enum | date_desc |
date_desc (jour le plus récent d'abord, puis le plus de visites), visits_desc. |
Les identifiants de robots, entreprises et types sont listés sur get_ai_crawler_overview. Tous les filtres se cumulent.
Réponse
data contient une ligne par jour, chemin, robot et statut, pageInfo l'enveloppe de pagination habituelle, et summary la période réellement lue et le dernier jour synchronisé.
{
"data": [
{
"id": "cmg4k2x9p0004l20812hd7fqa",
"date": "2026-09-28",
"path": "/blog/anciens-tarifs",
"crawler": "chatgpt-user",
"label": "ChatGPT-User",
"operator": "OpenAI",
"kind": "user",
"status": 404,
"visits": 6
},
{
"id": "cmg4k2x9p0005l208a3kq1zte",
"date": "2026-09-27",
"path": "/blog/anciens-tarifs",
"crawler": "gptbot",
"label": "GPTBot",
"operator": "OpenAI",
"kind": "training",
"status": 404,
"visits": 4
}
],
"pageInfo": { "hasMore": true, "nextCursor": "cmg4k2x9p0005l208a3kq1zte", "totalCount": 23 },
"summary": {
"connected": true,
"dateRange": { "from": "2026-08-30", "to": "2026-09-28" },
"syncedThrough": "2026-09-28"
}
}
date: le jour UTC des visites (YYYY-MM-DD).path: le chemin d'URL, sans le domaine et sans barre oblique finale.crawler,label,operator,kind: l'identifiant du robot et de quoi le lire.kindvautuser(lecture pour répondre),search(indexation recherche) outraining(collecte entraînement).status: le statut HTTP servi par le site.visits: le nombre de visites ce jour-là pour ce chemin, ce robot et ce statut.
pageInfo.totalCount compte toutes les lignes qui passent les filtres. Quand le projet n'est pas connecté à Cloudflare, le tool renvoie un data vide avec summary: { "connected": false }. Une période invalide (from après to) ou des filtres qui ne correspondent à aucun robot renvoient un data vide avec summary: { "connected": true }.
Conseils et patterns
filters: { statuses: [404, 410, 500, 502, 503] }avecsortBy: "visits_desc"liste les URL cassées que les robots IA touchent le plus. Redirigez-les ou corrigez-les en premier.filters: { path: "/tarifs", kinds: ["user"] }suit les lectures pour répondre d'une page jour par jour.- Les lignes sont déjà regroupées par jour. Additionnez
visitscôté agent pour regrouper par semaine, par entreprise ou par rubrique. - Pour un gros export, gardez
limit: 100et suiveznextCursorjusqu'à ce quehasMorevaille false.
Tools liés
get_ai_crawler_overview: la même donnée résumée pour tout le sitelist_ai_crawler_pages: la même donnée regroupée par page, avec les citationsget_ai_crawler_page: une page en détail