Analyses du secteur

Un guide pratique de Comprendre les agents IA, les chatbots et

Taras Shynkarenko
Taras Shynkarenko
•Mis à jour : •10 min de lecture
Un guide pratique de Comprendre les agents IA, les chatbots etUn guide pratique de Comprendre les agents IA, les chatbots et

TL;DR, Réponse rapide

10 min de lecture

Les systèmes d'IA interagissent avec les sites Web en tant que chatbots, moteurs de recherche, robots d'exploration, scrapers et agents dirigés par l'utilisateur. Traitez les références IA, les hits de robots et les mentions sans clic comme des signaux distincts au lieu d'un seul canal de trafic.

Le trafic IA n'est pas une seule chose, et comprendre les agents IA commence par distinguer un clic de référence ChatGPT, une requête de crawler et un scraper qui ne s'identifie jamais.

Le trafic IA n’est pas une chose. Un clic de référence ChatGPT, une demande de robot d'exploration OpenAI, une citation de source Perplexity, un agent d'automatisation de navigateur et un grattoir qui ne s'identifie jamais peuvent tous toucher votre site, mais ils signifient des choses différentes pour l'analyse.

L’erreur pratique est de les regrouper tous dans un seul compartiment appelé trafic IA. Cela cache la question à laquelle votre tableau de bord devrait répondre : s'agissait-il d'une visite humaine, d'une demande machine ou d'une mention hors site qui n'a jamais donné lieu à une visite ?

Les quatre interactions de l'IA qui méritent d'être séparées

1. Références IA des moteurs de réponse

Les produits de réponse IA peuvent envoyer de vrais visiteurs lorsque les utilisateurs cliquent sur une citation ou un lien source. Ces sessions apparaissent comme du trafic de référence provenant de domaines tels que chatgpt.com, perplexity.ai, claude.ai ou gemini.google.com, en fonction du contexte du produit et du navigateur. Ne présumez pas que ces référents sont stables ou complets ; certains contextes d'application, de navigateur et de confidentialité les suppriment ou les réécrivent.

Mesurez-les comme des sessions humaines, sauf indication contraire de vos contrôles de robot. Les questions utiles sont familières : quelles pages génèrent des citations, quels référents IA convertissent et si ces visiteurs se comportent différemment des visiteurs de recherche ou des réseaux sociaux.

Sessions de référence IA : compter ou vérifier
Traiter comme une session humaine
  • Référence depuis chatgpt.com, perplexity.ai, claude.ai ou gemini.google.com
  • Convertit ou atteint des pages à forte valeur
  • Se comporte comme les visiteurs issus de la recherche ou des réseaux sociaux
Vérifier avant de compter
  • Référent supprimé ou réécrit par l'application, le navigateur ou le contexte de confidentialité
  • Aucun contrôle de robots ne confirme une origine humaine
  • Le comportement ne correspond pas au trafic de référence habituel
Tous les clics de référents IA ne sont pas de vraies visites, et tous ne méritent pas d'être suspectés.

Rangées de baies de serveurs dans un centre de données, illustrant les requêtes automatisées des robots que cette section distingue des vrais visiteurs.

2. Robots d'exploration IA et robots d'indexation

Les sociétés d'IA exécutent des robots d'exploration pour découvrir ou récupérer du contenu Web. OpenAI documente des identités d'analyseur d'exploration distinctes, notamment GPTBot, OAI-SearchBot et ChatGPT-User, avec des objectifs et des jetons d'agent utilisateur différents. Google documente Googlebot pour la recherche et sépare les jetons d'exploration courants tels que Google-Extended pour certains cas d'utilisation de Gemini et Vertex AI (Google crawlers).

Les succès des robots ne constituent pas une demande du public. Ils peuvent gonfler les pages vues, déformer les rapports géographiques et déclencher des événements de type conversion si votre configuration d'analyse enregistre chaque demande. Conservez-les dans les journaux du serveur ou dans les rapports des robots, mais excluez-les des mesures normales de performances marketing.

3. Agents dirigés par l'utilisateur

Les agents IA sont plus délicats car ils agissent au nom d’un humain. Un utilisateur peut demander à un assistant de comparer les fournisseurs, de remplir un formulaire, de réserver une réunion ou de résumer les pages de tarification. Dans les journaux, ce trafic ressemble davantage à un navigateur qu'à un robot d'exploration. Il récupère JavaScript, suit des liens et interagit avec des formulaires. Ces assistants sont d'ailleurs plus faciles que jamais à déployer : avec un outil comme ClawOneClick, une entreprise peut lancer son propre assistant IA sur des canaux de messagerie tels que WhatsApp, Telegram, Discord ou Slack en un seul clic.

Traitez le trafic des agents comme une classe distincte lorsque vous pouvez l'identifier. Il ne s’agit ni d’un spam de robot ordinaire, ni d’une session humaine normale. L'intention commerciale peut être réelle, mais l'expérience de la page, le temps d'attente et la séquence d'événements peuvent être synthétiques.

4. Mentions IA sans clic

L’effet le plus important de l’IA n’apparaît jamais dans l’analyse Web. Si un moteur de réponse résume votre contenu et que l'utilisateur est satisfait, aucun clic de référence ne se produit. Votre contenu a influencé la décision, mais votre outil d'analyse ne voit rien.

Ceci est similaire à la recherche sans clic, mais plus difficile à mesurer car les interfaces de réponse varient et la visibilité de la source est incohérente. Vous pouvez le surveiller indirectement via des modifications de recherche de marque, des clics de référence à partir de domaines d'IA, des appels commerciaux mentionnant des outils d'IA et des vérifications ponctuelles manuelles de la couverture des réponses pour des sujets de grande valeur.

Suivre les mentions IA sans clic
Évolution des recherches de marque Variations des recherches sur le nom de votre marque
Clics de référence IA Sessions qui arrivent tout de même depuis des domaines IA
Mentions en appels commerciaux Prospects qui citent des outils IA
Vérifications manuelles Couverture des réponses pour les sujets à forte valeur
Sans clic, il n'y a pas de session, donc ces quatre vérifications sont la seule façon de voir l'influence.

Comment configurer Analytics sans polluer les rapports

Commencez par une taxonomie simple :

SignalExempleCompter comme trafic d'audience ?Où l'analyser
Séance de référencement IAUn utilisateur clique sur un lien source ChatGPTOuiRapports d'acquisition et de conversion
Requête du robot d'exploration IAGPTBot récupère un articleNonJournaux du serveur, analyses de robots, journaux CDN
Action de l'agent IAL'Assistant ouvre des pages pour une tâche utilisateurParfoisSegment séparé ou journal d'expérience
Mention IA sans clicVotre guide apparaît dans une réponseAucune visite n'existeSEO/suivi de marque, contrôles qualitatifs

Ajustez ensuite l’instrumentation :

  • Excluez les agents utilisateurs du robot d'exploration connus des analyses de pages vues.
  • Conservez les journaux bruts du serveur suffisamment longtemps pour auditer les pics inhabituels.
  • Segment Les référents IA constituent leur propre groupe source plutôt que de les mélanger dans un trafic de référence générique.
  • Évitez de compter les événements d'affichage de pages côté serveur provenant des prélecture, des extensions de liens et des robots d'exploration en tant que sessions.
  • Ajoutez des protections de formulaire afin que les soumissions automatisées ne deviennent pas des conversions de leads.

Si vous utilisez un CDN, la gestion des robots peut vous aider. AI Crawl Control de Cloudflare, par exemple, signale les catégories de robots d'exploration telles que GPTBot, ClaudeBot et Bytespider et aide les propriétaires de sites à comprendre comment les robots d'exploration IA interagissent avec une zone. Cela appartient à côté de l'analyse, et non à la même métrique que les pages vues par des humains.

Flowsery
Flowsery

Essai gratuit

Tableau de bord en temps réel

Suivi des objectifs

Suivi sans cookies

Robots.txt aide, mais ce n'est pas de l'analyse

Robots.txt exprime ses préférences envers les robots bien élevés. Il n’authentifie pas l’identité, ne bloque pas tout le trafic et ne prouve pas qu’une demande est légale. Le propre centre d'aide de Perplexity indique PerplexityBot honore robots.txt, tandis que Cloudflare a publiquement signalé des cas où il pensait qu'une partie du trafic de l'IA était obscurcie. La leçon n’est pas que tous les fournisseurs d’IA se comportent de la même manière. La leçon est que les analyses ne doivent pas s’appuyer uniquement sur robots.txt pour la classification.

Utilisez plusieurs signaux : agent utilisateur, DNS inversé ou plages IP publiées le cas échéant, taux de requêtes, modèles de chemin, exécution de JavaScript, comportement des cookies et scores du bot CDN. Soyez prudent avec un blocage agressif, car les récupérateurs dirigés par l'utilisateur peuvent faire partie du flux de travail d'un utilisateur réel.

Ce que le trafic IA signifie pour la stratégie de contenu

La découverte de l'IA change la valeur du contenu. Les pages qui répondent clairement à des questions spécifiques sont citées ou résumées même si elles ne génèrent pas de sessions organiques classiques. Cela rend la qualité des sources, les titres structurés, l’autorité et les définitions concises plus importants.

Pour les analyses de confidentialité de type Flowsery, le même principe de confidentialité s'applique : ne répondez pas à l'incertitude de l'IA en collectant davantage de données personnelles. Vous pouvez mesurer les performances de l’ère de l’IA avec des signaux agrégés :

  • Sessions de référencement IA par domaine source.
  • Pages de destination recevant des références IA.
  • Taux de conversion des visiteurs référencés par l'IA.
  • Volume d’exploration du robot par identité du robot.
  • Charge du serveur causée par des requêtes automatisées.
  • Pages de contenu mentionnées dans les appels commerciaux, les conversations d'assistance ou les enquêtes clients.

Un analyste à son bureau consultant des graphiques de trafic sur un ordinateur portable, en écho à la revue hebdomadaire décrite ici.

Une revue hebdomadaire pratique

Examinez le trafic IA séparément de SEO :

  1. Répertoriez les domaines référents IA et les pages de destination vers lesquelles ils ont envoyé du trafic.
  2. Vérifiez si des sessions de référencement IA ont été converties ou ont atteint des pages à forte intention.
  3. Comparez le trafic du robot d'exploration dans les journaux du serveur avec les vues de pages humaines.
  4. Enquêtez rapidement sur les pics qui frappent de nombreux URL ou ignorez les chemins de navigation normaux.
  5. Mettez à jour robots.txt uniquement après avoir décidé quels robots d'exploration vous souhaitez autoriser la recherche, les réponses IA, la formation de modèles ou la navigation dirigée par l'utilisateur.

L’objectif n’est pas de rendre l’analyse de l’IA parfaite. Le but est d’éviter de mélanger trois réalités différentes : des humains visitant votre site, des machines lisant votre site et des outils d’IA parlant de votre site ailleurs.

Liste de contrôle de classification du trafic IA

Pour chaque pic ou nouvelle source, classez-le avant de le signaler :

  • Session référente : à conserver dans les rapports d'acquisition si elle se comporte comme une visite humaine.
  • Robot d'exploration connu : exclure des métriques d'audience et examiner dans les journaux ou les analyses CDN.
  • Outil de récupération dirigé par l'utilisateur : segmentez séparément lorsqu'il est identifiable, car il peut représenter une intention humaine sans comportement de navigation normal.
  • Scraper ou robot anti-spam : filtrez les rapports marketing et protégez les formulaires.
  • Mentionner sans clic : suivez les canaux qualitatifs tels que les notes de vente, les enquêtes et la recherche de marque.

Cette taxonomie garantit l’honnêteté des tableaux de bord. L’influence de l’IA peut être réelle sans que chaque requête de la machine ne devienne du « trafic ».

Questions fréquentes

Quelle est la différence entre une référence IA et un robot d'exploration IA ?

Une référence IA est un vrai visiteur qui a cliqué sur un lien de citation ou de source dans un produit comme ChatGPT, Perplexity, Claude ou Gemini. Cette session doit compter comme une session humaine sauf si vos contrôles de robots indiquent le contraire. Un robot d'exploration IA est un bot comme GPTBot ou Googlebot qui récupère des pages pour les indexer ou les lire, et il appartient aux journaux serveur plutôt qu'aux métriques d'audience. Regrouper les deux dans un même panier appelé trafic IA masque quel chiffre a bougé et pourquoi.

GPTBot compte-t-il comme trafic du site ?

Non, GPTBot est une identité de robot que OpenAI documente aux côtés d'OAI-SearchBot et de ChatGPT-User, et les visites de robots ne représentent pas une vraie demande. Elles peuvent gonfler les pages vues et fausser les rapports géographiques si votre configuration d'analyse enregistre chaque requête, donc gardez-les dans les journaux serveur ou les rapports de bots plutôt que dans les métriques marketing.

Comment savoir si une référence ChatGPT est un vrai visiteur ?

Vérifiez si la session provient d'un domaine comme chatgpt.com et si vos contrôles de robots ne l'ont pas signalée. Les contextes d'application, de navigateur et de confidentialité suppriment ou réécrivent parfois ces référents. Regardez si le visiteur convertit ou se comporte comme un visiteur normal issu de la recherche ou des réseaux sociaux plutôt que de suivre un schéma de clics artificiel. Traitez-la comme une session humaine par défaut, sauf si un élément de votre configuration indique le contraire.

Qu'est-ce qu'un agent IA dirigé par l'utilisateur en analytique web ?

Un agent dirigé par l'utilisateur agit pour le compte d'une vraie personne, par exemple quand quelqu'un demande à un assistant de comparer des fournisseurs, remplir un formulaire ou résumer des pages de tarifs. Ce trafic peut ressembler à un navigateur classique dans les journaux car il charge du JavaScript, suit des liens et interagit avec des formulaires, mais le temps passé et la séquence d'événements peuvent rester artificiels. Segmentez-le à part dès que vous pouvez l'identifier, plutôt que de le mélanger aux catégories habituelles de bots ou d'humains.

Pourquoi robots.txt ne contrôle-t-il pas entièrement l'accès des robots IA ?

Robots.txt exprime seulement des préférences aux robots bien élevés, il n'authentifie pas d'identité, ne bloque pas tout le trafic et ne prouve pas qu'une requête est licite. Le centre d'aide de Perplexity indique que PerplexityBot respecte robots.txt, tandis que Cloudflare a publiquement rapporté des cas où il pensait qu'une partie du trafic IA était masquée. Cet écart signifie que l'analytique ne devrait pas se fier à robots.txt seul pour classer le trafic.

Que montre Cloudflare AI Crawl Control sur les robots IA ?

Cloudflare AI Crawl Control rapporte des catégories de robots comme GPTBot, ClaudeBot et Bytespider afin qu'un propriétaire de site voie comment les robots IA interagissent avec une zone. Il se place à côté de votre analytique comme un rapport de bots au niveau du CDN, pas dans la même métrique que les pages vues par des humains.

Flowsery
Flowsery

Essai gratuit

Tableau de bord en temps réel

Suivi des objectifs

Suivi sans cookies

Dois-je compter les mentions IA sans clic comme du trafic ?

Aucune visite n'existe quand un moteur de réponse résume votre contenu et que l'utilisateur ne clique jamais, donc il n'y a rien qu'un outil d'analytique web puisse compter. Vous pouvez tout de même suivre l'effet indirectement grâce aux évolutions de la recherche de marque, aux clics de référence IA, aux mentions lors d'appels commerciaux et aux vérifications manuelles de la couverture des réponses pour les sujets à forte valeur.

Quels domaines envoient du trafic de référence IA ?

Les sessions issues de produits de réponse IA apparaissent comme trafic de référence depuis des domaines tels que chatgpt.com, perplexity.ai, claude.ai ou gemini.google.com, selon le produit et le contexte du navigateur. Ces référents ne sont pas toujours stables ni complets, car certains contextes d'application, de navigateur et de confidentialité les suppriment ou les réécrivent avant que la session n'atteigne votre analytique.

À quelle fréquence dois-je examiner le trafic IA séparément du SEO ?

Une revue hebdomadaire fonctionne bien : listez les domaines de référents IA et les pages de destination qu'ils ont alimentées, puis vérifiez si l'une de ces sessions a converti ou atteint des pages à forte valeur. Comparez aussi le trafic de robots dans les journaux serveur aux pages vues par des humains. Examinez tout pic qui touche beaucoup d'URL rapidement ou ignore les parcours de navigation normaux, puis mettez à jour robots.txt seulement après avoir décidé quels robots vous voulez vraiment autoriser.

Qu'est-ce que Google-Extended et en quoi diffère-t-il de Googlebot ?

Googlebot explore pour la recherche, tandis que Google-Extended est un jeton distinct que Google documente pour certains usages liés à Gemini et Vertex AI. Les traiter comme le même robot brouille un rapport censé séparer l'indexation de recherche de la récupération liée à l'IA.

Cet article vous a-t-il été utile ?

Dites-nous ce que vous en pensez !

Nous voir plus souvent sur Google

Un clic définit Flowsery comme source préférée. Nos articles remontent alors dans vos À la une, en mode IA et dans les aperçus IA.

Avant de partir...

Flowsery

Flowsery

Des analyses orientées revenus pour votre site web

Suivez chaque visiteur, source et conversion en temps réel. Simple, puissant et sans cookies.

Tableau de bord en temps réel

Suivi des objectifs

Suivi sans cookies

Articles connexes