Perspectivas del sector

Una guía práctica de Comprender los agentes de IA, los chatbots

Taras Shynkarenko
Taras Shynkarenko
•Actualizado: •10 min de lectura
Una guía práctica de Comprender los agentes de IA, los chatbotsUna guía práctica de Comprender los agentes de IA, los chatbots

TL;DR, Respuesta rápida

10 min de lectura

Los sistemas de inteligencia artificial interactúan con sitios web como chatbots, motores de respuesta de búsqueda, rastreadores, scrapers y agentes dirigidos por el usuario. Trata las referencias de IA, las visitas de bots y las menciones sin clic como señales separadas en lugar de un solo canal de tráfico.

El tráfico de IA no es una sola cosa, y comprender los agentes de IA empieza por distinguir un clic de referencia de ChatGPT, una petición de rastreador y un scraper que nunca se identifica.

El tráfico de IA no es una sola cosa. Un clic de referencia de ChatGPT, una solicitud de rastreador de OpenAI, una cita de fuente de Perplexity, un agente de automatización del navegador y un raspador que nunca se identifica pueden afectar tu sitio, pero significan cosas diferentes para el análisis.

El error práctico es ponerlos a todos en un solo grupo llamado tráfico de IA. Eso oculta la pregunta que tu panel debería responder: ¿fue una visita humana, una solicitud de una máquina o una mención externa que nunca produjo una visita?

Las cuatro interacciones de IA que vale la pena separar

1. Referencias de IA de motores de respuesta

Los productos de respuesta de IA pueden enviar visitantes reales cuando los usuarios hacen clic en una cita o en un enlace de fuente. Estas sesiones aparecen como tráfico de referencia de dominios como chatgpt.com, perplexity.ai, claude.ai o gemini.google.com, según el producto y el contexto del navegador. No asumas que esos referentes son estables o completos; algunas aplicaciones, navegadores y contextos de privacidad los eliminan o reescriben.

Mídelos como sesiones humanas a menos que los controles de bots indiquen lo contrario. Las preguntas útiles son familiares: qué páginas obtienen citas, qué referentes de IA generan conversiones y si esos visitantes se comportan de manera diferente a los visitantes de búsqueda o sociales.

Sesiones de referencia de IA: contar o verificar
Tratar como sesión humana
  • Referencia desde chatgpt.com, perplexity.ai, claude.ai o gemini.google.com
  • Convierte o llega a páginas de alto valor
  • Se comporta como visitantes de búsqueda o redes sociales
Verificar antes de contar
  • El referente fue eliminado o reescrito por la app, el navegador o el contexto de privacidad
  • Ningún control de bots confirma el origen humano
  • El comportamiento no coincide con el tráfico de referencia normal
No todos los clics de referentes de IA son visitas reales, y no todos merecen sospecha.

Filas de racks de servidores en un centro de datos, en referencia a las solicitudes automatizadas de rastreadores que esta sección separa de los visitantes reales.

2. Rastreadores de IA y robots de indexación

Las empresas de inteligencia artificial ejecutan rastreadores para descubrir o recuperar contenido web. OpenAI documenta identidades de rastreadores separados, incluidos GPTBot, OAI-SearchBot y ChatGPT-User, con diferentes propósitos y tokens de agente de usuario. Google documenta el robot de Google para búsqueda y tokens de rastreador comunes separados, como Google-Extended, para algunos casos de uso de Gemini y Vertex AI (rastreadores de Google).

Los éxitos del rastreador no son una demanda de la audiencia. Pueden inflar las visitas a la página, distorsionar los informes geográficos y desencadenar eventos similares a las conversiones si tu configuración de análisis registra cada solicitud. Manténgalos en los registros del servidor o en los informes de los bots, pero exclúyalos de las métricas normales de rendimiento de marketing.

3. Agentes dirigidos por el usuario

Los agentes de IA son más complicados porque actúan en nombre de un humano. Un usuario puede pedirle a un asistente que compare proveedores, complete un formulario, programe una reunión o resuma páginas de precios. En los registros, ese tráfico se parece más a un navegador que a un rastreador. Recupera JavaScript, sigue enlaces e interactúa con formularios. Además, estos asistentes son más fáciles de implementar que nunca: con una herramienta como ClawOneClick, una empresa puede lanzar su propio asistente de IA en canales de mensajería como WhatsApp, Telegram, Discord o Slack con un solo clic.

Trata el tráfico de agentes como una clase separada cuando pueda identificarlo. No es un spam de bot común ni una sesión humana normal. La intención comercial puede ser real, pero la experiencia de la página, el tiempo de permanencia y la secuencia de eventos pueden ser sintéticos.

4. Menciones de IA sin hacer clic

El mayor efecto de la IA nunca aparece en la analítica web. Si un motor de respuesta resume tu contenido y el usuario está satisfecho, no se produce ningún clic de referencia. Tu contenido influyó en la decisión, pero tu herramienta de analítica no ve nada.

Esto es similar a la búsqueda sin clic, pero es más difícil de medir porque las interfaces de respuesta varían y la visibilidad de la fuente es inconsistente. Puedes monitorearlo indirectamente a través de cambios de búsqueda de marca, clics de referencias desde dominios de IA, llamadas de ventas que mencionan herramientas de IA y verificaciones manuales al azar de la cobertura de respuestas para temas de alto valor.

Cómo rastrear menciones de IA sin clic
Cambios en la búsqueda de marca Variaciones en las búsquedas de tu nombre de marca
Clics de referencia de IA Sesiones que sí llegan desde dominios de IA
Menciones en llamadas de ventas Prospectos que mencionan herramientas de IA
Revisiones manuales Cobertura de respuestas para temas de alto valor
Sin clic no hay sesión, así que estas cuatro comprobaciones son la única forma de ver la influencia.

Cómo configurar análisis sin informes contaminantes

Empieza con una taxonomía simple:

SeñalEjemplo¿Cuenta como tráfico de audiencia?Dónde analizarlo
Sesión de referencia de IAUn usuario hace clic en un enlace de origen ChatGPTSíInformes de adquisición y conversión
Solicitud de rastreador de IAGPTBot recupera un artículoNoRegistros de servidor, análisis de bots, registros de CDN
Acción del agente de IAAsistente abre páginas para una tarea de usuarioA vecesSegmento separado o registro de experimentos
Mención de IA sin clicTu guía aparece en una respuestaNo existe visitaSEO/seguimiento de marca, controles cualitativos

Luego ajuste la instrumentación:

  • Excluir agentes de usuario de rastreadores conocidos del análisis de vistas de página.
  • Mantén los registros del servidor sin procesar el tiempo suficiente para auditar picos inusuales.
  • Segmenta las referencias de IA como su propio grupo de origen en lugar de mezclarlas en tráfico de referencia genérico.
  • Evita contar como sesiones los eventos de visualización de páginas del lado del servidor provenientes de captadores previos, expansores de enlaces y rastreadores.
  • Agrega protecciones de formulario para que los envíos automáticos no se conviertan en conversiones de clientes potenciales.

Si utilizas una CDN, la gestión de bots puede ayudar. El control de rastreo de IA de Cloudflare, por ejemplo, informa categorías de rastreadores como GPTBot, ClaudeBot y Bytespider y ayuda a los propietarios de sitios a comprender cómo interactúan los rastreadores de IA con una zona. Eso pertenece al lado de la analítica, no dentro de la misma métrica que las visitas a páginas humanas.

Flowsery
Flowsery

Prueba gratuita

Panel en tiempo real

Seguimiento de objetivos

Rastreo sin cookies

Robots.txt ayuda, pero no es análisis

Robots.txt expresa preferencias por bots que se portan bien. No autentica la identidad, no bloquea todo el tráfico ni demuestra que una solicitud es legal. El propio centro de ayuda de Perplexity dice PerplexityBot honra a los robots.txt, mientras que Cloudflare ha informado públicamente de casos en los que creía que parte del tráfico de IA estaba ofuscado. La lección no es que todos los proveedores de IA se comporten de la misma manera. La lección es que la analítica no debe depender únicamente del archivo robots.txt para la clasificación.

Utiliza múltiples señales: agente de usuario, DNS inverso o rangos de IP publicados cuando estén disponibles, tasa de solicitudes, patrones de ruta, ejecución de JavaScript, comportamiento de cookies y puntuaciones de bots de CDN. Ten cuidado con el bloqueo agresivo, porque los buscadores dirigidos por el usuario pueden ser parte del flujo de trabajo de un usuario real.

Qué significa el tráfico de IA para la estrategia de contenidos

El descubrimiento de IA cambia el valor del contenido. Las páginas que responden claramente a preguntas específicas se citan o se resumen incluso si no generan sesiones orgánicas clásicas. Eso hace que la calidad de las fuentes, los títulos estructurados, la autoridad y las definiciones concisas sean más importantes.

Para el análisis de privacidad estilo Flowsery, se aplica el mismo principio de privacidad: no responder a la incertidumbre de la IA recopilando más datos personales. Puedes medir el rendimiento de la era de la IA con señales agregadas:

  • Sesiones de referencia de IA por dominio de origen.
  • Páginas de destino que reciben referencias de IA.
  • Tasa de conversión de visitantes referidos por IA.
  • Volumen de rastreo de bots por identidad del rastreador.
  • Carga del servidor causada por solicitudes automatizadas.
  • Páginas de contenido mencionadas en llamadas de ventas, conversaciones de soporte o encuestas a clientes.

Un analista en su escritorio revisando gráficos de tráfico en un portátil, en línea con la revisión semanal descrita aquí.

Una revisión semanal práctica

Revise el tráfico de IA por separado de SEO:

  1. Enumere los dominios de referencia de IA y las páginas de destino a las que enviaron tráfico.
  2. Verifique si alguna sesión de referencia de IA se convirtió o alcanzó páginas de alta intención.
  3. Compare el tráfico del rastreador en los registros del servidor con las vistas de páginas humanas.
  4. Investigue los picos que afectan rápidamente a muchos URLs o ignore las rutas de navegación normales.
  5. Actualice robots.txt solo después de decidir qué rastreadores desea permitir para búsquedas, respuestas de IA, entrenamiento de modelos o navegación dirigida por el usuario.

El objetivo no es perfeccionar el análisis de IA. El objetivo es evitar mezclar tres realidades diferentes: humanos que visitan tu sitio, máquinas que leen tu sitio y herramientas de inteligencia artificial que hablan de tu sitio en otro lugar.

Lista de verificación de clasificación de tráfico de IA

Para cada pico o fuente nueva, clasifíquelo antes de informarlo:

  • Sesión de referente: mantener en los informes de adquisición si se comporta como una visita humana.
  • Rastreador conocido: excluir de las métricas de audiencia y revisar en registros o análisis de CDN.
  • Recuperador dirigido por el usuario: segmenta por separado cuando es identificable porque puede representar una intención humana sin un comportamiento de navegación normal.
  • Scraper o spam bot: filtra los informes de marketing y protege los formularios.
  • Mención sin clic: seguimiento a través de canales cualitativos como notas de ventas, encuestas y búsqueda de marcas.

Esta taxonomía mantiene los paneles honestos. La influencia de la IA puede ser real sin que cada solicitud de la máquina se convierta en "tráfico".

Preguntas frecuentes

¿Cuál es la diferencia entre una referencia de IA y un rastreador de IA?

Una referencia de IA es un visitante real que hizo clic en un enlace de cita o fuente dentro de un producto como ChatGPT, Perplexity, Claude o Gemini. Esa sesión debe contarse como sesión humana salvo que tus controles de bots indiquen lo contrario. Un rastreador de IA es un bot como GPTBot o Googlebot que obtiene páginas para indexarlas o recuperarlas, y pertenece a los registros del servidor y no a las métricas de audiencia. Meter ambos en un mismo cajón llamado tráfico de IA oculta qué cifra se movió y por qué.

¿Cuenta GPTBot como tráfico del sitio web?

No, GPTBot es una identidad de rastreador que OpenAI documenta junto a OAI-SearchBot y ChatGPT-User, y los accesos de rastreadores no son demanda de audiencia. Pueden inflar las páginas vistas y distorsionar los informes geográficos si tu configuración de analítica registra cada solicitud, así que consérvalos en registros de servidor o informes de bots en lugar de en métricas de marketing.

¿Cómo sé si una referencia de ChatGPT es un visitante real?

Comprueba si la sesión proviene de un dominio como chatgpt.com y si tus controles de bots no la han marcado. Los contextos de app, navegador y privacidad a veces eliminan o reescriben estos referentes. Observa si el visitante convierte o se comporta como un visitante normal de búsqueda o redes sociales en lugar de seguir un patrón de clics sintético. Trátalo como sesión humana por defecto salvo que algo en tu configuración indique lo contrario.

¿Qué es un agente de IA dirigido por el usuario en la analítica web?

Un agente dirigido por el usuario actúa en nombre de una persona real, por ejemplo cuando alguien le pide a un asistente comparar proveedores, rellenar un formulario o resumir páginas de precios. Este tráfico puede parecer un navegador normal en los registros porque carga JavaScript, sigue enlaces e interactúa con formularios, pero el tiempo de permanencia y la secuencia de eventos pueden seguir siendo sintéticos. Sepáralo en su propio segmento en cuanto puedas identificarlo, en lugar de mezclarlo con las categorías comunes de bots o humanos.

¿Por qué robots.txt no controla del todo el acceso de los rastreadores de IA?

Robots.txt solo expresa preferencias a bots bien portados, así que no autentica identidad, no bloquea todo el tráfico ni demuestra que una solicitud sea legítima. El centro de ayuda de Perplexity afirma que PerplexityBot respeta robots.txt, mientras que Cloudflare ha reportado públicamente casos en los que creyó que parte del tráfico de IA estaba ofuscado. Esa brecha significa que la analítica no debería depender solo de robots.txt para clasificar el tráfico.

¿Qué muestra Cloudflare AI Crawl Control sobre los rastreadores de IA?

Cloudflare AI Crawl Control reporta categorías de rastreadores como GPTBot, ClaudeBot y Bytespider para que el dueño del sitio vea cómo interactúan los rastreadores de IA con una zona. Se ubica junto a tu analítica como un informe de bots a nivel de CDN, no dentro de la misma métrica que las páginas vistas por humanos.

Flowsery
Flowsery

Prueba gratuita

Panel en tiempo real

Seguimiento de objetivos

Rastreo sin cookies

¿Debo contar las menciones de IA sin clic como tráfico?

No existe visita cuando un motor de respuesta resume tu contenido y el usuario nunca hace clic, así que no hay nada que una herramienta de analítica web pueda contar. Aun así puedes rastrear el efecto de forma indirecta con cambios en la búsqueda de marca, clics de referencia de IA, menciones en llamadas de ventas y revisiones manuales de la cobertura de respuestas para temas de alto valor.

¿Qué dominios envían tráfico de referencia de IA?

Las sesiones de productos de respuesta de IA aparecen como tráfico de referencia desde dominios como chatgpt.com, perplexity.ai, claude.ai o gemini.google.com, según el producto y el contexto del navegador. Estos referentes no siempre son estables ni completos, ya que algunos contextos de app, navegador y privacidad los eliminan o reescriben antes de que la sesión llegue a tu analítica.

¿Con qué frecuencia debo revisar el tráfico de IA por separado del SEO?

Una revisión semanal funciona bien: enumera los dominios de referentes de IA y las páginas de destino a las que enviaron tráfico, y después comprueba si alguna de esas sesiones convirtió o llegó a páginas de alto interés. Compara además el tráfico de rastreadores en los registros del servidor con las páginas vistas por humanos. Investiga cualquier pico que golpee muchas URL rápidamente o ignore las rutas de navegación normales, y actualiza robots.txt solo después de decidir qué rastreadores quieres permitir de verdad.

¿Qué es Google-Extended y en qué se diferencia de Googlebot?

Googlebot rastrea para la Búsqueda, mientras que Google-Extended es un token distinto que Google documenta para algunos casos de uso de Gemini y Vertex AI. Tratarlos como el mismo rastreador difumina un informe que debería separar la indexación de búsqueda del rastreo relacionado con IA.

¿Te resultó útil este artículo?

¡Cuéntanos qué opinas!

Vernos más en Google

Un clic marca Flowsery como fuente preferida y nuestros artículos aparecen más arriba en tus Noticias destacadas, el modo IA y los resúmenes con IA.

Antes de irte...

Flowsery

Flowsery

Analítica orientada a ingresos para tu sitio web

Rastrea cada visitante, fuente y conversión en tiempo real. Simple, potente y sin cookies.

Panel en tiempo real

Seguimiento de objetivos

Rastreo sin cookies

Artículos relacionados