
Clarity de Microsoft ha lanzado una forma de identificar patrones que muestran cómo los rastreadores de inteligencia artificial (IA), los robots de búsqueda y los agentes automatizados interactúan con el contenido web mucho antes de que los agentes de IA proporcionen tráfico de citas o referencias a los editores o sitios web de contenido.
«Bot Activity», la función lanzada el jueves, está dirigida a propietarios de sitios web y profesionales digitales que necesitan identificar si el tráfico lo generan humanos o bots.
Proporciona una forma de identificar señales tempranas en los ciclos de contenido de IA.
Estas señales son valiosas porque representan la interacción observable más temprana entre el contenido y los sistemas de inteligencia artificial que ocurre antes de la actividad de conexión a tierra, citación o referencia.
La capacidad de identificar robots que rastrean un sitio web es a menudo la primera señal identificable de cómo los sistemas de inteligencia artificial pueden utilizar posteriormente el contenido, ya sea resumido o citado en los resultados de búsqueda o presentado en asistentes de inteligencia artificial. A diferencia de los rastreadores tradicionales, los sistemas de inteligencia artificial pueden acceder a contenido de forma continua en muchas plataformas en volúmenes significativos y a altas velocidades.
publicidad
publicidad
La medición es clave para responder preguntas para editores y propietarios de sitios, con nuevos tipos de preguntas, como la capacidad de identificar sistemas que acceden al contenido, si la actividad de los bots es productiva o costosa, y qué páginas pueden ser identificadas y accedidas de manera más agresiva por los bots.
AI Bot Activity de Microsoft proporciona datos sobre cómo los bots verificados interactúan con el contenido de un sitio web. En lugar de tratar el tráfico de los rastreadores como ruido de fondo, Clarity lo convierte en datos que los editores y especialistas en marketing pueden medir y analizar. Pone a disposición los datos para identificar con qué frecuencia el bot rastrea el sitio, así como para identificar las páginas, rutas y recursos.
Los datos identifican con qué frecuencia los agentes y bots de IA acceden al contenido y con qué fines, como indexación, preparación de recuperación, generación de incrustaciones u otros flujos de trabajo impulsados por IA.
Los datos de Microsoft publicados en diciembre muestran cómo los asistentes de inteligencia artificial han remodelado los patrones de tráfico de los sitios web. Las investigaciones muestran que las referencias de IA crecieron un 155% en un período de ocho meses. Examinó el tráfico de ChatGPT, Microsoft Copilot, Google Gemini y plataformas similares después de que generaron referencias a sitios web de origen.
La actividad de los bots se basa en datos de registro del lado del servidor recopilados a través de integraciones de CDN, datos que los análisis del lado del cliente no pueden ver.
Microsoft señala que la conexión a un servidor o la integración de CDN puede generar costos adicionales según el proveedor, la plataforma en la nube, el volumen de tráfico y la configuración regional.
Después de conectarse, Clarity comienza a procesar registros del lado del servidor para mostrar la actividad de rastreo. La métrica del operador de bots muestra la proporción de tráfico del sitio web generado por bots y agentes automatizados en lugar de usuarios humanos. De forma predeterminada, esta vista se centra en robots y rastreadores relacionados con la IA.
La métrica principal refleja la proporción del total de solicitudes que se originan a partir de la actividad del bot. Un valor alto indica que el acceso automático representa una parte importante de su tráfico total. Estos conocimientos pueden respaldar la planificación de la infraestructura, la optimización del rendimiento, las decisiones de disponibilidad de contenido y las evaluaciones de si la actividad de los bots contribuye al valor posterior.
La métrica Solicitudes de ruta destaca las páginas y recursos que reciben la mayor cantidad de solicitudes automatizadas. Las solicitudes se agregan a nivel de ruta e incluyen tipos de contenido como páginas HTML, imágenes, puntos finales JSON, archivos XML y otros activos.

