Activité Web contient l'historique des accès que votre site web a reçus. Chaque ligne représente une requête spécifique faite au serveur : par exemple, quelqu'un ouvrant une page, un navigateur demandant une image, un formulaire envoyant des données, un outil automatisé tentant d'accéder à une route spécifique, ou un bot explorant votre site.En termes simples, cette collection est l'enregistrement le plus "brut" et le plus complet de ce qui s'est passé sur votre site web au niveau du trafic. Elle ne regroupe pas les informations par session et ne résume pas le comportement d'une visite complète, mais stocke chaque accès séparément pour une analyse plus détaillée.
Cela en fait une collection particulièrement utile lorsque vous souhaitez répondre à des questions comme :
Activité Web sert à observer en détail ce qui se passe sur un site web du point de vue du serveur. Bien qu'elle contienne des champs techniques, elle peut également être très utile pour des profils non techniques si elle est interprétée avec une logique simple.Par exemple, cette collection vous permet de :
referer.Activité Web est de penser comme suit :Si vous voulez une vue d'ensemble du comportement des utilisateurs, il est généralement plus facile de travailler avec une collection comme Visites.
Si vous voulez entrer dans le détail et voir exactement ce qui s'est passé sur le serveur, la collection appropriée est Accès Web.
| Champ | Type | Description |
|---|---|---|
| abuse_score | Nombre | Score de risque de l'adresse IP, entre 0 et 100. |
| c_date | Date et heure | Date et heure de la requête HTTP dans le fuseau horaire UTC. |
| domain_sub | Catégoriel | Sous-domaine vers lequel la requête était dirigée. |
| http_version | Catégoriel | Version du protocole HTTP utilisée (HTTP/1.0, HTTP/1.1, HTTP/2 ou HTTP/3). |
| ip | Catégoriel | Adresse IP à l'origine de la requête. |
| method | Catégoriel | Méthode HTTP utilisée, comme GET ou POST. |
| referer | Catégoriel | Page d'où provient l'utilisateur, si disponible. |
| resource_path | Catégoriel | Chemin de la ressource demandée, sans les paramètres de l'URL. |
| url | Catégoriel | Adresse URL complète demandée. |
| user_agent | Catégoriel | Informations sur le navigateur, l'application ou l'appareil qui a effectué la requête. |
| user_fingerprint | Catégoriel | Identifiant généré à partir de l'adresse IP et du User-Agent. |
| status_code | Nombre | Code de réponse HTTP renvoyé par le serveur (200, 301, 404, 500, etc.). |
| total_visits | Nombre | Nombre de visites enregistrées pour cet événement. A généralement la valeur 1 et est utilisé pour les agrégations. |
| response_size | Nombre | Taille de la réponse envoyée par le serveur, en octets. |
| x_forwarded_for | Catégoriel | Adresse IP du client d'origine lorsque la requête est passée par un proxy ou un équilibreur de charge. |
| utm_* | Catégoriel | Valeur de tout paramètre UTM présent dans l'URL (par exemple, utm_source, utm_medium, utm_campaign, utm_term ou utm_content). |
abuse_score Type de données : numérique
Ce champ indique un score de risque associé à l'IP qui a effectué la requête. Son objectif est d'aider à détecter si l'accès pourrait provenir d'une source suspecte. En termes simples, plus cette valeur est élevée, plus il est probable que cette IP soit liée à une activité indésirable, comme des bots, des analyses ou des comportements malveillants.
Cela ne signifie pas automatiquement qu'une IP est dangereuse, mais cela sert d'indicateur pour y prêter plus d'attention.
Exemple d'utilisation :
abuse_score élevé,
c_date C'est la date exacte à laquelle la requête a été enregistrée. Elle permet de placer chaque accès dans le temps. Grâce à elle, vous pouvez filtrer par plages de dates, détecter des moments d'activité maximale ou analyser quand une erreur ou un pic de trafic s'est produit.
domain_sub Indique le domaine ou sous-domaine qui a reçu la requête. Il sert à distinguer à quelle partie de votre infrastructure web cette requête était destinée. Ceci est particulièrement utile si vous gérez plusieurs domaines ou sous-domaines et souhaitez séparer l'activité de chacun.
Exemple d'utilisation :
vous pouvez voir si un accès était destiné au domaine principal, à un sous-domaine administratif, à une zone interne ou à un environnement spécifique.
http_version Type de données : texte catégoriel
Affiche la version du protocole HTTP utilisée dans la requête, par exemple HTTP/1.1 ou HTTP/2.0. Pour une personne non technique, ce champ n'est généralement pas une priorité dans l'analyse normale, mais il peut avoir de la valeur lorsque vous souhaitez examiner la compatibilité technique ou les modèles spécifiques de certains clients.
ip Type de données : texte catégoriel
Il s'agit de l'adresse IP à l'origine de la requête. Ce champ est essentiel pour l'analyse des accès car il permet de connaître l'origine technique d'une requête. Il n'identifie pas directement une personne, mais la connexion ou le point à partir duquel l'accès a été effectué.
Exemple d'utilisation :
Lorsque la même IP apparaît de nombreuses fois en très peu de temps, il vaut la peine de vérifier ce qu'elle demande et comment elle le fait.
method Type de données : texte catégoriel
Il s'agit de la méthode HTTP utilisée dans la requête. Les plus courantes sont GET et POST.
Pour comprendre sans langage technique :
GET signifie généralement que quelqu'un demande à voir quelque chose, comme une page ou une ressource.POST signifie généralement que quelqu'un envoie des informations, par exemple depuis un formulaire ou vers un script.PUT, DELETE ou OPTIONS peuvent apparaître dans des contextes plus techniques ou d'API.Exemple d'utilisation :
si vous détectez de nombreuses requêtes POST vers des routes inconnues ou suspectes, il pourrait s'agir d'une tentative automatisée d'exploiter un formulaire ou un point de terminaison.
mtm_campaign Type de données : texte catégoriel
Collecte le nom d'une campagne marketing au format Matomo, si l'URL incluait ces données. Ce champ n'aura de contenu que lorsque la visite arrive avec des paramètres de campagne. Sinon, il apparaîtra vide. Il sert à relier un accès à une campagne spécifique.
mtm_content Type de données : texte catégoriel
Indique une variante spécifique du contenu dans une campagne Matomo. Peut être utilisé pour distinguer des versions de publicités, des liens ou différentes créations au sein d'une même action marketing.
mtm_kwd Type de données : texte catégoriel
Stocke un mot-clé associé à une campagne Matomo, s'il est présent dans l'URL. Dans de nombreux cas, il peut être vide.
mtm_medium Type de données : texte catégoriel
Indique le support par lequel la visite est arrivée dans une campagne Matomo. Par exemple, il peut refléter si le trafic provenait d'un e-mail, d'une publicité, des réseaux sociaux, etc.
mtm_source Type de données : texte catégoriel
Indique la source spécifique du trafic dans une campagne Matomo. Utile pour savoir d'où provient une requête marquée : par exemple, une plateforme, une newsletter ou une source promotionnelle.
referer Type de données : texte catégoriel
Ce champ indique de quelle page ou site provient l'accès, si cette information était disponible.
En termes simples, il aide à répondre à la question : "d'où venait le visiteur avant d'arriver ici ?"
Parfois, il affichera un site web externe, parfois une page de votre propre site web, et d'autres fois il apparaîtra vide ou avec -, en particulier lorsque l'accès est direct ou que l'origine n'a pas pu être déterminée.
Exemple d'utilisation :
savoir si le trafic provient de Google, des réseaux sociaux ou d'un site web spécifique,
détecter les accès internes entre pages,
ou examiner d'où proviennent certaines erreurs.
resource_path Type de données : texte catégoriel
Il s'agit du chemin spécifique de la ressource demandée sur le site web. Ce champ est très important car il indique quel fichier, page ou point de terminaison a réellement été tenté d'être ouvert.
Par exemple, il pourrait s'agir de :
Exemple d'utilisation :
Pour une lecture simple, ce champ répond à la question : "quelle partie exacte du site web ont-ils essayé d'ouvrir ?"
response_size Type de données : numérique
Indique la taille de la réponse envoyée par le serveur, mesurée en octets. Ce n'est généralement pas le premier champ qu'un utilisateur non technique regarde, mais il peut être utile pour détecter des réponses très petites, très grandes ou incohérentes.
Exemple d'interprétation :
une petite réponse pourrait être une page d'erreur ou une redirection,
une réponse plus grande pourrait correspondre à une page ou une ressource avec plus de contenu.
status_code Type de données : numérique
C'est l'un des champs les plus importants de la collection. Il indique le résultat de la requête. C'est-à-dire ce qui s'est passé lorsque quelqu'un a essayé d'accéder à cette URL.
Les codes les plus courants s'interprètent comme suit :
200 : tout s'est bien passé, la page ou la ressource a été correctement délivrée.301 ou 302 : il y a eu une redirection.403 : accès interdit.404 : la ressource n'existe pas.500 : erreur interne du serveur.503 : service indisponible.Il sert à répondre à une question très pratique : "cet accès a-t-il fonctionné ou a-t-il causé un problème ?"
Exemple d'utilisation :
404,500 ou 503,200.
total_visits Type de données : numérique
Ce champ représente le nombre total de visites associées à ce contexte utilisateur ou accès selon la logique interne de la plateforme. Selon la source de données, il peut servir de mesure auxiliaire pour identifier la récurrence. Dans de nombreuses analyses, ce ne sera pas le champ principal, mais il peut fournir un contexte lorsqu'il est combiné avec l'IP, le user agent ou l'empreinte.
url Type de données : texte catégoriel
Contient l'URL complète demandée. Contrairement à resource_path, qui reflète généralement uniquement le chemin, url peut donner une vue plus complète de l'accès tel qu'il a été enregistré. Il est utile lorsque vous souhaitez examiner plus en détail exactement quelle adresse a été demandée.
user_agent Indique quel type de client a effectué la requête. Bien que la valeur puisse sembler technique, elle répond en réalité à une question assez simple : "qui ou quoi a fait cet accès ?"
Il pourrait s'agir de :
Exemple d'interprétation simple :
bot, crawler, python, curl ou une bibliothèque spécifique apparaît, il s'agissait probablement de trafic automatisé.Ce champ est très utile pour séparer le trafic humain du trafic technique ou automatisé.
user_fingerprint Type de données : texte catégoriel
Il s'agit d'un identifiant généré à partir de plusieurs données du visiteur, généralement conçu pour aider à reconnaître le même modèle d'accès même sans session traditionnelle. Il sert à l'analyse interne et à relier les requêtes entre elles lorsque l'IP seule ne suffit pas.
utm_campaign Type de données : texte catégoriel
Nom de la campagne au format UTM. Ce champ n'aura de valeur que si la visite est arrivée avec des paramètres UTM dans l'URL. Il sert à savoir à quelle campagne marketing un accès est associé.
utm_content Type de données : texte catégoriel
Indique une variante spécifique du contenu ou de la publicité dans une campagne UTM. Il est utilisé pour différencier les créations, les liens ou les différentes versions au sein d'une même campagne.
utm_kwd Type de données : texte catégoriel
Mot-clé associé à la campagne UTM, s'il est envoyé dans l'URL. Il ne sera pas toujours présent.
utm_medium Indique le support par lequel la visite est arrivée dans une campagne UTM.
Par exemple :
Cela aide à classer le type de canal qui a généré l'accès.
utm_source Type de données : texte catégoriel
Indique la source spécifique du trafic dans une campagne UTM. Par exemple, il pourrait représenter un moteur de recherche, un réseau social, une newsletter ou toute autre origine promotionnelle.
C'est l'un des champs les plus utiles lorsque vous souhaitez analyser l'acquisition de trafic.
utm_term Type de données : texte catégoriel
Collecte le terme ou mot-clé associé à une campagne UTM, généralement utilisé dans les campagnes de recherche ou publicitaires. Il ne sera pas toujours présent.
x_forwarded_for Type de données : texte catégoriel
Ce champ enregistre une IP d'origine lorsque la requête est passée par des proxies, des équilibreurs de charge ou des services intermédiaires.
Ce qu'il faut comprendre :
Il n'aura pas toujours de valeur, et il ne sera pas toujours nécessaire dans les analyses normales, mais il peut être important dans des examens de trafic ou de sécurité plus avancés.
Vous pouvez rechercher l'URL ou la route et examiner le status_code. Si vous voyez beaucoup de 404, la page ou le fichier n'existe probablement pas. Si vous voyez des 500, il y a un problème technique interne.
user_agent étranges,resource_path,abuse_score,resource_path ou url et compter combien de fois chacune apparaît.country, referer, utm_source, utm_medium, utm_campaign et les champs similaires.POST vers des points de terminaison spécifiques,user_agent non typiques des navigateurs normaux.Activité Web et une collection Visites Ceci est important pour éviter toute confusion.
La collection Activité Web enregistre les accès individuels.
La collection Visites regroupe plusieurs actions d'un même utilisateur au sein d'une seule visite.
Par conséquent :
Activité Web lorsque vous souhaitez voir le détail technique de chaque requête ;Visites lorsque vous souhaitez comprendre le comportement agrégé d'une visite.Si vous avez besoin de savoir :
Accès Web est la collection correcte.Si vous avez besoin de savoir :
"combien de temps une visite a duré",
"où un utilisateur a navigué",
"combien de pages ils ont vues dans une session",
alors il vaut mieux utiliser une collection orientée sessions.