Outils pour utilisateurs

Outils du site


admin:monitoring:metrologie-via-collectd

Différences

Ci-dessous, les différences entre deux révisions de la page.

Lien vers cette vue comparative

Les deux révisions précédentesRévision précédente
Prochaine révision
Révision précédente
admin:monitoring:metrologie-via-collectd [2026/07/08 00:11] – Métrologie personnalisée fhenry2admin:monitoring:metrologie-via-collectd [2026/08/05 13:37] (Version actuelle) – [Ajout classique] pitchum
Ligne 54: Ligne 54:
 #LoadPlugin rrdtool #LoadPlugin rrdtool
 </file> </file>
 +Penser à supprimer le contenu inutile présent dans ''/var/lib/collectd/rrd/*'' après redémarrage du service.
 </note> </note>
  
Ligne 148: Ligne 149:
 CREATE CONTINUOUS QUERY "downsample-1decade-avg-1w" ON "collectd" RESAMPLE EVERY 6h FOR 2w BEGIN SELECT mean(*) INTO "collectd"."1decade".:MEASUREMENT FROM collectd."1week"./.*/ GROUP BY time(1w) END; CREATE CONTINUOUS QUERY "downsample-1decade-avg-1w" ON "collectd" RESAMPLE EVERY 6h FOR 2w BEGIN SELECT mean(*) INTO "collectd"."1decade".:MEASUREMENT FROM collectd."1week"./.*/ GROUP BY time(1w) END;
 </code> </code>
 +
 +===== Questions fréquentes =====
 +
 +==== Stockage ====
 +
 +> Où sont stockées les données ?
 +> Quel est le chemin du répertoire sur la VM Agir ?
 +Dans une base de donnée InfluxDB séparée et nommée ''collectd'' sur Admin.
 +
 +==== Version d’InfluxDB ====
 +
 +> Quelle version d’InfluxDB est installée en 2026 ?
 +> InfluxDB 1.6 ?
 +
 +==== Fréquence ====
 +
 +> Actuellement, Collectd semble sonder toutes les 10 secondes.
 +> Quel volume de données cela va-t-il représenter ?
 +> Est-ce compatible avec l'actuel espace de stockage ?
 +Aucune idée.
 +À voir comment ça évolue dans le [[https://grafana.chapril.org/d/VcqDKU8Gz/pitchums-test-dashboard?viewPanel=6&orgId=1&from=1615647600000&to=now&refresh=5m|graphe d’essai de Grafana]].
 +
 +> Les sondes système d’Icinga sont réglées à 5 minutes.
 +> Quelle période envisager pour Collectd ?
 +Par défaut c'est 10 secondes.
 +Pour les sondes personnalisées XMPP a une période d’une minute.
 +
 +==== Redondance ====
 +
 +> Quasiment tous les points de mesure affichés dans le test sont déjà mesurés via des sondes Icinga.
 +> Du coup, Collectd, n'est-il pas redondant ?
 +Dans les mesures venant d'Icinga manquent des paramètres comme les entrées ou sorties de volume de stockage.
 +
 +==== Gestion d'alertes ====
 +
 +> Les sondes Icinga, en plus de partager les données avec Grafana, gèrent des alertes.
 +> Collectd ne fait que collecter des mesures et ne génère aucune alerte.
 +> Y-a-t-il utilité à mesurer sans générer d'éventuelles alertes ?
 +Collectd est un outil de métrologie alors qu’Icinga est un outil de supervision.
 +Le but de la métrologie est de collecter des informations pour analyser des évolutions de comportements dans le temps.
 +Le but de la supervision est de réveiller les adminsys quand un problème est à résoudre immédiatement.
 +Beaucoup d'outils font les deux à la fois, mais ce sont bien deux approches différentes pour des besoins différents.
 +Les adminsys ont besoin de la supervision, les décideurs pressés s'intéressent plus à la métrologie.
 +
 +==== Nouvelles mesures ====
 +
 +> Actuellement, Icinga contient 1 005 sondes.
 +> Quels sont les points de mesure manquants dans Icinga ?
 +Toutes celles ajoutées dans [[https://grafana.chapril.org/d/97P8IXUGk/xmpp?orgId=1|un panneau de graphe pour XMPP]] en guise d’exemple (et ce n’est pas fini).
 +On y trouve :
 +  * //XMPP Accounts// :
 +    * //Total//,
 +    * //Active//,
 +    * //Active (dedup)// ;
 +  * //Federation// :
 +    * //Incoming s2s//,
 +    * //Outgoing s2s// ;
 +  * //Group chat// :
 +    * //Total rooms// ;
 +  * //HTTP Upload disk usage// :
 +    * //Per user avg (in MB)// ;
 +    * //Total (in GB)//.
 +
 +==== Top-down vs Down-top ====
 +
 +> Icinga sur la VM Agir est le déclencheur des mesures (à vérifier).
 +> Collectd depuis une VM cliente, alimente directement Icinga (à vérifier).
 +> Du point de vue de l’architecture, a-t-on une approche meilleure que l'autre ?
 +
 +==== ChaprilInfos ====
 +
 +> Quel futur pour le système de collecte ?
 +Un autre système de collecte en est en cours de développement : StatoolInfos.
 +Il est exploité pour ChaprilInfos et [[https://stats.chatons.org/|ChatonsInfos]].
 +Le périmètre des données vise celles génériques pour HTTP et celles spécifiques au services (nombre de comptes, d'utilisateurs etc.).
 +La fréquence est très réduites : une fois par jour au plus.
 +
 +Quelques avantages de ChaprilInfos :
 +  * Accès public ;
 +  * Possibilité de calculs cumulatifs.
 +Par exemple dans un graphique le nombre de visiteurs du service pourra être cumulé entre tous les services du Chapril et même au niveau du collectif [[https://chatons.org/|CHATONS]].
 +
admin/monitoring/metrologie-via-collectd.1783469479.txt.gz · Dernière modification : 2026/07/08 00:11 de fhenry2