admin:monitoring:metrologie-via-collectd
Différences
Ci-dessous, les différences entre deux révisions de la page.
| Prochaine révision | Révision précédente | ||
| admin:monitoring:metrologie-via-collectd [2026/07/07 21:39] – créée fhenry2 | admin:monitoring:metrologie-via-collectd [2026/08/05 13:37] (Version actuelle) – [Ajout classique] pitchum | ||
|---|---|---|---|
| Ligne 6: | Ligne 6: | ||
| </ | </ | ||
| - | Le Chapril a choisi [[: | + | Le Chapril a choisi [[: |
| Initialement la métrologie est obtenue par une instance [[: | Initialement la métrologie est obtenue par une instance [[: | ||
| - | ===== Métrologie de service | + | ===== Configuration d’InfluxDB |
| - | ==== Configuration d’InfluxDB ==== | + | Pour pouvoir collecter des métriques de services qui ne font pas l' |
| - | + | ||
| - | Pour pouvoir collecter des métriques de services qui ne font pas l' | + | |
| Elle a donc été nommée '' | Elle a donc été nommée '' | ||
| Ligne 30: | Ligne 28: | ||
| </ | </ | ||
| - | ==== Ajout classique ==== | + | < |
| + | |||
| + | ===== Ajout classique | ||
| Pour une métrique simple on installe et configure Collectd sur les machines qu’on veut observer. | Pour une métrique simple on installe et configure Collectd sur les machines qu’on veut observer. | ||
| Ligne 54: | Ligne 54: | ||
| #LoadPlugin rrdtool | #LoadPlugin rrdtool | ||
| </ | </ | ||
| + | Penser à supprimer le contenu inutile présent dans ''/ | ||
| </ | </ | ||
| Ligne 64: | Ligne 65: | ||
| Reste à jeter un œil dans l’instance [[https:// | Reste à jeter un œil dans l’instance [[https:// | ||
| Si on veut ajouter des graphes moins classiques, lire la suite ci-dessous. | Si on veut ajouter des graphes moins classiques, lire la suite ci-dessous. | ||
| + | |||
| + | ===== Ajout des fichiers ===== | ||
| + | |||
| + | Pour tenir compte des fichiers modifier le champ '' | ||
| + | <file apache / | ||
| + | <Plugin " | ||
| + | ReportInodes true | ||
| + | </ | ||
| + | </ | ||
| + | |||
| + | ===== Ajout d’Apache ===== | ||
| + | |||
| + | Dans le cas où la VM dispose d’[[https:// | ||
| + | <file apache / | ||
| + | LoadPlugin apache | ||
| + | <Plugin " | ||
| + | < | ||
| + | URL " | ||
| + | </ | ||
| + | </ | ||
| + | </ | ||
| + | |||
| + | Une configuration supplémentaire est aussi nécessaire pour le serveur Apache : | ||
| + | <code apache> | ||
| + | ExtendedStatus on | ||
| + | < | ||
| + | < | ||
| + | SetHandler server-status | ||
| + | </ | ||
| + | </ | ||
| + | </ | ||
| + | |||
| + | ===== Ajout de scripts ===== | ||
| + | |||
| + | ==== Bash ==== | ||
| + | |||
| + | Via le greffon '' | ||
| + | |||
| + | <file apache / | ||
| + | LoadPlugin exec | ||
| + | <Plugin exec> | ||
| + | # if we want to override default' | ||
| + | # Interval 60 | ||
| + | Exec " | ||
| + | Exec " | ||
| + | </ | ||
| + | </ | ||
| + | |||
| + | Exemple de script Bash qui compte le nombre d' | ||
| + | <file bash / | ||
| + | HOSTNAME=" | ||
| + | INTERVAL=" | ||
| + | |||
| + | while sleep " | ||
| + | do | ||
| + | echo " | ||
| + | done | ||
| + | </ | ||
| + | |||
| + | Dans la base InfluxDB, la variable s' | ||
| + | La boucle '' | ||
| + | Se référer à '' | ||
| + | |||
| + | ==== Python ==== | ||
| + | |||
| + | Penser à installer le paquet '' | ||
| + | |||
| + | Se référer à '' | ||
| + | |||
| + | ===== Expérimental ===== | ||
| + | |||
| + | ==== Ré-échantillonnage ==== | ||
| + | |||
| + | Le ticket [[https:// | ||
| + | Par exemple, on souhaite connaître à la minute près l' | ||
| + | |||
| + | Parmi les requêtes tentées : | ||
| + | <code sql> | ||
| + | CREATE RETENTION POLICY " | ||
| + | CREATE RETENTION POLICY " | ||
| + | CREATE RETENTION POLICY " | ||
| + | CREATE CONTINUOUS QUERY " | ||
| + | CREATE CONTINUOUS QUERY " | ||
| + | </ | ||
| + | |||
| + | ===== Questions fréquentes ===== | ||
| + | |||
| + | ==== Stockage ==== | ||
| + | |||
| + | > Où sont stockées les données ? | ||
| + | > Quel est le chemin du répertoire sur la VM Agir ? | ||
| + | Dans une base de donnée InfluxDB séparée et nommée '' | ||
| + | |||
| + | ==== Version d’InfluxDB ==== | ||
| + | |||
| + | > Quelle version d’InfluxDB est installée en 2026 ? | ||
| + | > InfluxDB 1.6 ? | ||
| + | |||
| + | ==== Fréquence ==== | ||
| + | |||
| + | > Actuellement, | ||
| + | > Quel volume de données cela va-t-il représenter ? | ||
| + | > Est-ce compatible avec l' | ||
| + | Aucune idée. | ||
| + | À voir comment ça évolue dans le [[https:// | ||
| + | |||
| + | > Les sondes système d’Icinga sont réglées à 5 minutes. | ||
| + | > Quelle période envisager pour Collectd ? | ||
| + | Par défaut c'est 10 secondes. | ||
| + | Pour les sondes personnalisées XMPP a une période d’une minute. | ||
| + | |||
| + | ==== Redondance ==== | ||
| + | |||
| + | > Quasiment tous les points de mesure affichés dans le test sont déjà mesurés via des sondes Icinga. | ||
| + | > Du coup, Collectd, n' | ||
| + | Dans les mesures venant d' | ||
| + | |||
| + | ==== Gestion d' | ||
| + | |||
| + | > Les sondes Icinga, en plus de partager les données avec Grafana, gèrent des alertes. | ||
| + | > Collectd ne fait que collecter des mesures et ne génère aucune alerte. | ||
| + | > Y-a-t-il utilité à mesurer sans générer d' | ||
| + | Collectd est un outil de métrologie alors qu’Icinga est un outil de supervision. | ||
| + | Le but de la métrologie est de collecter des informations pour analyser des évolutions de comportements dans le temps. | ||
| + | Le but de la supervision est de réveiller les adminsys quand un problème est à résoudre immédiatement. | ||
| + | Beaucoup d' | ||
| + | Les adminsys ont besoin de la supervision, | ||
| + | |||
| + | ==== Nouvelles mesures ==== | ||
| + | |||
| + | > Actuellement, | ||
| + | > Quels sont les points de mesure manquants dans Icinga ? | ||
| + | Toutes celles ajoutées dans [[https:// | ||
| + | On y trouve : | ||
| + | * //XMPP Accounts// : | ||
| + | * //Total//, | ||
| + | * //Active//, | ||
| + | * //Active (dedup)// ; | ||
| + | * // | ||
| + | * //Incoming s2s//, | ||
| + | * //Outgoing s2s// ; | ||
| + | * //Group chat// : | ||
| + | * //Total rooms// ; | ||
| + | * //HTTP Upload disk usage// : | ||
| + | * //Per user avg (in MB)// ; | ||
| + | * //Total (in GB)//. | ||
| + | |||
| + | ==== Top-down vs Down-top ==== | ||
| + | |||
| + | > Icinga sur la VM Agir est le déclencheur des mesures (à vérifier). | ||
| + | > Collectd depuis une VM cliente, alimente directement Icinga (à vérifier). | ||
| + | > Du point de vue de l’architecture, | ||
| + | |||
| + | ==== ChaprilInfos ==== | ||
| + | |||
| + | > Quel futur pour le système de collecte ? | ||
| + | Un autre système de collecte en est en cours de développement : StatoolInfos. | ||
| + | Il est exploité pour ChaprilInfos et [[https:// | ||
| + | Le périmètre des données vise celles génériques pour HTTP et celles spécifiques au services (nombre de comptes, d' | ||
| + | La fréquence est très réduites : une fois par jour au plus. | ||
| + | |||
| + | Quelques avantages de ChaprilInfos : | ||
| + | * Accès public ; | ||
| + | * Possibilité de calculs cumulatifs. | ||
| + | Par exemple dans un graphique le nombre de visiteurs du service pourra être cumulé entre tous les services du Chapril et même au niveau du collectif [[https:// | ||
admin/monitoring/metrologie-via-collectd.1783460346.txt.gz · Dernière modification : 2026/07/07 21:39 de fhenry2
