Clustraly
Intelligence des erreurs & RGPD

Gardez une base d'erreurs légère et fiable grâce à la rétention et l'échantillonnage anti-flood

Rétention / échantillonnage anti-flood une fonctionnalité du module Intelligence des erreurs & RGPD de Clustraly. La rétention et l'échantillonnage anti-flood purgent les vieux évènements, échantillonnent les pics et plafonnent les sources non fiables, sans fausser vos compteurs.

Purge quotidienne, échantillonnage des pics et plafond des sources non fiables : gardez une intelligence des erreurs légère et des compteurs fidèles, sans effort de tri.

Bénéfice

Une base d'erreurs qui ne déborde jamais

Vos erreurs affluent par vagues, surtout quand un même bug part en boucle. La rétention et l'échantillonnage anti-flood absorbent ces vagues pour vous : votre base reste légère et vos écrans restent lisibles, sans tri manuel.

Concrètement, une tâche quotidienne fait le ménage, un échantillonnage écrête les pics dès la capture et un plafond borne chaque source non fiable.

  • Base d'évènements maîtrisée dans la durée
  • Pics d'erreurs absorbés sans intervention
  • Compteurs d'occurrences préservés
Voir le tableau de bord des tendances
Échantillonnage

Les pics d'erreurs écrêtés dès la capture

Quand un même groupe d'erreurs dépasse son seuil d'évènements par minute, Clustraly ne conserve plus qu'un évènement sur dix. Vous gardez des échantillons représentatifs sans stocker mille fois le même incident.

Le seuil de déclenchement se règle via error_intel.sample_threshold : vous décidez à partir de quel débit l'échantillonnage s'active.

  • 1 évènement conservé sur 10 au-delà du seuil
  • Déclenchement par débit, groupe par groupe
  • Seuil configurable (sample_threshold)
Rétention

Un ménage quotidien qui rogne le passé

Chaque jour, la tâche cleanup_error_events supprime les groupes ignorés et résolus au-delà de la rétention, puis rogne les évènements plus anciens que votre fenêtre de conservation.

Par défaut, la rétention est de 30 jours, et les lignes d'échantillon (sample_event_id) sont préservées pour garder une trace de référence.

  • Purge quotidienne automatique
  • Groupes ignorés et résolus nettoyés
  • Rétention par défaut de 30 jours
  • Échantillons de référence conservés
Plafond des sources

Les beacons non fiables bornés à la source

Les beacons frontend et les rapports CSP arrivent d'Internet, sans session : une source malveillante ou boguée pourrait vous inonder. Un plafond horaire par source non fiable coupe court au flood.

Par défaut, chaque source est bornée à 500 évènements par heure (untrusted_max_per_hour) ; au-delà, l'ingestion s'arrête pour cette heure.

  • Plafond horaire par source non fiable
  • Beacons frontend et CSP bornés
  • Défaut de 500/heure, ajustable
Garde-fous

Vos compteurs restent justes, vous gardez la main

L'échantillonnage allège le stockage sans trahir la réalité : sur le tableau de bord des tendances, le total d'occurrences reste résistant à l'échantillonnage, et un indicateur « sampled » signale quand il est actif.

Vous gardez la main sur chaque garde-fou : réglez le seuil d'échantillonnage, la fenêtre de rétention (retention_days ≤ 0 désactive la purge) et le plafond des sources selon votre contexte.

  • Total d'occurrences résistant à l'échantillonnage
  • Indicateur « sampled » quand actif
  • Rétention désactivable (retention_days ≤ 0)
  • Seuils et plafonds sous votre contrôle
Pourquoi ça compte

L'automatisme propose, vos réglages décident

Seuil d'échantillonnage, fenêtre de rétention, plafond des sources non fiables : chaque garde-fou est un réglage que vous ajustez, jamais une boîte noire.

FAQ

Questions fréquentes

L'échantillonnage fausse-t-il mes statistiques d'erreurs ?
Non. Au-delà du seuil, Clustraly ne conserve qu'un évènement sur dix pour alléger le stockage, mais le total d'occurrences reste comptabilisé et affiché comme résistant à l'échantillonnage. Un indicateur « sampled » vous prévient quand l'échantillonnage est actif.
Que supprime exactement la purge quotidienne ?
La tâche cleanup_error_events supprime les groupes ignorés et résolus, avec leurs évènements, au-delà de la rétention, et rogne les évènements plus anciens que error_intel.retention_days, fixé à 30 jours par défaut. Les lignes d'échantillon (sample_event_id) sont préservées.
Puis-je désactiver la rétention automatique ?
Oui. Il suffit de fixer retention_days à 0 ou moins : la purge des évènements anciens est alors désactivée. Vous restez libre d'ajuster la fenêtre à la durée qui convient à votre contexte.
Comment les beacons frontend et CSP sont-ils protégés du flood ?
Chaque source non fiable est bornée par un plafond horaire, untrusted_max_per_hour, réglé à 500 par défaut. Au-delà, l'ingestion des beacons frontend et des rapports CSP s'arrête pour cette heure, ce qui protège votre base d'une inondation.
Prêt à commencer ?

Une intelligence des erreurs qui reste légère et fidèle

La rétention et l'échantillonnage anti-flood travaillent en arrière-plan : ils écrêtent les pics, purgent le passé et bornent les sources non fiables, sans jamais fausser vos compteurs. Vous gardez une base d'erreurs propre, des tendances fiables et la main sur chaque seuil.