FonctionnalitésCouvertureTarifsSécurité
FR EN
Fonctionnalités

Tout ce qu'il faut pour surveiller vraiment

Des contrôles simples aux parcours transactionnels, avec un verdict confirmé par quorum et un diagnostic qui va au fond.

Huit types de moniteurs

Un moniteur = un contrôle. Chacun sait précisément ce qu'il vérifie et ce qui déclenche une indisponibilité.

URL / HTTP
Vérifie le code de réponse, un mot-clé attendu dans la page, la latence, les redirections suivies et la validité du certificat TLS.
Indisponible si code inattendu, délai dépassé, mot-clé absent ou erreur TLS.
Ping (ICMP)
Joignabilité et latence réseau (RTT moyen), avec seuils optionnels de perte de paquets et de délai.
Indisponible si l'hôte ne répond pas (100 % de perte) ou qu'un seuil est franchi.
DNS / Domaine
Résolution du nom et surveillance de l'enregistrement via RDAP : date d'expiration, jours restants, registrar.
Indisponible si non enregistré, expiré, ou expirant sous votre seuil d'alerte.
Certificat TLS
Chaîne de confiance, correspondance du hostname et date d'expiration ; émetteur et jours restants affichés.
Indisponible si non fiable, expiré ou expirant sous le seuil — pour vous alerter avant.
Port TCP
Établit une connexion TCP sur un port (SSH, SMTP, base de données, port métier) et mesure la latence d'établissement.
Indisponible si le port est fermé, filtré ou en timeout ; diagnostic réseau joint.
Scénario transactionnel
Parcours multi-étapes dans un vrai Chromium (navigate, fill, click, assert_text…), enregistré au clic avec le recorder.
Indisponible à la première étape qui échoue ; captures (écran, console, source) jointes.
API multi-étapes
Enchaîne des appels HTTP : login, extraction de jeton (JSONPath/regex) réinjecté à l'étape suivante, assertions riches (code, temps, JSON, en-tête).
Indisponible si une assertion échoue ; secrets et jetons rédigés partout.
Full Page Check
Charge une page en navigateur réel et mesure les Web Vitals (LCP, FCP, CLS, TTFB), le temps de chargement, le poids et le nombre de requêtes.
Indisponible si un seuil (chargement, LCP) est dépassé — ou mesure sans alerte si laissé vide.

Un verdict juste, pas un réflexe

Kolosili distingue strictement une vraie panne d'une erreur de mesure — pour ne réveiller personne à tort.

Disponible (UP)
La cible répond et toutes les vérifications passent.
Indisponible (DOWN)
La cible ne répond pas ou une vérification échoue — confirmé par quorum spatial adaptatif min(3, n) avant toute alerte.
Erreur de mesure
Le moniteur lui-même n'a pas pu conclure (config invalide, JSONPath cassé…). Ce n'est pas une panne : aucune alerte n'est déclenchée.
Inconnu
Pas encore assez de mesures pour trancher (moniteur neuf ou repris).

Trois modes, du brouillon à la production

Chaque moniteur porte un mode qui décide s'il mesure et s'il alerte — et ce qui est facturé.

01
Développement
Aucun contrôle automatique (seulement « Vérifier maintenant »), notifications coupées. Gratuit — idéal pour mettre au point une configuration.
02
Simulation
Contrôles réguliers mais alertes muettes. Pour valider le comportement avant la bascule.
03
Production
Pleinement opérationnel : contrôles réguliers, notifications actives, compté dans les SLA.

Au-delà du « le site répond »

Multi-points & quorum
Chaque contrôle est joué depuis plusieurs points de contrôle. Une panne est confirmée par quorum spatial adaptatif — min(3, n) points doivent la constater — jamais sur un seul avis. L'erreur locale d'un point n'est pas prise pour une panne.
Alerting multi-niveaux
Escalade de 1 à 3 niveaux avec délais de promotion, rappels (intervalle + quota), message et traceroute par niveau, canaux e-mail / SMS / webhook. Acquitter stoppe l'escalade ; notification de reprise au retour.
Reporting SLA & exports
Rapports de disponibilité reproductibles (uptime, p50/p90/p95/p99, incidents), période calendaire ou glissante, exports PDF / Excel et envois planifiés par e-mail. Seule la Production compte dans les SLA.
Diagnostic d'incident
Phases DNS / TCP / TLS chronométrées, traceroute, cascade des ressources et captures d'écran attachées à chaque incident — pour trancher entre panne réelle et erreur de sonde.

En détail

Tableaux de bord & observabilité
Tableau de bord de widgets configurable par utilisateur, inclus dans l'offre : statut, temps de réponse, jauges SLA, MTTR/MTBF, heatmaps, Top N, Web Vitals, décomposition par étape.
Filtres globaux (période, groupe, moniteurs, checkpoint) et rafraîchissement automatique.
Enregistrez une disposition comme rapport, exportez-la en PDF/Excel ou planifiez son envoi.
Observabilité Grafana intégrée pour vos métriques Prometheus (/metrics), isolée par entreprise.
Recorder & maintenances
Recorder de scénarios : enregistrez un parcours au clic dans un navigateur piloté, collez vos secrets en sécurité.
« Tester le scénario » : exécution en direct sur un checkpoint, étapes ✅/❌ au fil de l'eau, sans laisser de trace dans l'historique.
Maintenances planifiées (période fixe ou récurrente hebdomadaire) : alertes suspendues et période exclue du SLA.
Sécurité & gouvernance
Secrets chiffrés AES-256-GCM, jamais renvoyés ni journalisés, rédigés dans les artefacts de diagnostic.
Isolation multi-tenant stricte ; RBAC fin par rôles, groupes d'utilisateurs et ACL de contrôles.
Portails d'entreprise multi-tenant pilotés par un super-utilisateur ; journal d'audit des actions sensibles.
Au quotidien
Assistant IA conversationnel : questions en langage naturel, réponses fondées sur vos propres données, navigation guidée — sans jamais rien modifier à votre place.
Détail de check : étapes, artefacts de diagnostic, en-têtes, cascade réseau.
Clonage d'un moniteur (config, checkpoints, scénario) sans jamais exposer les secrets.

Prêt à ne plus courir après les faux positifs ?

Voyez Kolosili sur vos propres services, avec vos points de contrôle. Une démo de 20 minutes suffit.