L'astreinte, sans les nuits blanches.
RemediAI investigue chaque alerte, trouve la cause racine et ne réveille votre équipe que lorsque c'est vraiment nécessaire.
J'accuse réception. Je regarde l'évolution de l'espace libre sur les 6 dernières heures.
node_filesystem_avail_bytes{mountpoint="/"} Pic de 4 min pendant la sauvegarde planifiée de 02:00, redescendu à 61 %. Aucune autre alerte, aucun impact service.
Branché sur votre stack d'observabilité
Moins d'alertes subies, plus de causes comprises
Moins de réveils pour rien
L'agent tient le premier niveau d'astreinte : il vérifie chaque alerte et ne vous escalade que celles qui ont un impact.
La cause racine, preuves à l'appui
Métriques, logs et incidents liés sont croisés en quelques dizaines de secondes. Chaque conclusion cite ses requêtes.
La surveillance en langage naturel
Vos consignes deviennent des agents qui tournent en continu, sans écrire une ligne de PromQL.
Un SRE IA pour chaque étape de l'incident
De l'alerte au ticket, l'agent travaille sous vos yeux, dans un fil de discussion que toute l'équipe peut relire.
La latence reste au-dessus de 800 ms depuis 12 min et les erreurs applicatives suivent la même courbe dans les logs.
Impact démontré : j'escalade avec la cause racine et les preuves.
Escaladé à l'astreinte{service_name="centreon"} |~ "(?i)(error|timeout)" Je compte les erreurs sur 30 min et je compare à la baseline. Au-delà, j'ouvre un incident.
Comment ça marche
Un webhook Grafana, un accès en lecture à Prometheus et Loki. Pas d'agent à installer sur vos serveurs.
L'alerte se déclenche
Grafana envoie l'alerte à RemediAI, ou un agent de surveillance détecte une dérive.
L'agent investigue
Requêtes PromQL et LogQL, incidents liés, hypothèses vérifiées puis réfutées.
Il trie
Fausse alerte : clôturée avec sa justification. Vrai incident : escaladé à l'astreinte.
Il rend compte
Cause racine, preuves, chronologie et recommandations, jusque dans votre ticket Jira.
Pensé pour la production
RemediAI observe et explique. Il ne touche jamais à vos systèmes.
Ce que RemediAI ne fait pasConçu par un architecte observabilité, à partir de vraies astreintes.
RemediAI est développé par Tristan Jossier, consultant indépendant en supervision et AIOps. Il déploie et fait vivre des plateformes de supervision en production, et a construit RemediAI pour automatiser la partie la plus répétitive de l'astreinte : comprendre ce qui se passe.
Déploiement accompagné
La mise en place se fait avec vous, sur vos vraies alertes : raccordement de Grafana, réglage des agents, revue des premières analyses.
Parler de votre supervisionVoyez l'agent à l'œuvre sur vos alertes
Une démonstration, puis un pilote sur votre propre stack Grafana.