---
title: "Le contexte d’incident dans Unolia"
description: "Unolia enregistre chaque panne et chaque déploiement échoué comme un incident, puis le relie au déploiement qui l’a causé, à celui qui l’a corrigé, et aux commits entre les deux."
url: "https://unolia.com/fr/blog/incident-context"
locale: "fr"
---

# Chaque panne dit ce qui l’a causée

Quand un site client tombe, Unolia nomme maintenant le déploiement qui l’a probablement cassé et celui qui l’a remis debout.

Une alerte vous dit qu’un site est tombé. Elle ne dit pas pourquoi, et les dix minutes que vous passez à répondre vous-même sont les dix minutes pendant lesquelles le client regarde.

Unolia garde maintenant les incidents.

Quand un monitoring passe au rouge ou qu’un déploiement se termine mal, un incident s’ouvre et reste ouvert jusqu’au retour à la normale. Il porte une gravité qui reflète ce qui s’est vraiment passé, donc une indisponibilité et un déploiement sans coupure discrètement raté n’arrivent pas en criant la même chose. Un site qui clignote pendant quelques minutes reste un seul incident plutôt que vingt.

Ensuite, Unolia cherche la cause. Il remonte vos déploiements pour trouver celui qui tombe au plus près avant la casse, et redescend pour trouver celui qui coïncide avec le retour à la normale. Entre les deux, il parcourt la filiation des commits et vous montre ce qui est parti en production, avec la personne qui a fusionné chaque pull request, lue aussi bien sur GitHub que sur GitLab. Quand une indisponibilité survient quelques minutes après un déploiement échoué, les deux sont reliés et l’incident prend la gravité la plus forte.

Rien n’est affirmé avec plus d’assurance que ce que cela mérite. Quand le moment exact de la casse ne peut pas être connu, Unolia dit que le début est approximatif et baisse d’autant sa confiance dans la cause. Et comme chaque passage recalcule tout depuis zéro, une hypothèse formulée pendant la panne se corrige d’elle-même une fois la panne terminée.

Ce que vous obtenez, c’est le paragraphe que vous alliez écrire à la main : c’est tombé ici, voilà ce qui venait de partir, voilà ce qui l’a remis debout.

[whatsdiff.app](https://whatsdiff.app) est un de mes propres sites. Quand il est tombé, Unolia a daté la panne au dernier moment où il avait relevé les données plutôt qu’au moment où le site avait vraiment cassé. La synchronisation des monitorings tourne toutes les heures maintenant, et un incident dit tout haut quand son début est une estimation.

La panne de loopline.app, avec le déploiement qui l’a cassée et celui sur lequel le site est revenu. Espace de démonstration · Données fictives
