mAPI-ng
Diagnostic d'incident pour APIs Go
- Le système
- Une API ralentit en production. La stack d’observabilité en place affiche tout et n’explique rien : à chaque incident, l’équipe passe son temps à interpréter des graphiques au lieu de réparer.
- La clarification
- La vraie question n’est pas « que montrent les métriques ? » mais « quelle est la cause la plus probable, et qu’est-ce qui l’écarterait ? ». Un diagnostic sans critère de réfutation n’est qu’une opinion bien présentée.
- La solution
- Classer les causes en huit familles et n’en proposer aucune sans la preuve qui la soutient ni la ligne qui dirait qu’elle est fausse. Quand rien n’explique l’anomalie, l’afficher : « cause non attribuée », plutôt qu’inventer une explication rassurante.
- L'outil
- Alors seulement l’outillage : agrégation DDSketch dans le process, résumés compacts dans ClickHouse, une variable d’environnement pour instrumenter. L’architecture découle du raisonnement, pas d’un choix de stack.
