Accord de niveau de service
La plateforme configure et déploie de l’infrastructure. Elle ne se trouve sur le chemin des requêtes d’aucune des applications qu’elle déploie.
Les déploiements s’exécutent comme des pipelines sur une infrastructure qui vous appartient. Une fois quelque chose déployé, cela tourne là-bas, répond à son propre trafic, sans aucune dépendance envers nous.
Si le plan de contrôle est indisponible, ce qui s’arrête, c’est donc votre capacité à changer les choses — pas votre capacité à servir vos utilisateurs.
Nous comptons le dire clairement plutôt que de l’enfouir. C’est la description honnête, et il se trouve que c’est aussi la plus favorable : une panne ici retarde un déploiement, elle ne met pas un système de production hors ligne.
Un déploiement traverse des systèmes que nous n’exploitons pas : votre fournisseur d’infrastructure, et la plateforme de pipelines qui exécute les jobs. Une défaillance de l’un ou de l’autre peut bloquer un déploiement alors que le plan de contrôle est en parfaite santé. Tout objectif mesuré doit tenir compte de cette frontière, pour que les chiffres décrivent quelque chose sur quoi nous avons réellement prise.
Le pourcentage de disponibilité, la fenêtre de mesure, le barème des crédits, les délais de réponse du support par offre, et la communication sur l’état du service et les incidents ne sont pas encore fixés. Ils le seront quand la plateforme aura assez d’historique d’exploitation pour qu’un objectif ait un sens, plutôt que choisis parce que le chiffre rassure.