Après une construction
La plateforme vient d'être mise en production, par CTN Solutions ou une autre équipe. Les contrôles, les décisions et les relais doivent maintenant s'inscrire dans la durée.
Périmètre accepté au contratEngagement récurrent
Rendre l'exploitation visible. Organiser sa continuité.
Lorsqu'une plateforme entre en production ou change d'exploitant, nous vérifions d'abord le périmètre, les accès, les journaux, les métriques, les procédures et les décideurs disponibles. Le contrat fixe ensuite la couverture et les responsabilités. L'ingénierie de la fiabilité (Site Reliability Engineering, SRE) relie chaque contrôle à un objectif, un responsable, un déclencheur et une trace.
Décrire la production à exploiterLe contrat précise le périmètre, les fenêtres et les responsabilités. Le registre relie ensuite chaque contrôle couvert à son objectif, son déclencheur et sa décision.
Chaque dimension est convenue avant le début de la responsabilité d'exploitation.
Chaque contrôle couvert conserve le contexte nécessaire pour comprendre l'action et la décision.
La plateforme vient d'être mise en production, par CTN Solutions ou une autre équipe. Les contrôles, les décisions et les relais doivent maintenant s'inscrire dans la durée.
Périmètre accepté au contratLes accès, la documentation ou les dépendances ne permettent pas encore d'attribuer les responsabilités. La reprise rend l'existant visible avant l'acceptation du périmètre.
Préparer la reprise d'exploitationRôle : Demandeur autorisé
Rôle : CTN Solutions
Rôle : CTN Solutions et propriétaires mobilisés
Rôle : Décideur désigné
Rôle : CTN Solutions
Canal d'urgence
La tierce maintenance d'infrastructure (TMI) commence par rendre visibles les dépendances, les inconnues et les critères d'acceptation.
Condition de sortie
Le périmètre et ses dépendances connues sont nommés.
Condition de sortie
Les actions autorisées sont possibles sans accès partagé implicite.
Condition de sortie
Les procédures prioritaires ont un résultat observable.
Condition de sortie
Une décision d'acceptation fixe ce qui est repris et ce qui ne l'est pas.
Un composant inconnu ou hors périmètre n'est pas implicitement pris en charge.
Condition requise
Périmètre nommé
Les systèmes couverts et les composants exclus sont listés au contrat.
Condition requise
Observabilité minimale
Des journaux, métriques et alertes exploitables sont requis ; le sprint observabilité du pilier Plateforme peut établir ce socle lorsqu'il manque.
Condition requise
Accès vérifiés
Les accès nécessaires sont nominatifs, disponibles et proportionnés.
Condition requise
Décideurs mobilisables
Les décisions métier, sécurité et risque ont un responsable joignable pendant la couverture.
Situation exclue
Système inconnu
Aucune exploitation ne commence sur un périmètre qui n'a pas été repris et accepté.
Situation exclue
Dépendance sans relais
Une dépendance critique sans propriétaire mobilisable reste hors couverture.
Le sprint observabilité établit les journaux, métriques et alertes nécessaires ; l'audit FinOps prépare les décisions sur les coûts.
Données de santé (HDS)
Pour préparer le périmètre, consultez aussi les limites liées aux données de santé (HDS).
Exploitation à préciser
Indiquez les systèmes, les journaux, métriques et alertes disponibles, l'origine du besoin (fin de construction ou reprise), les responsables et les limites déjà connues. Une demande envoyée ici ne déclenche pas une astreinte. Toute couverture planifiée dépend d'un périmètre, d'une période et de conditions convenus.