Runbook : déploiement et retour arrière
StableUn runbook, pas une dissertation. Suivez-le de haut en bas. Si une étape échoue, arrêtez-vous et passez au Retour arrière.
Préconditions
- Le changement est fusionné dans
mainet la CI est verte. - Vous avez accès au tableau de bord de déploiement et aux journaux.
- Vous connaissez la version actuellement en production (notez-la — vous en aurez besoin pour revenir en arrière).
Déploiement
Confirmer la cible
Vérifiez que le SHA du commit sur main est bien celui que vous comptez livrer.
Déclencher la mise en production
Lancez le déploiement depuis le pipeline. Ne déployez jamais depuis une machine locale.
Surveiller le déploiement
Observez les vérifications de disponibilité passer au vert. Sain signifie : pods/instances prêts, taux d’erreur stable, latence dans la plage normale.
Test de fumée
Exercez le chemin critique (pour le CRVS : rechercher un enregistrement connu ; pour la téléradiologie : charger une étude).
Confirmez que la corrélation requestId apparaît dans les journaux.
Annoncer
Publiez la version et le SHA dans le canal ops. C’est terminé.
Retour arrière
Si le taux d’erreur grimpe, si le test de fumée échoue ou si vous avez un doute — revenez d’abord en arrière, diagnostiquez ensuite. Le retour arrière est toujours sûr.
Redéployer la version précédente
Déclenchez un déploiement épinglé sur le dernier SHA réputé sain que vous avez noté dans les préconditions.
Vérifier le rétablissement
Confirmez que le taux d’erreur et la latence reviennent à la normale et que le test de fumée passe.
Geler
Suspendez tout nouveau déploiement jusqu’à ce que la cause soit comprise.
Documenter
Ouvrez une note d’incident : ce qui a été livré, ce qui a cassé, comment vous l’avez su, ce qui a corrigé le problème.