Analytique
La pile analytique du HIC est la couche de données qui transforme les données de santé brutes issues de neuf systèmes sources en analyses fiables et interrogeables. Elle prend en charge la planification de l’ingestion, la transformation SQL multicouche, le traitement distribué et la consommation BI.
dbtTransformation de données en SQL sur 4 couches de modèles (staging → DWH → reporting). Alimente tous les tableaux de bord Superset.PrefectOrchestration des workflows pour l’ingestion de données depuis plus de 10 systèmes sources de santé, le reporting planifié et les exécutions dbt.SparkTraitement distribué pour les charges analytiques à grande échelle, accessible via l’API REST Livy.Analyse spatiale et SIGCartographie géospatiale des indicateurs de santé et de climat sur la géographie administrative du Rwanda avec GeoPandas.
Outils consommateurs
Les données transformées dans l’entrepôt sont consommées par deux outils en aval :
- Apache Superset (
superset.nhic.moh.gov.rw) — tableaux de bord et requêtes SQL ad hoc pour le reporting des programmes de santé. Superset se connecte directement aux vues de la couchereportingproduites par dbt. - JupyterHub — notebooks Python interactifs pour les data scientists. Se connecte directement à l’entrepôt de données pour l’analyse exploratoire, le développement de modèles et les extractions personnalisées.
Dernière mise à jour le