Table des figures

Titre
1 5 000 ans d’histoire de la donnée
2 Le cycle éternel du data engineering
3 1960-1986 : des accès par pointeurs au modèle relationnel
4 1980-1999 : du data warehouse au tableau de bord
5 2000-2006 : l’émergence du traitement distribué à grande échelle
6 Le théorème CAP
7 2005-2012 : diversification des bases distribuées
8 Du cluster autogéré au cloud
9 Comment traiter 1 TB de données ?
10 Cycle de vie de l’ingénierie des données
11 Pipeline pédagogique inspiré de Spotify
12 Deux profils de source : schéma à l’écriture vs schéma à la lecture
13 Idempotence : deux runs, un seul résultat
14 États de confiance medallion appliqués au cas Spotify
15 Évolution complète d’un événement
16 ETL : des sources aux usages analytiques
17 ELT : charger le brut, transformer ensuite
18 Clé primaire vs clé étrangère
19 1NF : une cellule, une valeur
20 2NF : dépendre de toute la clé
21 3NF : pas de dépendance transitive
22 Exemple de schéma en étoile
23 Du schéma en étoile au schéma en flocon
24 Exemple de diagramme entité-association pour une pizzeria
25 Cardinalités en notation « patte d’oie »
26 Combiner partitionnement et clustering dans BigQuery
27 Les quatre familles de bases NoSQL
28 Théorème CAP : propriétés des bases distribuées