| 1 |
5 000 ans d’histoire de la donnée |
| 2 |
Le cycle éternel du data engineering |
| 3 |
1960-1986 : des accès par pointeurs au modèle relationnel |
| 4 |
1980-1999 : du data warehouse au tableau de bord |
| 5 |
2000-2006 : l’émergence du traitement distribué à grande échelle |
| 6 |
Le théorème CAP |
| 7 |
2005-2012 : diversification des bases distribuées |
| 8 |
Du cluster autogéré au cloud |
| 9 |
Comment traiter 1 TB de données ? |
| 10 |
Cycle de vie de l’ingénierie des données |
| 11 |
Pipeline pédagogique inspiré de Spotify |
| 12 |
Deux profils de source : schéma à l’écriture vs schéma à la lecture |
| 13 |
Idempotence : deux runs, un seul résultat |
| 14 |
États de confiance medallion appliqués au cas Spotify |
| 15 |
Évolution complète d’un événement |
| 16 |
ETL : des sources aux usages analytiques |
| 17 |
ELT : charger le brut, transformer ensuite |
| 18 |
Clé primaire vs clé étrangère |
| 19 |
1NF : une cellule, une valeur |
| 20 |
2NF : dépendre de toute la clé |
| 21 |
3NF : pas de dépendance transitive |
| 22 |
Exemple de schéma en étoile |
| 23 |
Du schéma en étoile au schéma en flocon |
| 24 |
Exemple de diagramme entité-association pour une pizzeria |
| 25 |
Cardinalités en notation « patte d’oie » |
| 26 |
Combiner partitionnement et clustering dans BigQuery |
| 27 |
Les quatre familles de bases NoSQL |
| 28 |
Théorème CAP : propriétés des bases distribuées |