En résumé, le Data Lake est un pilier du Big Data, capable de stocker tous types de données (structurées et non structurées) avec une scalabilité illimitée. Basé sur le stockage objet (AWS S3, Google Cloud Storage, Azure Blob Storage), il alimente la Business Intelligence (BI), le Machine Learning et l’analyse en temps réel.
Sommaire :
00:00 Introduction
00:14 Qu’est ce qu’un data lake?
01:38 Contraintes du datalake
02:30 3 couches de données
02:59 Data warehouse vs Data lake
Soyez le premier à commenter