Nice Data - Construire. Comprendre. Explorer.
  • Blog
  • Nice Data
  • Projet Synapse Lakehouse
  • À propos
Se connecter S'abonner

Jean-Laurent Ferralis

Jean-Laurent Ferralis
dbt : installer notre environnement local et découvrir les seeds

Développement

dbt : installer notre environnement local et découvrir les seeds

Installez dbt v2 avec DuckDB sous Windows, créez un premier projet local et chargez deux fichiers CSV avec dbt seed pour préparer la suite de la série.

Par Jean-Laurent Ferralis 23 sept. 2026
De l’effet waouh à la réalité : ce que l’IA a changé dans ma façon d’apprendre et de construire

IA appliquée

De l’effet waouh à la réalité : ce que l’IA a changé dans ma façon d’apprendre et de construire

Après l’effet waouh du code généré par l’IA, j’ai découvert une nouvelle dette technique : celle des décisions que je n’avais pas comprises. Retour d’expérience sur une façon de construire plus vite sans abandonner l’architecture.

Par Jean-Laurent Ferralis 16 sept. 2026
databricks & Azure logo

Azure Databriks - Introduction par la pratique

Dans le monde de l'ingénierie des données moderne, Databricks est un nom très connu. Lorsque l'on gravite autour de Spark, on utilise très régulièrement des outils ou concept directement issue de Databricks. Dans cet article nous allons faire nos premiers pas directement sur la plateforme Databricks

Par Jean-Laurent Ferralis 15 nov. 2024
Fabric copy job

Fabric - Copy job

Il y a quelque temps, Microsoft a annoncé un type de job particulier, les "Copy job". Dans de nombreux projets, pour des raisons d'impact sur les bases opérationnelles, nous faisons des copies des données sources pour travailler de façon autonome par la suite. Ce type de job est justement là pour tr

Par Jean-Laurent Ferralis 11 nov. 2024
Terraform + Fabric

Microsoft Fabric via Terraform - les Basics

Microsoft a annoncé très récemment la "Public Preview" d'un provider Terraform pour Microsoft Fabric. Nous allons ici tester les basics de la mise en place d'une Infrastructure as Code (IaC) autour de Fabric !

Par Jean-Laurent Ferralis 14 oct. 2024
people running

Zone Gold et Pipeline d'intégration synapse

Après avoir alimenté notre zone bronze : Paramétrer les Pipeline Azure Synapse Analytics sans ouvrir Synapse ! ; Après avoir alimenté notre zone sliver : Notre premier notebook Spark dans Synapse ; Nous allons maintenant alimenter notre zone gold et créer notre pipeline d'intégration complet de l'ingestion de nos données On-

Par Jean-Laurent Ferralis 28 sept. 2024
notebook drawing

Notre premier notebook Spark dans Synapse

Synapse nous permet d'utiliser Apache Spark en tant que Runtime de processing afin de travailler nos différents datasets. Dans cet article, nous allons créer notre premier notebook Spark (et le pool Spark nécessaire) pour transformer nos premières données de la zone bronze pour commencer à alimenter notre zone

Par Jean-Laurent Ferralis 17 août 2024
Authorized only

Connexion du Lake à Synapse

Nous avons fait le choix de créer un compte de stockage (ou plusieurs) séparé de celui propre à Synapse pour notre datalake. Et donc, après avoir créé nos différentes ressources (workspace et stockage), il reste une étape importante qui est la "connexion" du stockage au workspace afin de

Par Jean-Laurent Ferralis 17 juil. 2024
Conteneur de stockage

Architecture Data

Zones de Datalake selon les "bonnes pratiques" Microsoft

Comme tout bon éditeur qui se respecte, Microsoft présente de bonnes pratiques d'implémentation. La documentation proposée est disponible ici : Zones et conteneurs de lac de données - Cloud Adoption Framework | Microsoft Learn Nous allons dans cet article créer les différentes zones de notre Datalake en respectant ces bonnes pratiques

Par Jean-Laurent Ferralis 01 juin 2024
Wide World Importers

Wide World Importers - BDD source du projet

Nous allons dans cette article "installer" la base d'exemple Wide Word Importer de Microsoft, la préparer et l'inspecter un minimum pour pouvoir débuter nos travaux de Datalake.

Par Jean-Laurent Ferralis 11 mai 2024
Mise en cluster d'un runtime d'intégration auto-hébergé

Mise en cluster d'un runtime d'intégration auto-hébergé

Dans un précédent article, nous avons installé un runtime d'intégration auto-hébergé permettant le transfert de données locales vers Azure. Nous avions évoqué dans les options avancées, la possibilité de faire de la haute disponibilité pour notre runtime. Nous allons dans cet article configurer la haute disponibilité sur

Par Jean-Laurent Ferralis 02 avr. 2024
Créer un dataset Power BI depuis notre Synapse DataLakeHouse

Créer un dataset Power BI depuis notre Synapse DataLakeHouse

Notre DataLakeHouse contient physiquement des fichiers de données. Ceux-ci sont organisés, nettoyés, représentent un modèle de donnée défini sur la "dernière" couche et éventuellement de formats différents. Nous pouvons donc lire nos données depuis ces fichiers et travailler dessus pour faire ce que l'on en

Par Jean-Laurent Ferralis 29 mars 2023
Tout voir

Nice Data - Construire. Comprendre. Explorer.

Construire des solutions data utiles, comprendre les architectures modernes et explorer les technologies qui façonnent la Data.

Nice Data - Construire. Comprendre. Explorer.
  • Newsletter
Propulsé par Ghost