SSSèmèvo SALAKOinlokolabs.hashnode.dev·Mar 25 · 6 min readMa stack data locale en 2026 et pourquoi chaque outil a gagné sa placeLe principe de base : reproduire la prod en local La question que je me pose avant d'ajouter un outil : est-ce que ce setup me permettrait de bosser sur un vrai pipeline de prod sans rien réapprendre 00
SSSèmèvo SALAKOinlokolabs.hashnode.dev·Mar 16 · 7 min readdbt + DuckDB : monte ton entrepôt local de zéroPourquoi DuckDB comme backend dbt ? dbt a besoin d'un moteur SQL pour exécuter les transformations. En général c'est Snowflake, BigQuery, Redshift. Ces outils sont excellents en prod — mais lourds à c00
SSSèmèvo SALAKOinlokolabs.hashnode.dev·Mar 13 · 5 min readDuckDB vs Pandas : j'ai testé les deux sur 54 millions de lignesLe contexte Pandas est l'outil par défaut de tout Data Engineer Python. Fiable, connu, documenté. Mais il a une limite fondamentale : il charge tout le dataset en RAM. Chaque opération commence par ma00
SSSèmèvo SALAKOinlokolabs.hashnode.dev·Mar 9 · 5 min readPourquoi j'ai choisi un fichier HTML plutôt que Next.js pour ma landing pageIl y a un anti-pattern que je vois partout dans le monde de la data : utiliser Apache Spark pour traiter 10 000 lignes de CSV. Le framework impressionne sur le papier, il est dans le CV, alors on l'ut00