DuckDB vs Pandas : j'ai testé les deux sur 54 millions de lignes
Le contexte
Pandas est l'outil par défaut de tout Data Engineer Python. Fiable, connu, documenté. Mais il a une limite fondamentale : il charge tout le dataset en RAM. Chaque opération commence par ma
lokolabs.hashnode.dev5 min read