Aller au contenu principal

Polars

Date de mise à jour :
Identifiant Offre Info : 14_AF_0000270332
Organisme responsable : Human Coders (ouvre dans un nouvel onglet)

Nouvelle recherche

Présentation de la formation

Objectifs

  • Écrire des transformations idiomatiques avec l'API expression-first
  • Construire et analyser un plan d'exécution LazyFrame
  • Optimiser un pipeline via predicate et projection pushdown
  • Migrer un traitement Pandas vers Polars proprement
  • Produire des fichiers Parquet partitionnés adaptés à un cas métier
  • Mesurer et interpréter les gains de performance (temps et mémoire)

Programme de la formation

Cette formation intensive de 3 jours sur Polars cible les utilisateurs Python expérimentés avec Pandas, nécessitant une bonne maîtrise de Python, des DataFrames Pandas et des bases en manipulation de données pour une migration fluide. La progression pédagogique est structurée logiquement : le Jour 1 initie à la philosophie Polars (architecture columnar, API expression-first) et corrige les pièges Pandas via manipulations idiomatiques (select, with_columns, jointures) ; le Jour 2 approfondit la…

Cette formation intensive de 3 jours sur Polars cible les utilisateurs Python expérimentés avec Pandas, nécessitant une bonne maîtrise de Python, des DataFrames Pandas et des bases en manipulation de données pour une migration fluide. La progression pédagogique est structurée logiquement : le Jour 1 initie à la philosophie Polars (architecture columnar, API expression-first) et corrige les pièges Pandas via manipulations idiomatiques (select, with_columns, jointures) ; le Jour 2 approfondit la Lazy Execution (plans d'exécution, pushdown, streaming) pour optimiser les performances ; le Jour 3 aborde la production (Parquet partitionné, PyArrow, intégration DuckDB/lakehouse) avec benchmarks concrets. Les méthodes d'apprentissage alternent théorie démontrée, mini-exercices pratiques (correction de code Pandas, analyse de plans .explain()), mises en situation (nettoyage de datasets massifs, benchmarks CPU/mémoire) et ateliers (traduction de pipelines, rédaction de rapports professionnels). À l'issue, les participants maîtrisent l'écriture idiomatique Polars, l'optimisation lazy (predicate/projection pushdown), la production de fichiers Parquet scalables et la mesure objective de gains (temps, mémoire), favorisant une expérience immersive et mesurable pour des pipelines data performants en production.

Validation et sanction

Attestation de formation

Type de formation

Non certifiante

Niveau de sortie

Sans niveau spécifique

Durée, rythme, financement

Financement

Conventionnement
Non

Conditions d'accès

Public visé

  • Tout public

Niveau d'entrée

Sans niveau spécifique

Conditions spécifiques et prérequis

-

Lieu de réalisation de l'action

Modalités d'enseignement

Formation entièrement en présentielle

Adresse

11bis Passage Doisy
75017 Paris 17e

Responsable : Human Coders

Périodes prévisibles de déroulement des sessions

Début

Fin

Adresse d'inscription
Human Coders
75017 Paris 17e
État du recrutement
Ouvert
Modalités
Entrées / Sorties à dates fixes