Databricks et Spark - traitement de données à grande échelle
Date de mise à jour :
Identifiant Offre Info : 14_AF_0000292531
Organisme responsable :
IDCACADEMY
(ouvre dans un nouvel onglet)
Présentation de la formation
Objectifs
Maîtriser la plateforme Databricks et Apache Spark pour l'ingénierie et l'analytique big data. Objectifs pédagogiques : Prendre en main Databricks (workspaces, notebooks, Unity Catalog). Développer des jobs Spark structurés (Delta Lake, optimisations). Orchestrer, tester et industrialiser (Jobs, workflows, CI/CD). Compétences visées : Spark/Delta Data Engineering Orchestration & CI/CD Gouvernance (Unity Catalog) Prépare à la certification : Databricks & Spark…
Objectifs pédagogiques :
- Prendre en main Databricks (workspaces, notebooks, Unity Catalog).
- Développer des jobs Spark structurés (Delta Lake, optimisations).
- Orchestrer, tester et industrialiser (Jobs, workflows, CI/CD).
- Spark/Delta
- Data Engineering
- Orchestration & CI/CD
- Gouvernance (Unity Catalog)
Programme de la formation
Durée : 3 jour(s), soit 21 heures. Formation animée par un formateur expert du domaine, alternant apports théoriques et travaux pratiques. Programme adaptable aux besoins du commanditaire. Module 1 — Fondamentaux Databricks (0,5 j) Contenus : Workspace Repos Catalogues & permissions Module 2 — Traitements Spark & Delta (1,5 j) Contenus : Spark SQL & DataFrames OPTIMIZE, Z?ORDER Streaming Module 3 — Industrialisation (1 j) Contenus : Jobs/Workflows Tests &…
Module 1 — Fondamentaux Databricks (0,5 j)
Contenus :
- Workspace
- Repos
- Catalogues & permissions
Contenus :
- Spark SQL & DataFrames
- OPTIMIZE, Z?ORDER
- Streaming
Contenus :
- Jobs/Workflows
- Tests & CI/CD
- Monitoring & coûts
Contenus :
- MLflow : tracking, registry, déploiement
- Serving des modèles sur Databricks
- Optimisation des pipelines ML
- Lab : pipeline ML complet avec MLflow sur Databricks
- Déployer et monitorer des modèles ML sur Databricks
Validation et sanction
Type de formation
Non certifiante
Niveau de sortie
Sans niveau spécifique
Durée, rythme, financement
Modalités pédagogiques
Groupe de 12 stagiaires maximum, formateur expert du domaine. Apports théoriques et travaux pratiques sur environnement dédié. Présentiel Paris 8e, classe virtuelle ou mixte. Supports adaptables au ha
Durée
En centre
21 h
Financement
- Conventionnement
- Non
- Conditions de prise en charge
- Tarif : 1800 € net de taxe (3 j à 600 €/jour). Financement possible : plan de développement des compétences, OPCO, AIF ou POEI France Travail, aides régionales dont Recrut'up, financement personnel ou employeur.
Conditions d'accès
Public visé
- Tout public
Informations sur les publics
Data Engineers, Data Scientists, Architectes Data. Ouvert aux salariés, demandeurs d'emploi, indépendants et particuliers. Accessible aux personnes en situation de handicap (référent dédié).
Modalités de recrutement et d'admission
Entretien ou RDV individuel
Niveau d'entrée
Sans niveau spécifique
Conditions spécifiques et prérequis
Bases Python/SQL et concepts Data Lake. Un entretien de positionnement valide le profil avant l'entrée en formation.
Lieu de réalisation de l'action
Modalités d'enseignement
Formation mixte
Adresse
58 RUE DE MONCEAU75008 Paris 8e
Responsable : IDCACADEMY
Périodes prévisibles de déroulement des sessions
Début
Fin
- Adresse d'inscription
-
IDCACADEMY
75008 Paris 8e - État du recrutement
- Ouvert
- Modalités
- Entrées / Sorties à dates permanentes