data-platformDemande élevée · Tendance croissance

Dossier de compétencesDatabricks Lakehouse Platform

Databricks est la plateforme Apache Spark managée et unifiée pour les projets data et IA. Elle couvre l'ingestion (DLT), la transformation (notebooks, dbt), le ML (MLflow, Feature Store) et le serving de modèles. En ESN, elle est demandée sur les projets de modernisation de data factory et les projets IA.

Le DC est une brique parmi d'autres : explorez comment automatiser tout votre pipeline de recrutement avec l'IA.

Versions

Databricks Runtime 13+

Demande

élevée

Métiers

5 profils

Production

Délais courts

Cas d'usage typiques

  • Lakehouse avec Delta Lake pour les projets data à grand volume
  • Pipelines ML end-to-end avec MLflow et Feature Store
  • Streaming temps-réel avec Structured Streaming
  • Migration depuis Hadoop/HDFS vers Databricks

Critères DC spécifiques

  • Certifications Databricks (Data Engineer Associate, ML Associate/Professional)
  • Delta Lake : expérience avec ACID transactions et time travel
  • MLflow en production : tracking, registry, serving de modèles
  • Unity Catalog pour la gouvernance des données

Écosystème

Apache Spark / PySparkMLflowDelta LakeUnity Catalogdbt on Databricks

Les prestations Profilya

Un accompagnement IA pour tous vos enjeux RH

Profilya vous accompagne sur l'ensemble de vos process RH — du tri de CV aux dossiers de compétences ESN, jusqu'aux automatisations sur-mesure.

Confiez-nous la production d'un DC Databricks professionnel

Profilya identifie les compétences Databricks, structure les expériences et livre un DC prêt à envoyer.