Data Engineer Databricks Confirmé - CDI (H/F)

Postuler à cette offre
Partager

💼 Offre d'emploi

Date de publication
11/09/2026
Dernière mise à jour
12/09/2026
Type de contrat
CDI
Durée de travail
Expérience
2 An(s)
Salaire brut
Annuel de 50000.0 Euros à 58000.0 Euros
Permis demandé
Aucune information

📍 Entreprise

Aucun logo fourni
Employeur
Collective.work
Secteur d'activité
(Code NAF )

Lieu de travail

75 - Paris (Code postal ) Voir sur une carte

Déplacement


Description de l'offre

Salaire: 50-58k€

CONTEXTE

En tant que Data Engineer, vous intervenez sur la conception, le développement et l'optimisation de pipelines de données robustes et scalables. Vous travaillez au cœur des plateformes Data afin de garantir la qualité, la disponibilité et la performance des données utilisées par les équipes métiers, BI et Data Science.

MISSIONS

*

Concevoir, développer et optimiser des pipelines de données robustes et scalables

*

Collaborer efficacement au sein d'équipes agiles et pluridisciplinaires, en lien avec les équipes Data, IT et métiers

*

Garantir la qualité, la disponibilité et la performance des données

*

Prioriser les tâches, gérer les contraintes et respecter les engagements

*

Communiquer clairement avec des interlocuteurs techniques et non techniques

*

Appliquer les bonnes pratiques de développement logiciel pour assurer la maintenabilité et la testabilité des pipelines

*

Concevoir des pipelines Data comme de véritables produits logiciels, en tenant compte de la maintenabilité, de l'évolutivité et de l'observabilité

*

Mettre en place des stratégies de tests automatisés pour les pipelines, incluant tests unitaires et contrôles de qualité des données

OUTILS & ENVIRONNEMENT

*

Plateforme Databricks dans un contexte Data Engineering

*

Apache Spark via PySpark et Spark SQL pour le développement de pipelines Data

*

Delta Lake et ses mécanismes clés (Delta log, ACID, schema evolution, time travel)

*

Méthodes d'ingestion de données sur la plateforme Databricks

*

Framework Spark Declarative Pipelines

*

Outils de tests automatisés : pytest, contrôles qualité des données (DQX, SDP Expectations)

*

Gestion de version avec Git et workflows collaboratifs associés

*

Langage SQL pour interrogation des données

*

Programmation en Python avec bonnes pratiques de software engineering (structuration, modularité, conventions de nommage, gestion des dépendances)

*

Environnements Business Intelligence, Big Data et architectures Lakehouse

*

Plateformes Data modernes (Cloud)

CONDITIONS DE TRAVAIL

*

Expérience attendue : 3 à 6 ans en ingénierie Data

*

Rémunération : 50-58k€

*

Certifications recommandées : Databricks Certified Data Engineer Associate (ou équivalent)

1.

3 à 8+ ans d'expérience en ingénierie Data

2.

Capacité à évoluer efficacement au sein d'équipes agiles et pluridisciplinaires

3.

Fort esprit analytique et grande rigueur

4.

Autonomie, proactivité et sens des responsabilités

5.

Capacité à communiquer clairement avec des interlocuteurs techniques et non techniques

6.

Savoir prioriser les tâches, gérer les contraintes et respecter les engagements

7.

Esprit de synthèse et orientation résultats et valeur métier

8.

Bonne connaissance des environnements Business Intelligence, Big Data et des architectures Lakehouse

9.

Expérience sur des plateformes Data modernes (Cloud)

10.

Maîtrise de SQL et notions de modélisation de données (architecture médaillon, modèle en étoile)

11.

Bagage en software engineering pour écrire un code robuste, lisible, maintenable et testable, notamment en Python

12.

Application des bonnes pratiques de développement : structuration du code, modularité, gestion des dépendances, conventions de nommage

13.

Sensibilisation aux principes de qualité logicielle (tests unitaires, tests d'intégration, revue de code)

14.

À l'aise avec les outils de versioning (Git) et workflows collaboratifs

15.

Capacité à concevoir des pipelines Data comme des produits logiciels, en tenant compte de la maintenabilité, évolutivité et observabilité

16.

Bonne maîtrise de la plateforme Databricks en contexte Data Engineering

17.

Utilisation avancée d'Apache Spark via PySpark et Spark SQL pour le développement

Postuler à cette offre
Partager

Identifiant de cette offre d'emploi sur France Travail : 6825465

Libellé ROME de l'offre d'emploi : Data engineer (Code ROME : M1811)

Autre appellation de l'offre : Big data engineer

Source : France Travail (Cojob n'est pas responsable des informations fournies)

Publicité

Offres d'emploi similaires

Chargement des offres similaires...