ami consulting

Data Engineer GCP / Hadoop / PySpark (H/F)

ami consulting Neuilly-sur-Seine, Ile-de-France, France · €50K/yr

Business Consulting and Services · 2-10 employees

10 h ago
data-engineer Senior (5-10 yrs) Full-time France
Log in to apply, save this posting, or score it against your profile with AI.

About the role

The Data Engineer will design, develop, and maintain data pipelines and ingestion flows within a Big Data environment. They will collaborate with DevOps and international teams to industrialize data processes and optimize performance.

What they look for

GCP Hadoop PySpark Spark Shell Scripting Data Lake Big Data Data Engineering Agile DevOps Data Pipelines Data Ingestion Data Transformation Data Integration

Requirements

Candidates must have at least 5 years of experience in Data Engineering with strong proficiency in PySpark, Hadoop, and GCP. Professional English skills are required for regular interaction with international teams.

Full description

🚀 À propos d’AMI Consulting

💡 Entreprise innovante & familiale – Lauréat de la bourse Innov'UP de BPI France en 2019, AMI Consulting est spécialisé dans l’exploitation de la data afin de proposer des consultants experts parfaitement adaptés aux besoins de ses clients.

🌱 Engagement durable & bien-être – Nous valorisons la qualité de vie de nos collaborateurs et adoptons une approche 100 % digitale pour la qualification, la sélection et l’intégration de nos talents, réduisant ainsi notre empreinte carbone.

🎯 Présentation de l'offre

📍 Localisation : Île-de-France

🏢 Secteur : Data / Big Data / Cloud

🏠 Télétravail : Hybride – 1 jour de télétravail par semaine

📄 Contrat : CDI de mission ou Freelance via portage salarial

💰 CDI de mission : 50 k€ brut annuel

💰 Freelance : TJM 480 € HT – uniquement via société de portage

👨‍💻 Expérience : 5 ans minimum

🇫🇷 Français : Courant

🇬🇧 Anglais : Professionnel – échanges avec des équipes internationales

🧠 Contexte de la mission

Au sein de la DSI de notre client, en charge de la conception et de la maintenance des applications stratégiques des métiers du Groupe, nous recherchons un Data Engineer GCP / Hadoop / PySpark.

La mission s’inscrit dans le cadre de l’évolution du Data Lake CIO Office.

Le consultant participera au développement, à l’évolution et à l’industrialisation des pipelines de données, en collaboration avec les équipes de production applicative et DevOps.

Vous évoluerez dans un environnement Big Data, Cloud et Agile, avec des interactions régulières avec des équipes internationales.

🧩 Responsabilités

  • Concevoir et développer de nouveaux flux d’ingestion de données
  • Développer et maintenir les pipelines Data en PySpark
  • Réaliser les traitements de préparation, transformation et intégration des données
  • Participer à l’évolution du Data Lake et des traitements Big Data
  • Développer et maintenir des scripts Shell
  • Collaborer avec les équipes DevOps sur les évolutions de la plateforme
  • Rédiger les spécifications techniques
  • Participer aux tests, validations et mises en production
  • Optimiser les traitements et les performances des pipelines
  • Participer aux cérémonies Agile et aux échanges avec les équipes internationales

🛠️ Compétences techniques

  • GCP
  • Hadoop
  • PySpark / Spark
  • Shell Scripting
  • Data Lake
  • Big Data / Data Engineering

👤 Profil recherché

  • Expérience confirmée en tant que Data Engineer
  • Excellente maîtrise de PySpark / Apache Spark
  • Expérience significative sur des environnements Hadoop / Big Data
  • Bonne connaissance des environnements GCP

Similar roles