Senior Data Engineer (H/F)

Devoteam
Casablanca
Workplace: OnsiteFull timeFunction: Solutions Engineering & Sales EngineeringExperience: 4+ yearsSkills: ["Collaboration","Documentation","Incident resolution","Data quality awareness"]

Concevoir, industrialiser et optimiser des plateformes de données batch et temps réel dans des environnements distribués basés sur Cloudera. Vous développez des pipelines avec PySpark, mettez en place l’ingestion et le streaming via Kafka et NiFi, modélisez NoSQL (Cassandra) et Hive, et garantissez qualité, performance et fiabilité en production. Vous industrialisez les développements avec CI/CD, documentez les flux, contribuez à la gouvernance des données et collaborez avec les équipes métiers et Data Scientists.

Loading

Loading job details...

Preparing the role view and application actions.

FursaFursa
Devoteam
Devoteam
2 months ago

Senior Data Engineer (H/F)

✓ Verified Job

Canonical indexed version, validated from employer's careers page.

Source: Company careers pageValidated by: Fursa AI
Last checked: 43 minutes agoStatus: Live
Reposted: similar role first listed 9 months ago

Job Summary

Concevoir, industrialiser et optimiser des plateformes de données batch et temps réel dans des environnements distribués basés sur Cloudera. Vous développez des pipelines avec PySpark, mettez en place l’ingestion et le streaming via Kafka et NiFi, modélisez NoSQL (Cassandra) et Hive, et garantissez qualité, performance et fiabilité en production. Vous industrialisez les développements avec CI/CD, documentez les flux, contribuez à la gouvernance des données et collaborez avec les équipes métiers et Data Scientists.
Location: Casablanca
Workplace: Onsite
Employment Type: Full time · Permanent
Job Function: Solutions Engineering & Sales Engineering
Seniority: Mid level

Key Responsibilities

  • •Développer des pipelines de traitement de données massives en PySpark pour des modes batch et real-time/streaming.
  • •Mettre en place des flux temps réel via Kafka et assurer l’ingestion avec NiFi.
  • •Modéliser et optimiser des schémas NoSQL, notamment sur Cassandra, et optimiser les traitements Spark pour architectures distribuées.
  • •Déployer des mécanismes de Data Quality (contrôles, monitoring, alerting) et gérer la supervision/résolution des incidents en production.
  • •Industrialiser les développements via des chaînes CI/CD, documenter les flux/modèles, et contribuer à la gouvernance des données.

Key Requirements

  • •4 ans d’expérience dans des environnements distribués et des architectures Big Data.
  • •Maîtrise impérative du traitement Batch et Streaming avec Spark/PySpark.
  • •Très bonne maîtrise de Kafka pour le temps réel et de NiFi pour l’ingestion.
  • •Expérience confirmée en NoSQL, notamment Cassandra et/ou Hive, et capacité à modéliser/optimiser les schémas.
  • •Compétences en Git, CI/CD (tests automatisés, déploiements) et en un outil d’orchestration (Airflow, Luigi ou Prefect).
Experience:4+ yearsBig DataDistributed systemsData engineeringStreamingNoSQLHadoop ecosystem
Skills:CollaborationDocumentationIncident resolutionData quality awareness
Languages:English
Tech Stack:PySparkSparkKafkaNiFiCassandraHiveNoSQLHadoopHDFSClouderaGitCI/CDGitLab CIAirflowLuigiPrefectDataviz

Company Brief

Devoteam
Devoteam is an IT consulting firm specializing in digital transformation, cloud, cybersecurity, and data solutions for enterprise clients across Europe and the Middle East, combining technology partnerships with management consulting services.
Industry: Consulting
Company Size: Enterprise (1,001+ employees)
Growth: Public Company
Valuation: Public Company (Market Cap in USD)
Funding: IPO / Publicly Listed
Headquarters: Paris, France
Founded: 1995
WebsiteLinkedIn