Senior Data Engineer

ClanX

Gurugram District

On-site

INR 1,800,000 - 2,800,000

Full time

11 days ago

Get more replies from employers

Send a job-specific resume in minutes.

Job summary

ClanX in Gurugram, India, is seeking a data engineer to design, build, and maintain scalable batch ETL/ELT and CDC pipelines. You will own ingestion from client systems into our data platform and ensure reliability.

You will optimize Spark/PySpark and SQL workloads for large-scale analytics, implement data quality checks, and collaborate with ML, product, and engineering teams to deliver robust data solutions.

Qualifications

  • 3–7 years of hands-on experience building production-grade data pipelines.
  • Strong SQL expert with query optimization and complex transformations.
  • Strong Python programming skills for data engineering workloads.
  • Experience with Spark/PySpark or equivalent distributed processing frameworks.
  • Strong understanding of data modeling, ETL/ELT, CDC, incremental processing, and partitioning.
  • Experience with workflow orchestration tools such as Dagster, Airflow, or Prefect.
  • Experience working with AWS or Azure cloud platforms.
  • Strong focus on data quality, observability, validation, and monitoring.
  • Experience building scalable datasets for analytics and machine learning use cases.
  • Bachelor's degree in Computer Science, Engineering, Mathematics, or a related field.

Responsibilities

  • Design, build, and maintain scalable batch ETL/ELT and CDC pipelines.
  • Own data ingestion from client systems into the data platform.
  • Build reliable, idempotent, incremental, and backfill-safe data pipelines.
  • Model and transform raw data into trusted analytical and ML-ready datasets.
  • Develop and optimize Spark/PySpark and SQL workloads for large-scale processing.
  • Implement data quality checks, lineage, monitoring, and alerting mechanisms.
  • Support machine learning feature pipelines and analytics platforms.
  • Optimize storage formats, partitioning strategies, and query performance.
  • Collaborate with ML, product, and engineering teams to deliver reliable data solutions.
  • Drive best practices for scalability, reliability, and maintainability across the data stack.

Education

Bachelor's degree in CS/Engineering/Mathematics

Job description

Job Description:

Requirements
  • 3–7 years of hands-on experience building production-grade data pipelines
  • Strong expertise in SQL, including query optimization and complex transformations
  • Strong Python programming skills for data engineering workloads
  • Experience with Spark/PySpark or equivalent distributed processing frameworks
  • Strong understanding of data modeling, ETL/ELT, CDC, incremental processing, and partitioning
  • Experience with workflow orchestration tools such as Dagster, Airflow, or Prefect
  • Experience working with AWS or Azure cloud platforms
  • Strong focus on data quality, observability, validation, and monitoring
  • Experience building scalable datasets for analytics and machine learning use cases
  • Bachelor's degree in Computer Science, Engineering, Mathematics, or a related field
Responsibilities
  • Design, build, and maintain scalable batch ETL/ELT and CDC pipelines
  • Own data ingestion from client systems into the data platform
  • Build reliable, idempotent, incremental, and backfill-safe data pipelines
  • Model and transform raw data into trusted analytical and ML-ready datasets
  • Develop and optimize Spark/PySpark and SQL workloads for large-scale processing
  • Implement data quality checks, lineage, monitoring, and alerting mechanisms
  • Support machine learning feature pipelines and analytics platforms
  • Optimize storage formats, partitioning strategies, and query performance
  • Collaborate with ML, product, and engineering teams to deliver reliable data solutions
  • Drive best practices for scalability, reliability, and maintainability across the data stack
Job Details

Gurugram - Hybrid (2–3 days on-site)

Interview Process
  • Technical Round (Python & SQL)
  • System Design Round
  • Culture Fit Round
Get your free, confidential resume review.
or drag and drop your file here.
Similar jobs

Similar jobs worth comparing

Senior Data Engineer - Gurugram
Senior Data Engineer - Gurugram

ClanX Network LLP • Gurugram District

Hybrid
INR 1,000,000 - 1,500,000
Data Engineer
Data Engineer

Newt Global • Chennai District

On-site
INR 1,200,000 - 1,800,000
Data Engineer (Contract)
Data Engineer (Contract)

NexTurn Inc. • Hyderabad

On-site
INR 1,200,000 - 1,800,000
Senior Data Engineer
Senior Data Engineer

Terasol Technologies Pvt. Ltd. • Gurgaon

Remote
INR 1,000,000 - 1,500,000
Remote work flexibility
Paid leaves
Performance incentives
+1
Data Engineer
Data Engineer

Agilisium • Chennai District

On-site
INR 800,000 - 1,200,000
Data Engineer
Data Engineer

Lorven Technologies Inc. • Bengaluru

On-site
INR 1,500,000 - 2,100,000
Senior Data Engineer
Senior Data Engineer

Go Digital Technology Consulting • Mumbai

Hybrid
INR 1,200,000 - 1,800,000
Senior Data Engineer
Senior Data Engineer

DATAECONOMY Inc • Hyderabad

On-site
INR 1,500,000 - 2,100,000
Data Engineer
Data Engineer

Deservely Technologies Pvt Ltd • Hyderabad

On-site
INR 1,500,000 - 2,300,000
Senior Data Engineer
Senior Data Engineer

DTDC Express • Gurugram District

On-site
INR 2,500,000 - 5,500,000