Senior Data Engineer

Toppan Merril

Chennai District

On-site

INR 800,000 - 1,200,000

Full time

14 days+

Get more replies from employers

Send a job-specific resume in minutes.

Job summary

Toppan Merril is seeking a Data Engineer in Chennai, India, responsible for building and maintaining ETL/ELT data pipelines using Azure Databricks and Apache Spark. The role demands strong experience in designing data governance and ensuring data quality. Candidates should have proficiency in Python and SQL to optimize data transformations.

The ideal candidate will collaborate with various teams and must possess excellent problem-solving skills. Knowledge of CI/CD practices and security compliance is essential for this position.

Qualifications

  • Strong experience building distributed data pipelines using Azure Databricks and Apache Spark (PySpark).
  • Proficiency in writing optimized and maintainable Python code for data engineering.
  • Hands-on experience implementing data governance, access controls, and lineage tracking with Unity Catalog.
  • Strong knowledge of SQL for data transformations and optimizations.

Responsibilities

  • Build, test, and maintain ETL/ELT data pipelines using Azure Databricks and Apache Spark.
  • Optimize performance and cost‑efficiency of Spark jobs.
  • Ensure data quality through validation, monitoring, and alerting mechanisms.
  • Implement Unity Catalog for data governance, managing data lineage and access control policies.
  • Enable secure data sharing across teams and external stakeholders.

Skills

Azure Databricks and Apache Spark (PySpark)
Python
Unity Catalog
SQL
Delta Lake
Workflow Orchestration
CI/CD & Infrastructure as Code (IaC)
Security & Compliance

Job description

Responsibilities
  • Build, test, and maintain ETL/ELT data pipelines using Azure Databricks and Apache Spark (PySpark).
  • Optimize performance and cost‑efficiency of Spark jobs.
  • Ensure data quality through validation, monitoring, and alerting mechanisms.
  • Understand cluster types, configuration, and use‑cases for serverless computing.
  • Implement Unity Catalog for data governance—design and enforce access control policies, manage data lineage, auditing, and metadata governance.
  • Enable secure data sharing across teams and external stakeholders.
  • Integrate Databricks with Azure Data Lake Storage, Azure Blob Storage, Azure Event Hub, and other cloud data platforms.
  • Implement Delta Lake for scalable, ACID‑compliant storage.
  • Automate and orchestrate workflows: develop CI/CD pipelines for data workflows using Azure Databricks Workflows or Azure Data Factory.
  • Monitor and troubleshoot failures in job execution and cluster performance.
  • Collaborate with Data Analysts, Scientists, and Business Teams to translate business needs into scalable data engineering solutions.
  • Pull data from a wide variety of APIs using different strategies and methods.
Required Skills & Experience
  • Azure Databricks and Apache Spark (PySpark) – strong experience building distributed data pipelines.
  • Python – proficiency in writing optimized and maintainable Python code for data engineering.
  • Unity Catalog – hands‑on experience implementing data governance, access controls, and lineage tracking.
  • SQL – strong knowledge of SQL for data transformations and optimizations.
  • Delta Lake – understanding of time travel, schema evolution, and performance tuning.
  • Workflow Orchestration – experience with Azure Databricks Jobs or Azure Data Factory.
  • CI/CD & Infrastructure as Code (IaC) – familiarity with Databricks CLI, Databricks DABs, and DevOps principles.
  • Security & Compliance – knowledge of IAM, role‑based access control (RBAC), and encryption.
Preferred Qualifications
  • Experience with MLflow for model tracking & deployment in Databricks.
  • Familiarity with streaming technologies such as Kafka, Delta Live Tables, Azure Event Hub, and Azure Event Grid.
  • Hands‑on experience with dbt (Data Build Tool) for modular ETL development.
  • Certification in Databricks, Azure is a plus.
  • Experience with Azure Databricks Lakehouse connectors for Salesforce and SQL Server.
  • Experience with Azure Synapse Link for Dynamics, Dataverse.
  • Familiarity with other data pipeline strategies, such as Azure Functions, Fabric, ADF, etc.
Soft Skills
  • Strong problem‑solving and debugging skills.
  • Ability to work independently and in teams.
  • Excellent communication and documentation skills.
Equity Statement

Toppan Merrill is an equal opportunity/affirmative action employer. Qualified individuals, including qualified women, minorities, individuals with disabilities, and veterans, are encouraged to apply.

Get your free, confidential resume review.
or drag and drop your file here.
Similar jobs

Similar jobs worth comparing

Senior Data Engineer
Senior Data Engineer

Toppan Merril • Chennai

On-site
INR 1,000,000 - 1,500,000
Data Engineer
Data Engineer

Kumaran Systems • Chennai District

On-site
INR 4,000,000 - 7,000,000
Data Engineer
Data Engineer

Kumaran Systems • Hyderabad

On-site
INR 2,400,000 - 4,200,000
Senior Data Engineer
Senior Data Engineer

Kumaran Systems • Hyderabad

On-site
INR 4,000,000 - 6,000,000
Data Engineering Lead
Data Engineering Lead

Kumaran Systems • Hyderabad

On-site
INR 2,800,000 - 4,000,000
Azure Data Engineer
Azure Data Engineer

Deloitte Shared Services India • Coimbatore District

Hybrid
INR 1,200,000 - 1,800,000
Azure Subcontractor
Azure Subcontractor

Birlasoft • Hyderabad

On-site
INR 1,200,000 - 1,800,000
Databricks - Data Engineer
Databricks - Data Engineer

Tredence Inc. • Bengaluru

On-site
INR 1,500,000 - 2,500,000
Senior Databricks Engineer
Senior Databricks Engineer

Keka Technologies Private Limited • Hyderabad

On-site
INR 1,500,000 - 2,500,000
Azure Databricks Engineer
Azure Databricks Engineer

Turnkeylearning • Hyderabad

On-site
INR 1,000,000 - 2,000,000