Cloudera DWH Analyst / Data Warehouse Engineer

Dixp

Delhi

On-site

INR 900,000 - 1,500,000

Full time

12 days ago

Get more replies from employers

Send a job-specific resume in minutes.

Job summary

Dixp is seeking a Cloudera DWH Analyst / Data Warehouse Engineer to design and implement data warehouses on CDP. You will build Medallion-layered warehouse architectures and develop scalable data pipelines using Spark and Hive.

Ideal candidates have 4–7 years of experience in data warehousing and big data environments, with strong SQL, Hive, Spark skills and data governance awareness.

Qualifications

  • Bachelor's degree in CS/IT or related field.
  • 4–7 years in Data Warehousing and Big Data environments.

Responsibilities

  • Design and implement Data Warehouse solutions on CDP.
  • Build data warehouse layers using Medallion Architecture (Bronze, Silver, Gold).
  • Design data models and analytics schemas for reporting.
  • Develop and manage data ingestion and transformations with Spark and Hive.
  • Implement ETL/ELT to move data into warehouse layers.
  • Ensure efficient data processing for analytics workloads.
  • Write and optimize SQL queries on large datasets.
  • Develop Hive queries and Spark jobs for batch processing.
  • Integrate data from multiple sources and perform cleansing/validation.
  • Document models, designs and transformation logic; ensure data governance.

Skills

Cloudera CDP
Hive
Spark
SQL
ETL pipelines
Data warehouse

Education

B.Tech/B.E. in Computer Science, Data Engineering, IT, or related field

Job description

Cloudera DWH Analyst / Data Warehouse Engineer

Experience: 4 - 7 yrs

Job Type: Full-Time / Contract

Education:
  • UG: B.Tech/B.E. in Computer Science, Data Engineering, Information Technology, or a related field
Job Description

Project Role Description: We are looking for a Cloudera DWH Analyst with strong experience in building Data Warehouses on Cloudera Data Platform (CDP) using Hive and Spark. The candidate will be responsible for designing and implementing data warehouse layers using Medallion Architecture (Bronze, Silver, Gold) and building scalable data pipelines and transformation workflows. The role requires hands‑on expertise in Hive, Spark, SQL, and big data warehousing concepts, along with experience working in distributed data platforms.

Key Responsibilities:
Data Warehouse Design
  • Design and implement Data Warehouse solutions on Cloudera Data Platform (CDP).
  • Build data warehouse layers using Medallion Architecture (Bronze, Silver, Gold layers).
  • Design data models and schema structures for analytics and reporting.
  • Develop and manage data ingestion and transformation pipelines using Apache Spark and Hive.
  • Implement ETL/ELT workflows to move data from source systems into the data warehouse layers.
  • Ensure efficient data processing and transformation for analytics workloads.
SQL Development & Data Processing
  • Write and optimize complex SQL queries on large datasets.
  • Develop Hive queries and Spark jobs for batch data processing.
  • Optimize queries and storage structures for performance and scalability.
Data Integration
  • Integrate data from multiple sources such as databases, files, APIs, and enterprise systems.
  • Implement data cleansing, transformation, and validation processes.
Performance Optimization
  • Optimize Hive tables, partitioning strategies, and storage formats.
  • Improve performance of Spark jobs and distributed data processing tasks.
  • Work closely with data engineers, architects, analysts, and business stakeholders.
  • Document data models, pipeline designs, and transformation logic.
  • Ensure adherence to data governance and best practices.
Qualifications:
  • Bachelor's degree in Computer Science, Data Engineering, Information Technology, or related field.
  • 4–7 years of experience in Data Warehousing and Big Data environments.
Required Skills:
  • Strong experience with Cloudera Data Platform (CDP).
  • Hands‑on experience with Hive and Spark.
  • Strong SQL development and query optimization skills.
  • Experience building data pipelines and ETL workflows.
  • Understanding of distributed data processing and big data concepts.
Preferred Skills:
  • Experience with Airflow or other workflow orchestration tools.
  • Familiarity with Impala for high-performance querying.
  • Experience with data governance tools such as Ranger and Atlas.
  • Knowledge of data lakehouse architectures and analytics platforms.
Get your free, confidential resume review.
or drag and drop your file here.
Similar jobs

Similar jobs worth comparing

Cloudera Hadoop Engineer (Big Data Engineer)
Cloudera Hadoop Engineer (Big Data Engineer)

Dixp • Delhi

On-site
INR 1,500,000 - 2,100,000
Data Migration Specialist – SQL DWH to Cloudera CDP
Data Migration Specialist – SQL DWH to Cloudera CDP

Dixp • Delhi

On-site
INR 1,200,000 - 1,800,000
Data Engineer (PySpark + Cloudera)
Data Engineer (PySpark + Cloudera)

Zorba AI • Maharashtra

On-site
INR 1,000,000 - 1,500,000
Cloudera Architect
Cloudera Architect

ASPL Info Services • Mumbai

On-site
INR 2,500,000 - 3,500,000
Big Data Engineer (Hadoop & Cloudera)
Big Data Engineer (Hadoop & Cloudera)

Sunware Technologies • Pune District

On-site
INR 1,800,000 - 2,500,000
Cloudera Administrator (CDP Platform)
Cloudera Administrator (CDP Platform)

Dixp • Delhi

On-site
INR 1,400,000 - 2,300,000
Data Architect
Data Architect

Geodis India Pvt.Ltd • Ernakulam

On-site
INR 1,800,000 - 2,800,000
Data Engineer
Data Engineer

Tekskills • Hyderabad

Hybrid
INR 900,000 - 1,600,000
Associate - Data Engineer-Data Management and Analytics-Database Warehousing
Associate - Data Engineer-Data Management and Analytics-Database Warehousing

EXL • Bengaluru

On-site
INR 900,000 - 1,500,000
Hadoop Data Engineer
Hadoop Data Engineer

Incedo Inc. • Hyderabad

On-site
INR 1,200,000 - 1,900,000