Data Engineer

PwC Service Delivery Center

Kolkata District, Hyderabad, Bengaluru

On-site

INR 900,000 - 1,800,000

Full time

10 days ago
Application generator

Stand out for this role — generate a tailored resume and cover letter in about a minute.

Get past ATS filters

Job summary

PwC Service Delivery Center in India is seeking a Senior Associate Data Engineering & AI to design, build, and optimize scalable data platforms for analytics, reporting, and AI-enabled applications.

The role requires hands-on experience with Oracle, SQL, MongoDB, Databricks, and managing data systems; you will develop ETL pipelines, data models, and AI-ready data pipelines, supporting embedding and vector search use cases.

Qualifications

  • Strong hands-on experience with Oracle Database, SQL, and PL/SQL.
  • Experience with relational database design, query optimization, indexing, partitioning, and performance tuning.
  • Working knowledge of MongoDB, including document modeling, aggregation, indexing, and administration.
  • Experience with Databricks, Apache Spark, Spark SQL, PySpark, and Delta Lake concepts.
  • Experience building batch or near-real-time data pipelines.
  • Knowledge of database administration, including backup, recovery, security, monitoring, migration, and high availability.
  • Understanding of AI-ready data pipelines, embeddings, vector search, similarity matching, and vector databases.
  • Proficiency in Python or another data-engineering scripting language.
  • Strong analytical, troubleshooting, communication, and documentation skills.

Responsibilities

  • Design and develop reliable ETL/ELT pipelines using SQL, Python, PySpark, and Databricks.
  • Build and maintain data models across Oracle, relational databases, MongoDB, and lakehouse platforms.
  • Develop and optimize complex SQL queries, stored procedures, views, indexes, and database objects.
  • Administer databases, including user access, security, backup and recovery, monitoring, patching, and performance tuning.
  • Build Databricks workflows using Spark SQL, Delta Lake, and medallion data layers.
  • Prepare structured and unstructured data for analytics, machine learning, and Generative AI applications.
  • Support AI use cases involving embeddings, vectorization, semantic search, vector databases, and Retrieval-Augmented Generation (RAG).
  • Implement data-quality checks, metadata management, security controls, and data-governance standards.
  • Troubleshoot production database and data-pipeline issues and perform root-cause analysis.
  • Collaborate with data architects, application teams, analysts, data scientists, and AI engineers.
  • Mentor junior team members and contribute to data engineering and database best practices.

Skills

Oracle DB
SQL
PL/SQL
MongoDB
Databricks
Spark / PySpark
Delta Lake
ETL/ELT pipelines
Python
Data governance
Vector search / AI
Embeddings
Troubleshooting

Education

Bachelor's degree

Tools

Databricks
MongoDB
Oracle
SQL Server / Oracle SQL
Airflow
Azure/AWS/GCP

Job description

Job Title- Data engineer Senior associate

Years of experience -4-9yrs

Location - Bangalore/Hyderabad/Kolkata

Shoft timings-2-11PM

Skills requirement - Database-Sql, Mango DB, AI , Gen AI , AI engineer

Role Overview

We are looking for a Senior Associate Data Engineering & AI to design, develop, and manage scalable data platforms supporting analytics, reporting, and AI-driven applications. The ideal candidate will have strong experience with Oracle, SQL databases, MongoDB, Databricks, and database administration, along with an understanding of vectorization, embeddings, vector search, and Generative AI data patterns.

This role combines hands-on data engineering, database management, performance optimization, and the preparation of enterprise data for AI and machine-learning use cases.

Key Responsibilities
  • Design and develop reliable ETL/ELT pipelines using SQL, Python, PySpark, and Databricks.
  • Build and maintain data models across Oracle, relational databases, MongoDB, and lakehouse platforms.
  • Develop and optimize complex SQL queries, stored procedures, views, indexes, and database objects.
  • Administer databases, including user access, security, backup and recovery, monitoring, patching, and performance tuning.
  • Build Databricks workflows using Spark SQL, Delta Lake, and medallion data layers.
  • Prepare structured and unstructured data for analytics, machine learning, and Generative AI applications.
  • Support AI use cases involving embeddings, vectorization, semantic search, vector databases, and Retrieval-Augmented Generation (RAG).
  • Implement data-quality checks, metadata management, security controls, and data-governance standards.
  • Troubleshoot production database and data-pipeline issues and perform root-cause analysis.
  • Collaborate with data architects, application teams, analysts, data scientists, and AI engineers.
  • Mentor junior team members and contribute to data engineering and database best practices.
Required Skills
  • Strong hands-on experience with Oracle Database, SQL, and PL/SQL.
  • Experience with relational database design, query optimization, indexing, partitioning, and performance tuning.
  • Working knowledge of MongoDB, including document modeling, aggregation, indexing, and administration.
  • Experience with Databricks, Apache Spark, Spark SQL, PySpark, and Delta Lake concepts.
  • Experience building batch or near-real-time data pipelines.
  • Knowledge of database administration, including backup, recovery, security, monitoring, migration, and high availability.
  • Understanding of AI-ready data pipelines, embeddings, vector search, similarity matching, and vector databases.
  • Proficiency in Python or another data-engineering scripting language.
  • Strong analytical, troubleshooting, communication, and documentation skills.
Preferred Skills
  • Exposure to Generative AI, large language models, RAG, prompt-based applications, or AI/ML platforms.
  • Experience with Databricks Vector Search, MongoDB Atlas Vector Search
  • Familiarity with Azure, AWS, or Google Cloud.
  • Experience with orchestration and streaming tools such as Airflow, Azure Data Factory, Kafka, or Databricks Workflows.
  • Knowledge of Git, CI/CD, automated testing, and DevOps practices.
Get your free, confidential resume review.
or drag and drop your file here.
Similar jobs

Similar jobs worth comparing

Data Engineer
Data Engineer

NexionPro Services • Bengaluru

Hybrid
INR 800,000 - 1,500,000
Data Engineer
Data Engineer

AuxoAI Inc. • Bengaluru

On-site
INR 800,000 - 1,500,000
Data Engineer
Data Engineer

NITYO • Mumbai

On-site
INR 1,500,000 - 2,100,000
Data Engineer
Data Engineer

Fossgen Technologies • Pune District, Gurugram District, Bengaluru

On-site
INR 1,500,000 - 3,200,000
Data Engineer
Data Engineer

Crayon Data • Chennai District

On-site
INR 800,000 - 1,200,000
Data Engineer
Data Engineer

Deservely Technologies Pvt Ltd • Hyderabad

On-site
INR 1,500,000 - 2,300,000
Data Engineer
Data Engineer

Agilisium • Chennai District

On-site
INR 800,000 - 1,200,000
Opening For Data and AI Engineer
Opening For Data and AI Engineer

Tekskills • Bengaluru

On-site
INR 2,500,000 - 4,000,000
Data Engineer
Data Engineer

Opella • Hyderabad

On-site
INR 1,500,000 - 2,200,000
Opening For Data and AI Engineer
Opening For Data and AI Engineer

Tekskills • Pune District

On-site
INR 1,200,000 - 2,000,000