A leading data analytics firm in India is seeking an Associate to join their Business Consulting and Services team. The role involves designing scalable data pipelines, leading data migration projects, and managing real-time data architectures. The ideal candidate has expertise in SQL, Python, and data migration strategies, along with familiarity with tools like Apache Iceberg and Presto. This position is full-time and offers opportunities to work with innovative data solutions.
Qualifications
Proven expertise in data migration from Oracle, including schema translation and performance optimization.
Strong understanding of data governance, security, and compliance in cloud environments.
Responsibilities
Design and implement scalable batch and real-time data pipelines.
Lead data migration projects from Oracle to cloud-native data lakes.
Architect and manage real-time data ingress and egress.
Build and maintain data abstraction layers for secure data access.
Optimize data storage and schema evolution strategies.
Skills
Data migration
SQL
Python
Spark
Presto
Trino
CI/CD
DevOps practices
Tools
Apache Iceberg
AWS services
Kafka
Kinesis
Flink
Terraform
CloudFormation
Job description
Responsibilities
Design and implement scalable batch and real‑time data pipelines using Apache Iceberg, AWS services, and streaming technologies bi‑directional data sync mechanisms.
Lead data migration projects from Oracle to cloud‑native data lakes and warehouses.
Architect and manage real‑time data ingress and egress using tools like Kafka, Kinesis, or Flink.
Build and maintain data abstraction layers (e.g., APIs, semantic layers) to enable secure and simplified data access.
Optimize data storage, partitioning, and schema evolution strategies in Iceberg.
Leverage Presto/Trino for federated querying and interactive analytics across heterogeneous data sources.
Collaborate with business, data scientists, analysts, and engineers to deliver high quality, reliable data solutions.
Implement robust monitoring, alerting, and data quality frameworks.
Qualifications
Proven expertise in data migration from Oracle, including schema translation and performance optimization.
Proficiency in SQL, Python, and Spark.
Experience with Presto or Trino for distributed querying and federated data access.
Familiarity with building data abstraction mechanisms, API, and stored procedures.
Experience with CI/CD, infrastructure‑as‑code (Terraform, CloudFormation), and DevOps practices.
Strong understanding of data governance, security, and compliance in cloud environments.
Seniority level
Associate
Employment type
Full‑time
Job function
Business Consulting and Services; Data Infrastructure and Analytics