Data Engineer

Exasoft Pte. Ltd.

Singapore

On-site

SGD 120,000 - 170,000

Full time

14 days+
Application generator

An application made for this job — a tailored resume and cover letter that speak straight to the posting.

Get past ATS filters

Job summary

Exasoft Pte. Ltd. is seeking a senior Data Engineer to design scalable data storage and pipelines on AWS and Databricks. You will implement data governance with Informatica IDMC and build robust ETL processes for analytics.

Ideal candidates have 5+ years in data engineering, strong Python, SQL/NoSQL skills, and experience with Docker/Kubernetes. You will collaborate with data scientists and engineers to optimize performance and ensure data quality while controlling costs.

Qualifications

  • Bachelor's or Master's degree in computer science, data engineering, or a related field.
  • Minimum 5+ years of experience in data engineering with expertise in AWS, Databricks, and/or Informatica IDMC.
  • Proficiency in Python for building data pipelines.
  • Strong SQL and NoSQL database knowledge.
  • Experience with data governance and data cataloguing tools, especially Informatica IDMC.
  • Familiarity with data visualization tools like Tableau or Power BI.
  • Familiarity with Docker and Kubernetes.

Responsibilities

  • Design data storage solutions using AWS services such as S3, RDS and Databricks Delta Lake.
  • Create, manage and optimize data pipelines for ingestion, processing, and transformation.
  • Integrate data from multiple sources into AWS and Databricks, ensuring quality and governance.
  • Develop ETL processes to cleanse, transform, and enrich data for analytics.
  • Monitor and optimize data processing and query performance in AWS and Databricks.
  • Implement security best practices and data encryption; ensure privacy compliance.
  • Automate routine tasks with AWS Step Functions, AWS Lambda, Databricks Jobs and Informatica IDMC.
  • Maintain documentation with metadata management via Informatica IDMC.
  • Collaborate with data scientists, analysts, and engineers.
  • Identify and resolve data-related issues and ensure data availability.
  • Optimize resource usage to control costs.
  • Stay up-to-date with AWS, Databricks and Informatica IDMC services and best practices.

Skills

Python
SQL
NoSQL databases
Data modelling
Problem solving
Communication
Collaboration

Education

Bachelor's or Master's degree in Computer Science or Data Engineering

Tools

Docker
Kubernetes
Tableau/Power BI
AWS
Databricks
Informatica IDMC

Job description

Responsibilities
  • Design data storage solutions, including databases, data lakes, and warehouses, using AWS services such as Amazon S3, Amazon RDS along with Databricks Delta Lake. Integrate Informatica IDMC for metadata management and data cataloging.
  • Create, manage, and optimize data pipelines for ingesting, processing, and transforming data using AWS services like AWS Glue, AWS Data Pipeline, and AWS Lambda, Databricks for advanced data processing, and Informatica IDMC for data integration and quality.
  • Integrate data from various sources, both internal and external, into AWS and Databricks environments, ensuring data consistency and quality, while leveraging Informatica IDMC for data integration, transformation, and governance.
  • Develop ETL (Extract, Transform, Load) processes to cleanse, transform, and enrich data, making it suitable for analytical purposes using Databricks Spark capabilities and Informatica IDMC for data transformation and quality.
  • Monitor and optimize data processing and query performance in both AWS and Databricks environments, making necessary adjustments to meet performance and scalability requirements. Utilize Informatica IDMC for optimizing data workflows.
  • Implement security best practices and data encryption methods to protect sensitive data in both AWS and Databricks, while ensuring compliance with data privacy regulations. Employ Informatica IDMC for data governance and compliance.
  • Implement automation for routine tasks, such as data ingestion, transformation, and monitoring, using AWS services like AWS Step Functions, AWS Lambda, Databricks Jobs, and Informatica IDMC for workflow automation.
  • Maintain clear and comprehensive documentation of data infrastructure, pipelines, and configurations in both AWS and Databricks environments, with metadata management facilitated by Informatica IDMC.
  • Collaborate with cross-functional teams, including data scientists, analysts, and software engineers, to understand data requirements and deliver appropriate solutions across AWS, Databricks, and Informatica IDMC.
  • Identify and resolve data-related issues and provide support to ensure data availability and integrity in both AWS, Databricks, and Informatica IDMC environments.
  • Optimize AWS, Databricks, and Informatica resource usage to control costs while meeting performance and scalability requirements.
  • Stay up-to-date with AWS, Databricks, Informatica IDMC services, and data engineering best practices to recommend and implement new technologies and techniques.
Requirements
  • Bachelor's or Master's degree in computer science, data engineering, or a related field.
  • Minimum 5+ years of experience in data engineering, with expertise in AWS services, Databricks, and/or Informatica IDMC.
  • Proficiency in programming languages such as Python for building data pipelines.
  • Evaluate potential technical solutions and make recommendations to resolve data issues especially on performance assessment for complex data transformations and long running data processes.
  • Strong knowledge of SQL and NoSQL databases.
  • Proficiency in data modelling and schema design.
  • Excellent problem-solving and analytical skills.
  • Strong communication and collaboration skills.
  • AWS certifications (e.g., AWS Certified Data Analytics - Specialty, AWS Certified Data Analytics - Specialty), Databricks certifications, and Informatica certifications are a plus.
  • Knowledge of data governance and data cataloguing tools, especially Informatica IDMC.
  • Familiarity with data visualization tools like Tableau or Power BI.
  • Knowledge of containerization and orchestration tools like Docker and Kubernetes.
Get your free, confidential resume review.
or drag and drop your file here.
Similar jobs

Similar jobs worth comparing

Data Engineer - Informatica
Data Engineer - Informatica

Synapxe • Singapore

On-site
SGD 140,000 - 240,000
Data Engineer - Informatica
Data Engineer - Informatica

SYNAPXE PTE. LTD. • Singapore

On-site
SGD 110,000 - 190,000
Cloud Engineer
Cloud Engineer

JALANDHAR SC PTE. LTD. • Singapore

On-site
SGD 140,000 - 210,000
Senior Data Engineer
Senior Data Engineer

CADENZA SOLUTIONS PTE. LTD. • Singapore

On-site
SGD 120,000 - 180,000
Data Engineer (Databricks)
Data Engineer (Databricks)

Percept Solutions Pte Ltd • Singapore

On-site
SGD 90,000 - 120,000
Data Engineer (PySpark, Apache Spark, Delta Lake, ETL, Oracle, DB2, AWS, TWS, Lambda, IAM)
Data Engineer (PySpark, Apache Spark, Delta Lake, ETL, Oracle, DB2, AWS, TWS, Lambda, IAM)

EXASOFT CONSULTING PTE. LTD. • Singapore

On-site
SGD 90,000 - 170,000
Senior Data Engineer
Senior Data Engineer

Cadenza Solutions • Singapore

On-site
SGD 140,000 - 210,000
Data Architect -Data brick and AWS
Data Architect -Data brick and AWS

PATH INFOTECH PTE. LTD. • Singapore

On-site
SGD 90,000 - 150,000
Data Engineer (PySpark, Apache Spark, Delta Lake, ETL, Oracle, DB2, AWS, TWS, Lambda, IAM)
Data Engineer (PySpark, Apache Spark, Delta Lake, ETL, Oracle, DB2, AWS, TWS, Lambda, IAM)

NOVACLOUD SYSTEMS PTE. LTD. • Singapore

On-site
SGD 110,000 - 170,000
Principal Data Integration Architect (Informatica IDMC/Databricks)
Principal Data Integration Architect (Informatica IDMC/Databricks)

ADVANCE SOFTWARE ENGINEERING PTE. LTD. • Singapore

On-site
SGD 260,000 - 420,000