Senior Data Engineer

Incedo Inc.

Torrance (CA)

On-site

USD 120,000 - 160,000

Full time

1 hour ago
Be an early applicant
Application generator

Get a reply from this employer — a resume and cover letter tailored to exactly what they’re hiring for.

Get past ATS filters

Job summary

Incedo Inc. in Torrance, CA is hiring a Data Engineer to design and maintain data integration solutions across AWS services.

You will translate business needs into scalable pipelines using PySpark, Spark, Python, and tools like Glue, EMR, and Airflow, ensuring data quality and timely delivery for BI.

The role emphasizes performance optimization, documentation, compliance, and collaboration with analysts.

Qualifications

  • 5+ years of data engineering, ETL, and data warehousing.
  • 3+ years with AWS tools including S3, EMR, Glue, Athena, Redshift, RDS, Spectrum and Airflow.
  • 2+ years CI/CD practices and pipelines.

Responsibilities

  • Design and implement data integration workflows with AWS Glue/EMR and Airflow.
  • Develop data pipelines using PySpark and Python for large datasets.
  • Ensure data extraction, transformation, and loading into target systems.
  • Maintain data quality, monitoring, validation, and error handling.
  • Collaborate with analysts and stakeholders to meet data requirements.
  • Document data integration processes and compliance.

Skills

Pyspark
Apache Spark
Python
AWS Glue
AWS EMR
Airflow
Redshift
Iceberg
RDS
CI/CD
Amazon Kiro
IDMC
S3
Lambda
Athena

Tools

Informatica Cloud (IDMC)
Lambda
S3
Athena

Job description

Develop and Maintain Data Integration Solutions:
  • Design and implement data integration workflows using AWS Glue/EMR,AWS MWAA(Airflow), Lambda, Redshift
  • Demonstrate proficiency in Pyspark, Apache Spark and Python for data processing large datasets
  • Ensure data is accurately and efficiently extracted, transformed, and loaded into target systems.
Ensure Data Quality and Integrity:
  • Validate and cleanse data to maintain high data quality.
  • Ensure data quality and integrity by implementing monitoring, validation, and error handling mechanisms within data pipeline.
Optimize Data Integration Processes:
  • Enhance the performance, optimization of data workflows to meet SLAs, scalability of data integration processes and cost-efficiency on AWS cloud infrastructure.
  • Identify and resolve performance bottlenecks, fine-tuning queries, and optimizing data processing to enhance Redshift's performance
  • Regularly review and refine integration processes to improve efficiency.
  • Support Business Intelligence and Analytics:
  • Translate business requirements to technical specifications and coded data pipelines
  • Ensure timely availability of integrated data for business intelligence and analytics.
  • Collaborate with data analysts and business stakeholders to meet their data requirements.
Maintain Documentation and Compliance:
  • Document all data integration processes, workflows, and technical & system specifications.
  • Ensure compliance with data governance policies, industry standards, and regulatory requirements.
WHAT WILL THIS PERSON BE WORKING ON
  • 5+ years of experience in data engineering, database design, ETL processes, and data warehousing.
  • 3+ years of experience with AWS tools and technologies (S3, EMR, Glue, Athena, RedShift, RDS, Spectrum and Airflow)
  • 2+ years of experience with CI/CD tools.
  • Strong knowledge of data storage and processing technologies, including databases and data lakes based distributed computing frameworks (e.g., Hadoop, Spark).
  • 3+ in programming languages such as Python, Java, or Scala.
  • Nice to have Informatica Cloud tool experience (IDMC)
  • Nice to have Agentic AI experience with Amazon Kiro
Primary Skills: AWS EMR, GLUE, AIRFLOW, ICEBERG, REDSHIFT, RDS, IDMC, AMAZON KIRO, and CI/CD

Candidate should design and Develop Data Pipelines and support them.

Ensure Data Quality and Integrity:
  • Validate and cleanse data to maintain high data quality.
  • Ensure data quality and integrity by implementing monitoring, validation, and error handling mechanisms within data pipelines
Optimize Data Integration Processes:
  • Enhance the performance and optimization of data workflows to meet SLAs, scalability of data integration processes, and cost-efficiency on AWS cloud infrastructure.
  • Identify and resolve performance bottlenecks, fine-tuning queries, and optimizing data processing to enhance Redshift's performance
  • Regularly review and refine integration processes to improve efficiency.
Support Business Intelligence and Analytics:
  • Translate business requirements to technical specifications and coded data pipelines
  • Ensure timely availability of integrated data for business intelligence and analytics.

Collaborate with data analysts and business stakeholders to meet their data requirements

Get your free, confidential resume review.
or drag and drop your file here.
Similar jobs

Similar jobs worth comparing

Data Engineer
Data Engineer

Compunnel, Inc. • Boston (MA)

On-site
USD 110,000 - 140,000
Data Engineer
Data Engineer

Applied Resource Group • Atlanta (GA)

On-site
USD 110,000 - 130,000
AWS Data Engineer
AWS Data Engineer

Qode Page • United States

On-site
USD 140,000 - 180,000
Data Engineer
Data Engineer

Insight Global • Bellevue (WA)

On-site
USD 120,000 - 170,000
Data Engineer
Data Engineer

The Value Maximizer • South Carolina

On-site
USD 90,000 - 120,000
Data Engineer Technology
Data Engineer Technology

Verathon Inc • Duluth (GA), Northern (KY)

On-site
USD 100,000 - 140,000
Data Engineer - Python, SQL, AWS
Data Engineer - Python, SQL, AWS

Compunnel, Inc. • Durham (NC)

On-site
USD 95,000 - 120,000
Senior Data Engineer
Senior Data Engineer

Compunnel, Inc. • Charlotte (NC)

On-site
USD 120,000 - 150,000
Data Engineer
Data Engineer

TMV Global Inc • Virginia (MN)

On-site
USD 95,000 - 120,000
Data Engineer
Data Engineer

Smart IT Frame LLC • Reston (VA)

On-site
USD 110,000 - 180,000