Junior Data Engineer — Pipelines, PySpark & SQL

Madison-Davis, LLC

Woodbridge Township (NJ)

On-site

USD 65,000 - 95,000

Full time

6 days ago
Be an early applicant

Get more replies from employers

Send a job-specific resume in minutes.

Job summary

Madison-Davis, LLC seeks an entry-level Data Engineer to build and maintain data-ingestion processes for enterprise datasets in a modern cloud environment. You will write Python, PySpark, and SQL for data processing and transformations, ensuring data quality and schema enforcement.

As part of the role, you will monitor scheduled workflows, investigate pipeline failures, and collaborate with technical and business teams onboarding data onto the platform.

Qualifications

  • Bachelor's degree in CS, Engineering, IS, or related discipline.
  • Foundational SQL skills including joins, aggregations, and filtering.
  • Hands-on Python programming ability.
  • Basic understanding of object-oriented programming.
  • Strong understanding of tables, schemas, relational data, and data transformations.
  • Exposure to Spark, PySpark, or similar distributed-data technologies.
  • Interest in learning Databricks and modern cloud-data platforms.
  • Strong problem-solving and attention to detail.
  • Ability to communicate clearly and collaborate across teams.

Responsibilities

  • Build and maintain data-ingestion processes for enterprise datasets.
  • Write Python, PySpark, and SQL for data-processing and transformation tasks.
  • Assist with cleansing, validation, reconciliation, and schema enforcement.
  • Monitor scheduled workflows and help investigate pipeline failures.
  • Collaborate with technical and business teams onboarding data onto the platform.
  • Document pipeline logic, transformations, technical decisions, and fixes.
  • Participate in code reviews, testing, version control, and deployment processes

Skills

Python programming
SQL
Data transformations
Communication
Team collaboration

Education

Bachelor's degree in CS/Engineering/IS

Tools

PySpark
Spark
Databricks
SQL

Job description

Madison-Davis, LLC seeks an entry-level Data Engineer to build and maintain data-ingestion processes for enterprise datasets in a modern cloud environment. You will write Python, PySpark, and SQL for data processing and transformations, ensuring data quality and schema enforcement.

As part of the role, you will monitor scheduled workflows, investigate pipeline failures, and collaborate with technical and business teams onboarding data onto the platform.

Get your free, confidential resume review.
or drag and drop your file here.
Similar jobs

Similar jobs worth comparing

Data Engineer: Modern Data Platform & Pipelines (Hybrid)
Data Engineer: Modern Data Platform & Pipelines (Hybrid)

SustainableHR PEO & Recruiting • Madison (WI)

Hybrid
USD 90,000 - 110,000
Junior Data Engineer - Build Scalable Data Pipelines
Junior Data Engineer - Build Scalable Data Pipelines

Socket.dev • Fairfax (VA)

On-site
USD 75,000 - 95,000
Junior Data Engineer: Build Scalable Data Pipelines
Junior Data Engineer: Build Scalable Data Pipelines

Enlighten Hacks - Community for Growth • California (MO)

On-site
USD 60,000 - 90,000
Data Engineer: Python Pipelines & PySpark Expert
Data Engineer: Python Pipelines & PySpark Expert

Insight Global • New York (NY)

On-site
USD 120,000 - 160,000
Junior Data Engineer: Azure Spark Pipelines & ETL
Junior Data Engineer: Azure Spark Pipelines & ETL

Fabric • United States

Remote
USD 65,000 - 95,000
Junior Data Engineer: Build Scalable Data Pipelines
Junior Data Engineer: Build Scalable Data Pipelines

Socket.dev • San Antonio (TX)

On-site
USD 65,000 - 95,000
Junior Data Engineer: Build Pipelines & Insights
Junior Data Engineer: Build Pipelines & Insights

Incedo Inc. • Florham Park (NJ)

On-site
USD 70,000 - 90,000
Data Engineer - PySpark & AWS Cloud Pipelines
Data Engineer - PySpark & AWS Cloud Pipelines

SDLC Technologies • Charlotte (NC)

On-site
USD 90,000 - 150,000
Data Engineer - Entry Level: Build Scalable Pipelines
Data Engineer - Entry Level: Build Scalable Pipelines

ActiveProspect, Inc. • San Jose (CA)

On-site
USD 90,000 - 120,000
Remote Junior Big Data Engineer for AI Pipelines
Remote Junior Big Data Engineer for AI Pipelines

Drivenintelligence • United States

Hybrid
USD 70,000 - 100,000