Data Engineer (Data Pipelines & Modeling)

Katalyst CRO

Warrendale (Allegheny County)

On-site

USD 100,000 - 150,000

Full time

4 days ago
Be an early applicant
Application generator

A complete application in a minute — tailored resume and cover letter, ready to send.

Get past ATS filters

Job summary

Katalyst CRO is seeking a data engineer to design and implement robust ingestion pipelines from APIs, databases, files, and streaming sources. The role includes supporting C4C offline migrations and integrating data into centralized platforms.

The candidate will design data models for workforce planning, forecast service operations, and develop optimized schemas for reporting and analytics, ensuring data quality and consistency across models.

Qualifications

  • Strong experience in data engineering and pipeline development.
  • Proficiency in Python and SQL with hands-on Spark experience.
  • Bachelor's or Master's in CS/IT or related field.

Responsibilities

  • Design and implement robust data ingestion pipelines from APIs, databases, files, and streaming sources.
  • Support C4C offline database migration with data accuracy and consistency.
  • Integrate data from enterprise systems into centralized data platforms.
  • Design and implement data models for workforce planning.
  • Forecast service operations.
  • Develop optimized schemas for reporting and analytics.
  • Ensure data quality, integrity, and consistency across models.

Skills

Data engineering
Pipeline development
Python
SQL
Apache Spark
ETL/ELT
Data warehousing
Independent work
Cross-functional teamwork

Education

Bachelor's or Master's in Computer Science / IT

Tools

Jenkins
GitHub Actions
AWS
Azure
GCP

Job description

Responsibilities
  • Design and implement robust data ingestion pipelines from multiple sources (APIs, databases, files, streaming systems).
  • Support C4C offline database migration, ensuring data accuracy and consistency.
  • Integrate data from enterprise systems into centralized data platforms.
  • Design and implement data models for Workforce planning.
  • Service operations forecasting.
  • Develop optimized schemas for reporting and analytics.
  • Ensure data quality, integrity, and consistency across models.
Requirements
  • Strong experience in data engineering and pipeline development.
  • Proficiency in Python / SQL.
  • Hands-on experience with Apache Spark or similar big data tools.
  • Strong understanding of ETL/ELT concepts and data warehousing.
  • Ability to work independently and in cross-functional teams.
  • Bachelor's / Master's in Computer Science, IT, or related field.
Good to Have
  • Exposure to CI/CD tools like Jenkins or GitHub Actions.
  • Knowledge of cloud platforms (AWS / Azure / GCP).
  • Experience in healthcare or regulated environments.
Get your free, confidential resume review.
or drag and drop your file here.
Similar jobs

Similar jobs worth comparing

Data Engineer
Data Engineer

Compunnel, Inc. • San Francisco (CA)

On-site
USD 100,000 - 130,000
Data Engineer
Data Engineer

Veriipro • Chicago (IL)

On-site
USD 130,000 - 170,000
Data Engineer
Data Engineer

VTG Defense • McLean (VA)

On-site
USD 100,000 - 130,000
Data Engineer
Data Engineer

Burtch Works • Cincinnati (OH)

Hybrid
USD 95,000 - 120,000
Data Engineer: Pipelines, Modeling & Analytics
Data Engineer: Pipelines, Modeling & Analytics

Katalyst CRO • Warrendale

On-site
USD 100,000 - 150,000
Senior Data Engineer
Senior Data Engineer

Compunnel, Inc. • Charlotte (NC)

On-site
USD 120,000 - 150,000
Data Engineer: Build Scalable Pipelines for Analytics
Data Engineer: Build Scalable Pipelines for Analytics

TheCorporate • Tulsa (OK)

On-site
USD 110,000 - 150,000
Data Engineer
Data Engineer

Evlo AI • Minneapolis (MN)

On-site
USD 110,000 - 150,000
Data Engineer
Data Engineer

Medical Mutual of Ohio • Cleveland (OH)

Hybrid
USD 85,000 - 120,000
Data Engineer
Data Engineer

The Judge Group • New York (NY)

On-site
USD 150,000 - 190,000