Spark Engineer: Real-Time ETL & Cloud Data Pipelines

Veriipro

Jacksonville (FL)

On-site

USD 90,000 - 130,000

Full time

14 days+
Application generator

Turn this role into an interview — a resume and cover letter built around what this employer wants.

Get past ATS filters

Job summary

Veriipro is seeking a data engineer skilled in Apache Spark to design and maintain scalable data processing solutions. The ideal candidate will possess strong experience with ETL pipelines, cloud platforms like AWS and Azure, and SQL-based data analysis.

The role requires collaboration with data teams to ensure high-quality data solutions and optimization for performance. Candidates should have a thorough understanding of distributed architectures and Spark internals.

Qualifications

  • Strong hands-on experience in Apache Spark and distributed data processing.
  • Deep understanding of Spark internals, architecture, and execution lifecycle.
  • Expertise in SQL-based data transformation and analysis.
  • Experience with ETL frameworks, data modeling, and cloud-based data platforms.
  • Good understanding of distributed systems and scalable data architectures.

Responsibilities

  • Design, develop, and maintain scalable batch and real-time data processing solutions using Apache Spark.
  • Build and optimize ETL pipelines to support analytics and downstream applications.
  • Develop high-performance data transformations using Spark SQL, DataFrames, Datasets, and RDDs.
  • Perform Spark performance tuning, query optimization, and resource management for scalability and efficiency.
  • Work with cloud-based storage and processing platforms in AWS/Azure environments.
  • Collaborate with data engineers, architects, and analytics teams to deliver end-to-end data solutions.
  • Ensure data quality, reliability, and adherence to engineering best practices.
  • Support deployment, monitoring, and troubleshooting of Spark applications in distributed environments.

Skills

Apache Spark
ETL pipelines
Cloud platforms (AWS/Azure)
SQL
Data modeling
Linux/Unix

Tools

Snowflake
Amazon S3
Azure Data Lake Storage

Job description

Veriipro is seeking a data engineer skilled in Apache Spark to design and maintain scalable data processing solutions. The ideal candidate will possess strong experience with ETL pipelines, cloud platforms like AWS and Azure, and SQL-based data analysis.

The role requires collaboration with data teams to ensure high-quality data solutions and optimization for performance. Candidates should have a thorough understanding of distributed architectures and Spark internals.

Get your free, confidential resume review.
or drag and drop your file here.
Similar jobs

Similar jobs worth comparing

Senior Data Engineer — Scalable Pipelines & Data Quality
Senior Data Engineer — Scalable Pipelines & Data Quality

Veriipro • Chicago (IL)

On-site
USD 130,000 - 170,000
Senior Data Engineer: Scale Data Pipelines & Quality
Senior Data Engineer: Scale Data Pipelines & Quality

Veriipro • Center Square (PA)

On-site
USD 120,000 - 160,000
Senior Real-Time Kafka & Spark Data Engineer
Senior Real-Time Kafka & Spark Data Engineer

Veriipro • Pennington (NJ)

On-site
USD 150,000 - 190,000
Azure Data Engineering Lead | Spark, Synapse & Data Lake
Azure Data Engineering Lead | Spark, Synapse & Data Lake

Veriipro • Atlanta (GA)

On-site
USD 120,000 - 180,000
Senior Data Engineer - ETL, PySpark & Cloud (Remote)
Senior Data Engineer - ETL, PySpark & Cloud (Remote)

VeeRteq Solutions Inc. • Chicago (IL)

Hybrid
USD 120,000 - 180,000
Senior Big Data Engineer: Hadoop & Spark to Snowflake
Senior Big Data Engineer: Hadoop & Spark to Snowflake

Veriipro • New York (NY)

On-site
USD 140,000 - 190,000
Azure Data Engineer: Spark, Databricks & Cloud Pipelines
Azure Data Engineer: Spark, Databricks & Cloud Pipelines

Compunnel, Inc. • San Jose (CA)

On-site
USD 120,000 - 180,000
Spark Data Engineer (PySpark) - Cloud ETL & Pipelines
Spark Data Engineer (PySpark) - Cloud ETL & Pipelines

Tata Consultancy Services • Irving (TX)

On-site
USD 90,000 - 120,000
Discretionary Annual Incentive
Medical Coverage (Health, Dental & Vis
401K Plan
+1
Databricks Data Engineer - Spark, ETL & Cloud Pipelines
Databricks Data Engineer - Spark, ETL & Cloud Pipelines

Smart IT Frame LLC • Reston (VA)

On-site
USD 90,000 - 120,000
Senior Data Engineer: Spark & Cloud Pipelines
Senior Data Engineer: Spark & Cloud Pipelines

Tata Consultancy Services • Irving (TX)

On-site
USD 90,000 - 110,000
Discretionary Annual Incentive.
Comprehensive Medical Coverage
401K Plan
+1