Senior Data Engineer - Scalable Pipelines & ML-Ready Data
Compunnel, Inc.
Jersey City (NJ)
On-site
USD 100,000 - 130,000
Full time
14 days+
Get more replies from employers
Send a job-specific resume in minutes.
Start fresh or import an existing resume
Job summary
A technology company in Jersey City is seeking an experienced Data Engineer to build and maintain scalable data infrastructure that supports analytics and machine learning initiatives. The ideal candidate will focus on ensuring data is reliable, accessible, and optimized for performance across various processing systems. Required experience includes 7–10 years in data engineering, along with strong SQL and programming skills in Python, Scala, or Java. The role offers opportunities to manage data platforms like Snowflake and optimize pipelines.
Qualifications
7–10 years of experience in data engineering or a related field.
Responsibilities
Build and maintain ETL/ELT pipelines for batch and streaming data processing.
Manage and optimize data platforms including data warehouses and data lakes.
Work with distributed processing systems such as Spark and Kafka.
Implement data quality checks, validation processes, monitoring, and lineage tracking.
Optimize data pipelines for scalability, performance, and efficiency.
Skills
Strong SQL skills
Programming skills in Python
Programming skills in Scala
Programming skills in Java
Experience with big data tools
Knowledge of cloud-based data architectures
Tools
Snowflake
BigQuery
S3
Spark
Kafka
Job description
A technology company in Jersey City is seeking an experienced Data Engineer to build and maintain scalable data infrastructure that supports analytics and machine learning initiatives. The ideal candidate will focus on ensuring data is reliable, accessible, and optimized for performance across various processing systems. Required experience includes 7–10 years in data engineering, along with strong SQL and programming skills in Python, Scala, or Java. The role offers opportunities to manage data platforms like Snowflake and optimize pipelines.