data engineer for scalable data pipelines

HireHi

United States

Remote

USD 110,000 - 160,000

Full time

9 days ago
Application generator

Turn this role into an interview — a resume and cover letter built around what this employer wants.

Get past ATS filters

Job summary

HireHi ищет инженера по данным для проектирования и реализации масштабируемых пайплайнов на Apache Spark (Databricks приветствуется). Вы будете писать эффективный PySpark код и разворачивать сложные SQL-запросы для извлечения и проверки данных.

Требуется 3+ года опыта в Data Software Engineering, знания pytest и Git. Рассматриваются кандидаты с англ. не ниже B2, готовность работать в команде и понимать процессы CI/CD.

Qualifications

  • 3+ года опыта в разработке Data Software
  • Опыт работы со Spark, предпочтительно в Databricks
  • Умение работать с PySpark и SQL
  • Опыт юнит-тестирования с pytest
  • Знание принципов ETL и инженерии данных
  • Опыт работы с системами контроля версий Git
  • Уровень английского не ниже B2
  • Желателен опыт работы в облачной среде (Azure/AWS/GCP) и знание CI/CD

Responsibilities

  • Проектирование, разработка и сопровождение масштабируемых пайплайнов данных на Spark
  • Написание эффективного PySpark-кода для трансформаций и обработки
  • Разработка и выполнение сложных SQL-запросов для получения данных
  • Руководство тестируемостью кода с pytest
  • Сотрудничество с дата-учеными, аналитиками и инженерами
  • Мониторинг и устранение неполадок в рабочих процессах
  • Документирование технических дизайнов и лучших практик

Skills

Коммуникационные навыки
Командная работа
Проблемное мышление
Адаптивность

Tools

Apache Spark
Databricks
PySpark
SQL
pytest
Git
Delta Lake
MLflow

Job description

Описание:

No description



Задачи:


  • Design, develop, and maintain scalable data pipelines using Apache Spark, with Databricks preferred

  • Write efficient and optimized PySpark code for data transformation and processing

  • Develop and execute complex SQL queries for data extraction, validation, and reporting

  • Implement unit tests using pytest to ensure code reliability and maintainability

  • Collaborate with data scientists, analysts, and other engineers to deliver high-quality data solutions

  • Monitor and troubleshoot data workflows and performance issues

  • Document technical designs, processes, and best practices



Требования:


  • 3+ Years of experience in Data Software Engineering

  • Proven experience with Apache Spark, ideally in a Databricks environment

  • Proficiency in PySpark and SQL

  • Background in unit testing frameworks, especially pytest

  • Understanding of data engineering principles and ETL processes

  • Familiarity with version control systems such as Git

  • Ability to work independently and in a collaborative team setting

  • Excellent problem-solving and communication skills

  • English proficiency at Upper-Intermediate level (B2) or higher

  • Nice to have: experience with cloud platforms such as Azure, AWS, or GCP, knowledge of CI/CD pipelines and DevOps practices, familiarity with Delta Lake, MLflow, or other Databricks-native tools



Условия:

No conditions specified

Get your free, confidential resume review.

or drag and drop your file here.

Similar jobs

Similar jobs worth comparing

data engineer in IT services
data engineer in IT services

HireHi • United States

Remote
USD 110,000 - 160,000
data engineer in modern data platforms
data engineer in modern data platforms

HireHi • United States

Remote
USD 90,000 - 150,000
Long-term contract (12+ months)
B2B engagement
Senior Data Software Engineer/ Databricks, Apache Spark, PySpark
Senior Data Software Engineer/ Databricks, Apache Spark, PySpark

EPAM Systems Inc • United States

Remote
USD 140,000 - 180,000
Spark Data Engineer for Scalable Pipelines (Databricks)
Spark Data Engineer for Scalable Pipelines (Databricks)

HireHi • United States

Remote
USD 110,000 - 160,000
data engineer vehicle telemetry
data engineer vehicle telemetry

HireHi • United States

Remote
USD 120,000 - 180,000
data engineer in regulated financial services
data engineer in regulated financial services

HireHi • United States

Remote
USD 120,000 - 190,000
data engineer for enterprise data platforms
data engineer for enterprise data platforms

HireHi • United States

On-site
USD 47,000 - 68,000
Databricks Data Engineer
Databricks Data Engineer

Henderson Scott • Irving (TX)

On-site
USD 100,000 - 130,000
data engineer data integration
data engineer data integration

HireHi • United States

Remote
USD 120,000 - 160,000
Data Engineer
Data Engineer

HireHi • Spain (TX)

Hybrid
USD 110,000 - 170,000
Private medical insurance
Company-provided laptop
Training and development
+2