Data Engineer- Python Pyspark GCP

Mployee.me

Hyderabad

In loco

INR 1.800.000 - 2.800.000

Tempo pieno

5 giorni fa
Candidati tra i primi
Generatore di candidature

Ricevi una risposta da questo datore di lavoro — un curriculum e una lettera di presentazione personalizzati, che corrispondono esattamente a ciò che sta cercando.

Supera i filtri ATS

Descrizione del lavoro

Mployee.me is seeking an experienced Data Engineer to design and maintain scalable data pipelines using Python and PySpark. You will implement ETL processes, optimize PySpark workloads, and ensure data quality across the lifecycle.

You will collaborate with cross-functional teams, write clean code, and participate in design reviews. Expertise in Big Data technologies, SQL, and REST APIs is required, with hands-on cloud experience on GCP/AWS/Azure.

Competenze

  • 4 to 8 + Years of experience using Python and Pyspark.
  • Strong proficiency in Python programming.
  • Hands-on experience with PySpark and Apache Spark.
  • Knowledge of Big Data technologies (Hadoop, Hive, Kafka, etc.).
  • Experience with SQL and relational/non-relational databases.
  • Familiarity with distributed computing and parallel processing.
  • Understanding of data engineering best practices.
  • Experience with REST APIs, JSON/XML, and data serialization.

Mansioni

  • Develop and maintain scalable data pipelines using Python and PySpark.
  • Design and implement ETL (Extract, Transform, Load) processes.
  • Optimize and troubleshoot existing PySpark applications for performance.
  • Collaborate with cross-functional teams to understand data requirements.
  • Write clean, efficient, and well-documented code.
  • Conduct code reviews and participate in design discussions.
  • Ensure data integrity and quality across the data lifecycle.
  • Integrate with cloud platforms like GCP, AWS or Azure.

Conoscenze

Python
PySpark
Apache Spark
SQL
Big Data
Distributed computing
REST APIs
JSON/XML

Strumenti

GCP
AWS
Azure
Hadoop
Hive
Kafka
SQL databases
NoSQL databases
Spark SQL
Cloud computing

Descrizione del lavoro

Role & responsibilities
  • Develop and maintain scalable data pipelines using Python and PySpark.
  • Design and implement ETL (Extract, Transform, Load) processes.
  • Optimize and troubleshoot existing PySpark applications for performance.
  • Collaborate with cross-functional teams to understand data requirements.
  • Write clean, efficient, and well-documented code.
  • Conduct code reviews and participate in design discussions.
  • Ensure data integrity and quality across the data lifecycle.
  • Integrate with cloud platforms like GCP, AWS or Azure.

Implement data storage solutions and manage large-scale datasets.


Preferred candidate profile
  • 4 to 8 + Years of experience using Python and Pyspark.
  • Strong proficiency in Python programming.
  • Hands-on experience with PySpark and Apache Spark.
  • Knowledge of Big Data technologies (Hadoop, Hive, Kafka, etc.).
  • Experience with SQL and elational/non-relational databases.
  • Familiarity with distributed computing and parallel processing.
  • Understanding of data engineering best practices.
  • Experience with REST APIs, JSON/XML, and data serialization.

Exposure to GCP services and cloud computing environments


Ottieni la revisione del curriculum gratis e riservata.

o trascina qui il file.

Similar jobs

Offerte di lavoro simili che vale la pena confrontare

Data Engineer- Python Pyspark GCP
Data Engineer- Python Pyspark GCP

Tata Consultancy Services • Hyderabad

In loco
INR 1.200.000 - 1.800.000
Python,Pyspark,GCP
Python,Pyspark,GCP

Tata Consultancy Services • Hyderabad

In loco
INR 2.500.000 - 3.600.000
Python_PySpark Developer on GCP
Python_PySpark Developer on GCP

TymblHub • Hyderabad

In loco
INR 1.200.000 - 1.800.000
Data Engineer-Pyspark
Data Engineer-Pyspark

Deloitte US-India Offices • Chennai District

In loco
INR 900.000 - 1.300.000
Data Engineer
Data Engineer

Quess IT Solutions • Pune District

Ibrido
INR 900.000 - 1.200.000
Data Engineer
Data Engineer

Lloyds Technology Centre • Hyderabad

In loco
INR 4.000.000 - 6.000.000
Data Engineer (Spark & Python)
Data Engineer (Spark & Python)

Infosys • Hyderabad, Pune District, Bengaluru

In loco
INR 1.200.000 - 1.800.000
Digital : Python(GCP, Pyspark)
Digital : Python(GCP, Pyspark)

Tata Consultancy Services • Hyderabad

In loco
INR 1.100.000 - 1.700.000
Data Engineer
Data Engineer

Authorasist Hyderabad • Hyderabad, Bengaluru

Ibrido
INR 1.500.000 - 2.500.000
Data Engineer
Data Engineer

AppSierra • Dadri

In loco
INR 1.200.000 - 2.400.000