Recibe más respuestas de empleadores
Envía un currículum específico para el puesto de trabajo en cuestión de minutos.
Empresa Confidencial busca un Data Engineer para construir, mantener y optimizar pipelines de datos en el Datalake corporativo en AWS. Integrarás información de sistemas agrícolas, comerciales, de calidad y de soporte para entregar datos confiables y trazables a las áreas de negocio.
Serán clave las ingestas hacia el Datalake, el desarrollo de Glue Jobs en PySpark y las cargas a Redshift para consumo en Tableau y Athena.
Importante empresa del sector alimentario con presencia a nivel mundial se encuentra en búsqueda de: DATA ENGINEER para integrar a su equipo.
Misión: Construir, mantener y optimizar los pipelines de datos del Datalake corporativo en AWS, integrando la información de los sistemas agrícolas, comerciales, de calidad y de soporte, de acuerdo con los estándares de arquitectura, seguridad y gobierno de datos definidos por el área, con el fin de que las áreas de negocio dispongan de información confiable, oportuna y trazable para la toma de decisiones.
Excluyentes: SQL avanzado (window functions, CTEs, optimización de consultas). Python aplicado a datos con PySpark. AWS Glue (Jobs y Data Catalog) y Amazon S3 (arquitectura por capas, formatos columnares, particionado). Amazon Athena. Formatos Parquet, JSON y CSV. Modelamiento de datos (modelo estrella, hechos y dimensiones, cargas incrementales). Bases de datos relacionales y no relacionales. Git. Amazon Redshift, AWS Step Functions, EventBridge, Lambda, DynamoDB, AppFlow, Transfer for SFTP, Lake Formation y Secrets Manager. Extracción desde SAP (OData, SAP BW) y consumo de APIs REST/SOAP. Infraestructura como código (Terraform o CloudFormation) y CI/CD. Herramientas de catálogo y gobierno de datos (OpenMetadata).
Deseables: Tableau. Metodologías ágiles y JIRA.
Certificaciones deseables: AWS Certified Data Engineer – Associate o AWS Certified Solutions Architect – Associate.
Entre 2 y 4 años en cargos similares, con al menos 1,5 años construyendo pipelines de datos en AWS.