Nos entusiasma la innovación, los desafíos constantes y trabajar con los mejores talentos del mercado.
¡Si te sentís identificada/o nos encantaría conocerte!
Como Site Reliability Engineer, serás el puente entre los equipos de Desarrollo e Infraestructura. Tu objetivo principal será diseñar e implementar pipelines de CI/CD eficientes, automatizar la infraestructura y establecer prácticas de SRE para garantizar que las aplicaciones e infraestructuras críticas operen con alta disponibilidad, tolerancia a fallos y eficiencia de costos. Trabajarás en sinergia con nuestros Service Delivery Managers (SDMs) para asegurar entregas predecibles y sin fricciones.
¿Qué desafíos te esperan en este rol?
- El ingeniero será responsable de habilitar capacidades en AWS, y de operar, estabilizar y evolucionar plataformas críticas garantizando alta disponibilidad, resiliencia y eficiencia operativa.
- Cloud Operations y SRE: Incluye la resolución de incidentes como nivel 2/3, ejecución de análisis de causa raíz (RCA), capacity planning, y la gestión de SLIs/SLOs/SLAs para mejorar el MTTR.
- Automatización y Observabilidad: Creación de dashboards accionables con CloudWatch, Prometheus y Grafana, e implementación de runbooks automatizados.
- Ecosistema Cloud‑Native e IaC: Mantenimiento de infraestructura con Terraform, uso de Ansible para hardening de servidores y operación de Kubernetes (EKS/ECS).
- Seguridad y FinOps: Aplicación de controles con Sentinel y trabajo en conjunto con FinOps para la optimización del consumo de recursos en AWS.
¿Qué buscamos?
- Experiencia: +4 años de experiencia en roles DevOps / SRE, con fuerte foco en la administración de entornos productivos complejos sobre AWS.
- Infraestructura como Código: Dominio experto de Terraform (excluyente). Conocimiento de Ansible o CloudFormation es un plus.
- Contenedores y Orquestación: Experiencia sólida operando Docker y Kubernetes (EKS) en ambientes de producción a gran escala.
- SRE y Observabilidad: Experiencia configurando tableros y alertas en plataformas de monitoreo avanzadas (Datadog, Prometheus/Grafana o CloudWatch).
- Scripting y Programación: Habilidad para automatizar tareas rutinarias utilizando Python, Bash o Go.
- Certificación AWS Certified CloudOps Engineer - Associate.
- Habilidades Blandas: necesidad de actuar bajo presión ante incidentes críticos, poseer un fuerte sentido de ownership y tener un pensamiento analítico para un debugging estructurado.
Sumarte a la experiencia Nubiral es:
- Tiempo para vos: contás con días Nubiral para disfrutar como vos quieras.
- Día de cumpleaños off
- Licencia por adopción de mascotas.
- Formación continua: certificaciones afines cubiertas.
- Acompañamiento en momentos importantes para tu familia: regalo por nacimiento, cumple de hijos/as off.
Inclusión, innovación y trabajo en equipo son la base de nuestro éxito. Apostamos a la evolución constante, compartimos ideas con generosidad y nos divertimos mientras trabajamos.