En Dresden Partners conectamos el talento con empresas globales de primer nivel. Somos un puente de oportunidad laboral especialistas en identificar, y vincular profesionales con empresas internacionalesen México, LATAM y USA.
Sr SRE Engineer
Experiencia: +6 años de experiencia en SRE, DevOps, Cloud Infrastructure o Platform Engineering.
- AWS avanzado y experiencia con sistemas productivos a escala.
- Kubernetes / Docker / ECS.
- Terraform avanzado.
- Datadog / Observability: métricas, logs, traces, APM y monitoring.
- SLI/SLO, Error Budgets y Gestión de Incidentes.
- Python + Bash.
- CI/CD: GitHub Actions, Jenkins, GitLab CI, ArgoCD o similares.
- Linux y networking.
- PagerDuty/Opsgenie.
- Disaster Recovery, Chaos Engineering y resiliencia.
- Experiencia práctica con asistentes basados en LLM o agentes de IA aplicados a operaciones.
Responsabilidades
- Liderar incidentes críticos, troubleshooting, RCA y postmortems.
- Diseñar y administrar observabilidad, monitoreo, SLI/SLO y error budgets, principalmente con Datadog.
- Diseñar arquitecturas confiables en AWS: ECS/Fargate, EKS, Lambda, RDS/Aurora, ALB, SQS/SNS y Step Functions.
- Trabajar en capacity planning, performance, FinOps, disaster recovery y chaos engineering.
- Implementar controles de confiabilidad en CI/CD, incluyendo canary, blue/green deployments y automated rollback.
- Desarrollar automatizaciones y herramientas con Python y Bash.
- Crear y mantener módulos de Terraform.
- Utilizar AI SRE/AIOps para incident triage, anomaly detection, alert-noise reduction y predictive analytics.
- Diseñar guardrails para AI Agents y evaluar riesgos de sus acciones en producción.
- Mentorear a ingenieros junior y liderar iniciativas de confiabilidad. Idioma: inglés avanzado conversacional (interactúa de manera efectiva con equipos internacionales)
Zona de trabajo: Guadalajara