Lead DevOps Engineer

Trekrecruit

Richmond (VA)

On-site

USD 90,000 - 120,000

Full time

14 days+

Get more replies from employers

Send a job-specific resume in minutes.

Job summary

A technology recruitment firm in Richmond, Virginia, is seeking an Observability Engineer to design and implement monitoring solutions across cloud environments. Responsibilities include building observability platforms, analyzing telemetry data, and collaborating with DevOps teams. Candidates should be proficient in tools like Datadog, Prometheus, and Grafana, and hold expertise in programming languages such as Python and Go. This role offers a competitive salary and opportunities for professional growth.

Qualifications

  • Proficiency in monitoring, logging, and tracing tools.
  • Expertise in Python and Go for scripting and automation.
  • Experience with cloud platforms and container orchestration systems.

Responsibilities

  • Build and maintain observability platforms with logs, metrics, and traces.
  • Instrument applications and services to collect telemetry data.
  • Develop dashboards and alerts for system performance analysis.

Skills

Observability Tools
Python
Go
AWS
GCP
Azure
Kubernetes
Terraform
Ansible
Datadog

Tools

Prometheus
Grafana
ELK Stack
Splunk
CloudWatch

Job description

Qualifications
  • Observability Tools: Proficiency in monitoring, logging, and tracing tools, including Prometheus, Grafana, ELK Stack (Elasticsearch, Logstash, Kibana), Splunk, Datadog, New Relic, and cloud-native solutions like AWS CloudWatch.
  • Programming Languages: Expertise in languages such as Python and Go for scripting and automation.
  • Infrastructure & Cloud Platforms: Experience with cloud platforms (AWS, GCP, Azure) and container orchestration systems like Kubernetes.
  • Infrastructure as Code (IaC): Familiarity with Terraform and Ansible for managing infrastructure and configurations.
  • CI/CD & Automation: Experience with CI/CD pipelines and automation tools like Jenkins.
  • System & Software Engineering: A strong background in both system operations and software development.
  • Optimize cloud agent instrumentation, with cloud certifications being a plus.
  • Datadog Fundamental, APM and Distributed Tracing Fundamentals & Datadog Demo Certification (Mandatory)
  • Strong understanding of Observability concepts (Logs, Metrics, Tracing)
  • Expertise in security & vulnerability management in observability
  • Possesses 2 years of experience in cloud-based observability solutions, specializing in monitoring, logging, and tracing across AWS, Azure, and GCP environments.
Responsibilities
  • Design & Implement Solutions: Build and maintain comprehensive observability platforms that provide deep insights into complex systems, incorporating logs, metrics, and traces.
  • System Instrumentation: Instrument applications, infrastructure, and services to collect telemetry data using frameworks like OpenTelemetry.
  • Data Analysis & Visualization: Develop dashboards, reports, and alerts using tools like Prometheus, Grafana, and Splunk to visualize system performance and detect issues.
  • Collaboration: Work with development, SRE, and DevOps teams to integrate observability best practices and align monitoring with business and operational goals.
  • Automation: Develop scripts and use Infrastructure as Code (IaC) tools like Ansible and Terraform to automate monitoring configurations and telemetry collection.
  • Implement and manage full-stack observability using Datadog, ensuring seamless monitoring across infrastructure, applications, and services.
  • Instrument agents for on-premise, cloud, and hybrid environments to enable comprehensive monitoring.
  • Design and deploy key service monitoring, including dashboards, monitor creation, SLA/SLO definitions, and anomaly detection with alert notifications.
  • Configure and integrate Datadog with third-party services such as ServiceNow, SSO enablement, and other ITSM tools.
Get your free, confidential resume review.
or drag and drop your file here.
Similar jobs

Similar jobs worth comparing

Enterprise Observability Architect
Enterprise Observability Architect

TechDigital Group • Portsmouth (NH)

On-site
USD 140,000 - 210,000
Back fill Engineer
Back fill Engineer

JPC TECHNO INC • Phoenix (AZ)

On-site
USD 120,000 - 180,000
Observability Architect
Observability Architect

TechDigital Group • Atlanta (GA)

On-site
USD 120,000 - 150,000
Enterprise Observability Architect- Only W2
Enterprise Observability Architect- Only W2

Saransh Inc • Portsmouth (NH)

On-site
USD 150,000 - 190,000
Observability Engineer
Observability Engineer

Evolutyz Corp • Brea (CA)

On-site
USD 150,000 - 190,000
Engineer IV - Software
Engineer IV - Software

Worky • Town of Florida (NY)

On-site
USD 150,000 - 190,000
Infrastructure Engineer, Observability
Infrastructure Engineer, Observability

Jobtailor • California (MO)

On-site
USD 140,000 - 190,000
Sr. Observability Engineer
Sr. Observability Engineer

FreedomPay • Select (KY)

On-site
USD 150,000 - 210,000
Lead Software Engineer – Enterprise Observability
Lead Software Engineer – Enterprise Observability

Jobtailor • Town of Florida (NY)

On-site
USD 150,000 - 210,000
Site Reliability Engineer
Site Reliability Engineer

Infosys • Richardson (TX)

On-site
USD 80,000 - 120,000