Senior Site Reliability Engineer - AI Observability & Infra

Tulip Interfaces

Boston (MA)

Hybrid

USD 160,000 - 200,000

Full time

14 days+

Get more replies from employers

Send a job-specific resume in minutes.

Benefits offered by this job

Company equity
Flexible schedule
Health, dental, vision

Job summary

Tulip Interfaces, a hybrid company located in Somerville, MA, seeks an experienced Observability Engineer to advance AI-native observability across distributed systems. The role emphasizes mentoring teams, defining SLIs/SLOs, and shaping the reliability culture while collaborating with Edge, DevOps, and Hardware teams.

Ideal candidates have 5+ years with OpenTelemetry, Prometheus, and Grafana, plus hands-on experience with Kubernetes, time-series data, and AI processes.

Qualifications

  • 5+ years of experience with open source Observability tools (e.g. Loki, Grafana, Tempo, Mimir stack).
  • Hands-on instrumenting distributed systems using OpenTelemetry and managing metrics pipelines with Prometheus at scale.
  • Direct experience developing and distributing Claude Skills, Gemini Gems, or other AI processes and iterating on efficacy.
  • Experience with time-series data, ideally using PromQL.

Responsibilities

  • Mentor and evangelize observability best practices, SLIs/SLOs, and reliability culture across engineering teams.
  • Contributing to and maintaining Tulip's triage and remediation processes as player/coach.
  • Perform incident response and debug production issues across the stack.
  • Design, build, and maintain core infrastructure and tooling used by Tulip's engineering teams.

Skills

Observability
Distributed systems
Team mentorship
Communication

Tools

Prometheus
OpenTelemetry
Grafana
Loki
Tempo
Kubernetes

Job description

Tulip Interfaces, a hybrid company located in Somerville, MA, seeks an experienced Observability Engineer to advance AI-native observability across distributed systems. The role emphasizes mentoring teams, defining SLIs/SLOs, and shaping the reliability culture while collaborating with Edge, DevOps, and Hardware teams.

Ideal candidates have 5+ years with OpenTelemetry, Prometheus, and Grafana, plus hands-on experience with Kubernetes, time-series data, and AI processes.

Get your free, confidential resume review.
or drag and drop your file here.
Similar jobs

Similar jobs worth comparing

Senior Observability Lead for AI-Driven Infra
Senior Observability Lead for AI-Driven Infra

Tulip Interfaces • Boston (MA)

Hybrid
USD 160,000 - 200,000
Health insurance
Dental coverage
Vision coverage
+12
Senior SRE - Hybrid, AI-Observability & Equity
Senior SRE - Hybrid, AI-Observability & Equity

Tulip • Somerville (MA)

Hybrid
USD 160,000 - 200,000
Health, Dental, Vision
Disability insurance
Life Insurance
+8
Senior Site Reliability Engineer
Senior Site Reliability Engineer

Tulip • Somerville (MA)

Hybrid
USD 160,000 - 200,000
Health, Dental, Vision
Disability insurance
Life Insurance
+8
Observability Lead — Hybrid, Equity & PTO
Observability Lead — Hybrid, Equity & PTO

Tulip • Somerville (MA)

Hybrid
USD 160,000 - 200,000
Company equity
Flexible work schedule
401(K)
Observability Tech Lead
Observability Tech Lead

Tulip • Somerville (MA)

Hybrid
USD 160,000 - 200,000
Company equity
Flexible work schedule
401(K)
Senior Site Reliability Engineer
Senior Site Reliability Engineer

Tulip Interfaces • Boston (MA)

Hybrid
USD 160,000 - 200,000
Company equity
Flexible schedule
Health, dental, vision
Observability Tech Lead
Observability Tech Lead

Tulip Interfaces • Boston (MA)

Hybrid
USD 160,000 - 200,000
Health insurance
Dental coverage
Vision coverage
+12
Senior Observability Platform Engineer - AI-Enhanced Ops
Senior Observability Platform Engineer - AI-Enhanced Ops

IntraEdge • Phoenix (AZ)

On-site
USD 140,000 - 190,000
Senior Full-Stack AI Engineer — Real-Time Observability
Senior Full-Stack AI Engineer — Real-Time Observability

Traversal • New York (NY)

On-site
USD 150,000 - 300,000
Health insurance
Startup equity
In-office snacks
+1
Remote Site Reliability Engineer — AI-Driven Observability
Remote Site Reliability Engineer — AI-Driven Observability

OhioX • Northern (KY)

Hybrid
USD 142,000 - 197,000