Senior DevOps Engineer — AI/ML & Kubernetes (Equity)

NVIDIA Gruppe

Santa Clara (CA)

On-site

USD 176,000 - 276,000

Full time

14 days+

Get more replies from employers

Send a job-specific resume in minutes.

Benefits offered by this job

Equity

Job summary

NVIDIA in Santa Clara, CA seeks a Senior DevOps Platform Engineer for the Metropolis Team to scale CI/CD pipelines and manage Kubernetes-based infrastructure for AI/ML workloads on NVIDIA Data Center GPUs.

You will define release processes, drive developer efficiency with tooling, and own observability using Prometheus, Grafana, and log pipelines. Strong Linux, Python, and Kubernetes skills are required.

Qualifications

  • BS/MS in CS/CE or equivalent experience.
  • Strong Python scripting and automation skills.
  • Kubernetes, Helm, and production orchestration expertise.
  • Experience building scalable CI/CD pipelines at scale.
  • Solid Linux systems administration and networking knowledge.
  • Familiarity with release engineering practices and observability stacks.

Responsibilities

  • Compose, build, and maintain scalable CI/CD pipelines.
  • Develop and manage Kubernetes-based platform infrastructure for AI/ML workloads.
  • Implement scaling and performance measurement frameworks in Kubernetes.
  • Define release engineering processes, branching, versioning, and gating.
  • Drive developer efficiency with tooling and automation frameworks.
  • Own observability and monitoring with Prometheus, Grafana, and logs.

Skills

Python scripting
CI/CD design
Release engineering
Observability

Education

BS or MS in Computer Science/Engineering or equivalent

Tools

Kubernetes
Helm
Jenkins
GitHub Actions
GitLab Actions
Linux
ELK
Prometheus
Grafana

Job description

NVIDIA in Santa Clara, CA seeks a Senior DevOps Platform Engineer for the Metropolis Team to scale CI/CD pipelines and manage Kubernetes-based infrastructure for AI/ML workloads on NVIDIA Data Center GPUs.

You will define release processes, drive developer efficiency with tooling, and own observability using Prometheus, Grafana, and log pipelines. Strong Linux, Python, and Kubernetes skills are required.

Get your free, confidential resume review.
or drag and drop your file here.
Similar jobs

Similar jobs worth comparing

Senior DevOps Platform Engineer - AI/ML at Scale (Equity)
Senior DevOps Platform Engineer - AI/ML at Scale (Equity)

NVIDIA • Santa Clara (CA)

On-site
USD 176,000 - 276,000
Equity
Benefits
Senior DevOps Platform Engineer — AI/ML Infra & CI/CD
Senior DevOps Platform Engineer — AI/ML Infra & CI/CD

NVIDIA AI • Santa Clara (CA)

On-site
USD 176,000 - 276,000
Equity
Benefits
Senior DevOps Engineer, AI/ML Platform & CI/CD
Senior DevOps Engineer, AI/ML Platform & CI/CD

NVIDIA • Santa Clara (CA)

On-site
USD 176,000 - 276,000
Equity
Comprehensive benefits
Senior DevOps Engineer, Platform Engineering
Senior DevOps Engineer, Platform Engineering

NVIDIA Gruppe • Santa Clara (CA)

On-site
USD 176,000 - 276,000
Equity
Senior DevOps Engineer, Platform Engineering
Senior DevOps Engineer, Platform Engineering

Socket.dev • Santa Clara (CA)

On-site
USD 176,000 - 276,000
Equity
Comprehensive benefits
Senior DevOps Engineer, Platform Engineering
Senior DevOps Engineer, Platform Engineering

NVIDIA • Santa Clara (CA)

On-site
USD 176,000 - 276,000
Equity
Benefits
Senior DevOps Engineer, Platform Engineering
Senior DevOps Engineer, Platform Engineering

NVIDIA AI • Santa Clara (CA)

On-site
USD 176,000 - 276,000
Equity
Benefits
Senior Platform Engineer - AI/ML Infra & Global CDN
Senior Platform Engineer - AI/ML Infra & Global CDN

Nvidia Corporation • Santa Clara (CA)

On-site
USD 200,000 - 322,000
Equity
Comprehensive benefits
Senior DevOps Engineer, Platform Engineering
Senior DevOps Engineer, Platform Engineering

NVIDIA Corporation • Santa Clara (CA), Northern (KY)

Hybrid
USD 176,000 - 276,000
Kubernetes Platform Engineering Manager (AI & Self-Service)
Kubernetes Platform Engineering Manager (AI & Self-Service)

Nvidia Corporation • Santa Clara (CA)

On-site
USD 224,000 - 357,000