Senior Director, Hardware Reliability & AI-Driven Strategy

NVIDIA Corporation

Santa Clara (CA)

On-site

USD 332,000 - 500,000

Full time

14 days+
Application generator

A complete application in a minute — tailored resume and cover letter, ready to send.

Get past ATS filters

Job summary

NVIDIA Corporation seeks a Sr. Director of Board and System Level Reliability to set engineering standards for reliability across boards and systems.

You will lead global teams, influence design and supply chain decisions, and advance AI-driven reliability frameworks. This senior role requires deep expertise in physics of failure, reliability testing, and statistical modeling, with emphasis on scalability across data centers and automotive platforms.

Qualifications

  • Bachelor's degree in Engineering, Physics, Materials Science, or related field; Graduate degree preferred.
  • 18+ years in board and system-level reliability testing and activities.
  • 5+ years in Data Center equipment reliability and 10+ years leading reliability management.
  • Deep understanding of reliability concepts, physics of failure, testing methodologies, and industry standards.

Responsibilities

  • Own board and system level hardware reliability across product lines (Data Center, Server, Graphics, Automotive, Embedded).
  • Lead reliability labs and multiple multidisciplinary teams across sites.
  • Develop and implement company-wide HW reliability strategies.
  • Drive DfR, DfX, reliability modeling, and risk assessments.

Skills

Board reliability
System-level testing
DfR (Design for Reliability)
FMEA
Reliability modeling
Statistics
Data-driven decision making

Education

Bachelor's degree in Engineering or related field
Graduate degree preferred

Tools

Finite element analysis
Semiconductor/device testing

Job description

NVIDIA Corporation seeks a Sr. Director of Board and System Level Reliability to set engineering standards for reliability across boards and systems.

You will lead global teams, influence design and supply chain decisions, and advance AI-driven reliability frameworks. This senior role requires deep expertise in physics of failure, reliability testing, and statistical modeling, with emphasis on scalability across data centers and automotive platforms.

Get your free, confidential resume review.

or drag and drop your file here.

Similar jobs

Similar jobs worth comparing

Senior Hardware Reliability Engineer, Data Center & AI
Senior Hardware Reliability Engineer, Data Center & AI

NVIDIA Corporation • Santa Clara (CA)

On-site
USD 168,000 - 265,000
Head of Product Reliability - Hardware & AI
Head of Product Reliability - Hardware & AI

NVIDIA Corporation • Santa Clara (CA)

On-site
USD 256,000 - 385,000
Senior Director, Reliability Engineering
Senior Director, Reliability Engineering

NVIDIA Corporation • Santa Clara (CA)

On-site
USD 332,000 - 500,000
Head of Failure Analysis & Reliability Innovation
Head of Failure Analysis & Reliability Innovation

NVIDIA Corporation • Santa Clara (CA)

On-site
USD 232,000 - 368,000
Principal Software Engineer - Fleet Reliability & Equity
Principal Software Engineer - Fleet Reliability & Equity

NVIDIA Corporation • Santa Clara (CA), Northern (KY)

Hybrid
USD 272,000 - 431,000
Senior Manager, Product Reliability
Senior Manager, Product Reliability

NVIDIA Corporation • Santa Clara (CA)

On-site
USD 256,000 - 385,000
Director, System-Level Validation & Manufacturing Ramp
Director, System-Level Validation & Manufacturing Ramp

NVIDIA • Santa Clara (CA)

On-site
USD 272,000 - 426,000
Failure Analysis Leader – Hardware Reliability
Failure Analysis Leader – Hardware Reliability

NVIDIA • Santa Clara (CA)

On-site
USD 232,000 - 368,000
Equity
Benefits
Lead Systems Quality & Reliability Engineer
Lead Systems Quality & Reliability Engineer

NVIDIA Corporation • Santa Clara (CA)

On-site
USD 168,000 - 311,000
Equity
Benefits
Lead AI Platform Reliability Architect
Lead AI Platform Reliability Architect

NVIDIA • Santa Clara (CA)

Hybrid
USD 248,000 - 397,000