Senior Reliability Engineer: Hardware & Manufacturing Testing

Amazon Web Services (AWS)

Cupertino (CA)

On-site

USD 157,000 - 213,000

Full time

16 hours ago
Be an early applicant

Get more replies from employers

Send a job-specific resume in minutes.

Job summary

Annapurna Labs (U.S.) Inc. is seeking a Senior Reliability Engineer for the Trainium Manufacturing, Quality and Reliability team in Cupertino, CA.

You will define reliability tests during manufacturing, lead quality improvements, and partner with design teams to mitigate risks and ensure robust product reliability. The role requires 7+ years in reliability engineering for server hardware and a strong background in reliability modeling and test methodology.

Qualifications

  • 7+ years of reliability engineering work experience with server compute platforms or on high-tech hardware.
  • Bachelor's degree in Electrical or Mechanical Engineering, Engineering Technology, Reliability Engineering, or 2+ years of maintenance or engineering experience.
  • Experience in fast-paced environment similar to a high-tech start-up.
  • Demonstrated ability to uncover systemic issues prior to new product introduction.
  • Working understanding of server subcomponents (CPU, GPU, memory, HDD, SSD, motherboard, thermal system, peripherals).
  • Analytical, test plan and test procedure development experience related to server compute platforms or with high-tech hardware.

Responsibilities

  • Responsible for defining reliability tests to be implemented during manufacturing.
  • Drive manufacturing process improvements to address reliability issues and concerns.
  • Perform Reliability prediction of failure mechanisms, products under development and the field.
  • Working with multiple vendors and ODMs to standardize component manufacturing and reliability expectations.

Education

Bachelor's degree in Electrical or Mechanical Engineering
Master's Degree or PhD in Reliability Engineering or related field

Job description

Annapurna Labs (U.S.) Inc. is seeking a Senior Reliability Engineer for the Trainium Manufacturing, Quality and Reliability team in Cupertino, CA.

You will define reliability tests during manufacturing, lead quality improvements, and partner with design teams to mitigate risks and ensure robust product reliability. The role requires 7+ years in reliability engineering for server hardware and a strong background in reliability modeling and test methodology.

Get your free, confidential resume review.
or drag and drop your file here.
Similar jobs

Similar jobs worth comparing

Senior Reliability Engineer, AI Hardware & Manufacturing
Senior Reliability Engineer, AI Hardware & Manufacturing

Amazon Web Services (AWS) • Cupertino (CA)

On-site
USD 183,000 - 248,000
Senior Reliability Engineer, AI Hardware & Manufacturing
Senior Reliability Engineer, AI Hardware & Manufacturing

Amazon Web Services (AWS) • Austin (TX)

On-site
USD 136,000 - 184,000
Senior Reliability Engineer - AI Server Hardware Manufacturing
Senior Reliability Engineer - AI Server Hardware Manufacturing

Amazon Web Services (AWS) • Seattle (WA)

On-site
USD 159,000 - 215,000
Senior Reliability Engineer, AI Server Hardware
Senior Reliability Engineer, AI Server Hardware

Amazon Web Services (AWS) • Austin (TX)

On-site
USD 140,000 - 170,000
Senior Reliability Engineer - AI Server Hardware
Senior Reliability Engineer - AI Server Hardware

Socket.dev • Austin (TX)

On-site
USD 159,000 - 215,000
Quality & Reliability Engineer, Trainium Manufacturing, Quality & Reliability
Quality & Reliability Engineer, Trainium Manufacturing, Quality & Reliability

Amazon Web Services (AWS) • Austin (TX)

On-site
USD 136,000 - 184,000
Quality & Reliability Engineer, Trainium Manufacturing, Quality & Reliability
Quality & Reliability Engineer, Trainium Manufacturing, Quality & Reliability

Amazon Web Services (AWS) • Cupertino (CA)

On-site
USD 157,000 - 213,000
Reliability Engineer - Hardware Testing & Failure Analysis
Reliability Engineer - Hardware Testing & Failure Analysis

Confidencial • Cupertino (CA)

On-site
USD 90,000 - 120,000
Senior AI Systems Quality & Reliability Leader
Senior AI Systems Quality & Reliability Leader

Amazon Web Services (AWS) • Cupertino (CA)

On-site
USD 240,000 - 324,000
Health insurance
RSUs
System Reliability Engineer - Hardware & Failure Analysis
System Reliability Engineer - Hardware & Failure Analysis

Socket.dev • Cupertino (CA)

On-site
USD 110,000 - 170,000