Data Center Facility Operations Reliability Engineer

Meta

Phoenix (AZ)

On-site

USD 114,000 - 168,000

Full time

14 days+

Get more replies from employers

Send a job-specific resume in minutes.

Benefits offered by this job

Bonus
Equity
Benefits

Job summary

Meta is seeking an experienced Reliability Engineer to join the Asset Management & Reliability team within Facility Operations in Phoenix. You will own end-to-end reliability initiatives, scoping roadmaps and solving complex problems to ensure seamless data center operations across sites.

Responsibilities include leading FMEA, maintaining the Global Maintenance Library, and driving corrective maintenance while aligning with regulatory standards. Travel up to 25% is required.

Qualifications

  • Bachelor's degree in Mechanical, Electrical, Reliability Engineering, or a similar technical discipline, or 6+ years of relevant experience.
  • Eight or more years of reliability engineering experience related to electrical or mechanical cooling equipment.
  • Experience with Reliability Centered Maintenance (RCM) and FMEA activities to optimize maintenance and designs.
  • Ability to work independently within defined scope and manage complex problems.
  • Proficient in Enterprise Asset Management (EAM) solutions to extract data and gain insights.
  • Knowledge of ISO 14224, ISO 17359, ISO 55000 standards.

Responsibilities

  • Lead FMEA and establish maintenance strategies.
  • Govern content for Global Maintenance Library and enforce maintenance changes.
  • Drive corrective maintenance via root cause analysis and preventive measures.
  • Evaluate regulatory and compliance requirements across reliability activities.
  • Support condition-based monitoring and diagnostics programs (vibration, IR, PD, robotics).
  • Improve MTTR and MTBF metrics for continuous improvement.

Skills

Reliability engineering
RCM & FMEA
EAM data analytics
ISO standards familiarity
Project management
Cross-functional collaboration

Education

Bachelor's degree in Mechanical, Electrical, Reliability Engineering

Job description

Summary:

Meta is seeking an experienced and self-motivated Reliability Engineer to join our Asset Management & Reliability team within Facility Operations. This person will work within Facility Operations to identify and manage asset reliability risks and various stages of end-to-end asset lifecycle for the Data Center Operations. Managing stakeholders spread across time zones and key to the success of our individual projects and overall asset management, and reliability program. In this role, you will be expected to own and execute within your focus areas, contribute to scoping and roadmapping for reliability initiatives, and solve complex technical problems to ensure seamless operations across new and existing sites.

Required Skills:

Data Center Facility Operations Reliability Engineer Responsibilities:

  1. Lead operational Failure Mode and Effects Analysis (FMEA) and establish maintenance strategies.

  2. Manage and govern content for the Global Maintenance Library, ensuring rigorous Maintenance Change Management processes are followed.

  3. Drive Corrective Maintenance initiatives through deep Failure Mode Analysis to identify root causes and implement preventive measures.

  4. Evaluate regulatory and compliance requirements, providing governance and ensuring adherence across all reliability activities.

  5. Support and execute Condition-Based Monitoring and Diagnostics programs, including testing, vibration analysis, infrared (IR), partial discharge (PD), and robotics applications.

  6. Assess and optimize Mean Time To Repair (MTTR) and Mean Time Between Failures (MTBF) metrics to drive continuous improvement.

  7. Contribute to continuous production risk models to prioritize resources and mitigate operational vulnerabilities.

  8. Manage non-critical scope and support supplier scope management to ensure external partners meet reliability and quality standards.

  9. Implement and optimize sensor-based condition monitoring and maintenance (e.g., infrared, temperature, pressure, flow, leak detection) to remotely monitor and assign maintenance tasks.

  10. Support technical insourcing versus outsourcing decision-making for maintenance and reliability activities.

  11. Establish Service Bill of Materials (BOM) setups and drive initial and continuous spares selection processes.

  12. Develop and execute a comprehensive whole-equipment sparing strategy to minimize downtime.

  13. Identify First-of-Kind (FOK) parts and establish Parts Factory Base Part Number (FBPN) setups.

  14. Conduct Form-Fit-Function technical analysis to evaluate and approve replacement components.

  15. Act as the primary liaison to IBOS and ISCE teams for managing replacement parts backlog, timeliness, tooling requirements, and auditing.

  16. Identify reliability opportunities and contribute to engineering excellence within the team.

Minimum Qualifications:

Minimum Qualifications:

  1. Bachelor's degree in Mechanical, Electrical, Reliability Engineering, or a similar technical discipline or 6+ years relevant industry experience will be considered in lieu of 8+ years relevant industry experience

  2. 8+ years of experience in reliability engineering (related to electrical or mechanical cooling equipment) or related Engineering roles

  3. Experienced in Reliability Centered Maintenance (RCM) and Failure Mode and Effects Analysis (FMEA) activities for maintenance, process, and equipment design optimization to meet reliability requirements

  4. Proven ability to execute independently within defined scope and manage complex problems with guidance on ambiguous areas

  5. Proficient in the usage of Enterprise Asset Management (EAM) solutions to extract data and develop meaningful insights

  6. Knowledgeable of relevant ISO standards (ISO 14224, ISO 17359, ISO 55000)

  7. Experience with project management and cross-functional collaboration

  8. Ability to travel 25% domestically and internationally

Preferred Qualifications:

Preferred Qualifications:

  1. Experience with data center equipment such as critical cooling systems, generators, main switchboards, and network gear

  2. Proficient in data analysis techniques that can include Process Control, Reliability modeling and prediction, Fault Tree Analysis, Weibull Tree Analysis, and Six Sigma (6σ) Methodology

  3. Proficient in developing and executing comprehensive test plans for assets

  4. Experience supporting technical initiatives and advocating for high-quality engineering standards

  5. Certifications in Maintenance & Reliability such as CMRP, CRL, or CRE

Public Compensation:

$114,000/year to $168,000/year + bonus + equity + benefits

Industry: Internet

Equal Opportunity:

Meta is proud to be an Equal Employment Opportunity and Affi… (full EEO paragraph content here)

Meta is committed to providing reasonable accommodations … (full accommodation paragraph content here)

Get your free, confidential resume review.
or drag and drop your file here.
Similar jobs

Similar jobs worth comparing

Data Center Facility Operations Reliability Engineer
Data Center Facility Operations Reliability Engineer

Meta • Olympia (WA)

On-site
USD 143,000 - 198,000
Data Center Facility Operations Reliability Engineer
Data Center Facility Operations Reliability Engineer

Meta • Trenton (NJ)

On-site
USD 143,000 - 198,000
Data Center Facility Operations Reliability Engineer
Data Center Facility Operations Reliability Engineer

Meta • Lincoln (NE)

On-site
USD 143,000 - 198,000
Data Center Facility Operations Reliability Engineer
Data Center Facility Operations Reliability Engineer

Meta • Madison (WI)

On-site
USD 143,000 - 198,000
Data Center Facility Operations Reliability Engineer
Data Center Facility Operations Reliability Engineer

Meta • Augusta (ME)

On-site
USD 143,000 - 198,000
Bonus
Equity
Data Center Facility Operations Reliability Engineer
Data Center Facility Operations Reliability Engineer

Meta • Atlanta (GA)

On-site
USD 143,000 - 198,000
Data Center Facility Operations Reliability Engineer
Data Center Facility Operations Reliability Engineer

Meta • Lansing (MI)

On-site
USD 143,000 - 198,000
Reliability & Asset Management
Reliability & Asset Management

Meta • Charleston (WV)

On-site
USD 143,000 - 198,000
Reliability & Asset Management
Reliability & Asset Management

Meta • Montpelier (VT)

On-site
USD 143,000 - 198,000
Data Center Facility Operations Reliability Engineer
Data Center Facility Operations Reliability Engineer

Meta • United States

On-site
USD 143,000 - 198,000