Reliability & Asset Management

Meta

Montpelier (VT)

On-site

USD 143,000 - 198,000

Full time

14 days+

Get more replies from employers

Send a job-specific resume in minutes.

Job summary

Meta is seeking an experienced Reliability Engineer to join the Asset Management & Reliability team within Facility Operations. You will lead reliability initiatives across the data center fleet, drive scoping and roadmapping, and tackle complex technical ambiguities to ensure seamless operations across sites.

The role emphasizes FMEA leadership, maintenance strategy, and supplier management with international travel up to 25%.

Qualifications

  • Lead operational FMEA and establish maintenance strategies.
  • Govern content for the Global Maintenance Library with strict Change Management.
  • Drive Corrective Maintenance via root-cause Failure Mode Analysis.
  • Evaluate regulatory and ISO standards compliance.
  • Oversee Condition-Based Monitoring and diagnostics programs (IR, PD, vibration).
  • Optimize MTTR and MTBF for continuous improvement.
  • Develop production risk models to prioritize resources.
  • Manage supplier scope and non-critical work to meet reliability standards.
  • Implement sensor-based monitoring for remote maintenance tasks.
  • Decide insourcing vs outsourcing for maintenance work.

Responsibilities

  • Lead FMEA and establish maintenance strategies.
  • Govern the Global Maintenance Library with Change Management.
  • Drive corrective maintenance through root-cause analysis.
  • Ensure compliance with regulatory requirements across activities.
  • Oversee CBM and diagnostics programs including IR/PD/vibration.
  • Improve MTTR and MTBF through analysis and actions.
  • Develop and maintain risk models for production.
  • Coordinate supplier scope and external partners for reliability.
  • Implement sensor-based monitoring for remote tasks.
  • Drive efficiency in maintenance budgeting and planning.

Skills

FMEA
Maintenance Strategy
Content Governance
RCM
Diagnostics
MTTR/MTBF
Risk Modeling
Supplier Scope
Sensor Monitoring
Insourcing vs Outsourcing
BOM & Spares
Sparing Strategy
FBPN Setup
Form-Fit-Function
IBOS/ISCE Liaison
Reliability Opportunities

Education

Bachelor’s degree in Mechanical, Electrical, Reliability Engineering, or a similar technical discipline

Job description

Summary:

Meta is seeking an experienced and self-motivated Reliability Engineer to join our Asset Management & Reliability team within Facility Operations. This person will work at the leading edge of Facility Operations to identify and manage asset reliability risks and various stages of end-to-end asset lifecycle for the Data Center Operations. Managing stakeholders spread across time zones and key to the success of our individual projects and overall asset management, and reliability program. In this role, you will be expected to set the direction for your focus areas, drive scoping and roadmapping for reliability initiatives, and tackle the most complex technical ambiguities at the fleet level to ensure seamless operations across new and existing sites.

Required Skills:

Reliability & Asset Management Responsibilities:

  1. Lead operational Failure Mode and Effects Analysis (FMEA) and establish maintenance strategies.

  2. Manage and govern content for the Global Maintenance Library, ensuring rigorous Maintenance Change Management processes are followed.

  3. Drive Corrective Maintenance initiatives through deep Failure Mode Analysis to identify root causes and implement preventive measures.

  4. Evaluate regulatory and compliance requirements, providing governance and ensuring adherence across all reliability activities.

  5. Oversee Condition-Based Monitoring and Diagnostics programs, including testing, vibration analysis, infrared (IR), partial discharge (PD), and robotics applications.

  6. Assess and optimize Mean Time To Repair (MTTR) and Mean Time Between Failures (MTBF) metrics to drive continuous improvement.

  7. Develop and maintain continuous production risk models to prioritize resources and mitigate operational vulnerabilities.

  8. Manage non-critical scope and oversee supplier scope management to ensure external partners meet reliability and quality standards.

  9. Implement and optimize sensor-based condition monitoring and maintenance (e.g., infrared, temperature, pressure, flow, leak detection) to remotely monitor and assign maintenance tasks.

  10. Drive technical insourcing versus outsourcing decision-making for maintenance and reliability activities.

  11. Establish Service Bill of Materials (BOM) setups and drive initial and continuous spares selection processes.

  12. Develop and execute a comprehensive whole-equipment sparing strategy to minimize downtime.

  13. Identify First-of-Kind (FOK) parts and establish Parts Factory Base Part Number (FBPN) setups.

  14. Conduct Form-Fit-Function technical analysis to evaluate and approve replacement components.

  15. Act as the primary liaison to IBOS and ISCE teams for managing replacement parts backlog, timeliness, tooling requirements, and auditing.

  16. Create scope for yourself and others by identifying reliability opportunities and driving engineering excellence across the team.

Minimum Qualifications:

Minimum Qualifications:

  1. Bachelor’s degree in Mechanical, Electrical, Reliability Engineering, or a similar technical discipline plus 8+ years relevant industry experience will be considered in lieu of 10+ years relevant industry experience

  2. 10+ years of experience in reliability engineering (related to electrical or mechanical cooling equipment) or related Engineering roles

  3. Experienced in Reliability Centered Maintenance (RCM) and Failure Mode and Effects Analysis (FMEA) activities for maintenance, process, and equipment design optimization to meet reliability requirements

  4. Proven ability to independently scope work, set technical direction, and manage complex problems with high ambiguity

  5. Proficient in the usage of Enterprise Asset Management (EAM) solutions to extract data and develop meaningful insights

  6. Knowledgeable of relevant ISO standards (ISO 14224, ISO 17359, ISO 55000)

  7. Experience with program/project management and cross-functional team leadership

  8. Ability to travel 25% domestically and internationally

Preferred Qualifications:

Preferred Qualifications:

  1. Experience with data center equipment such as critical cooling systems, generators, main switchboards, and network gear

  2. Proficient in data analysis techniques that can include Process Control, Reliability modeling and prediction, Fault Tree Analysis, Weibull Tree Analysis, and Six Sigma (6σ) Methodology

  3. Proficient in developing and executing comprehensive test plans for assets

  4. Experience stepping into technical leadership gaps to advocate for high-quality engineering standards

  5. Certifications in Maintenance & Reliability such as CMRP, CRL, or CRE

Public Compensation:

$143,000/year to $198,000/year + bonus + equity + benefits

Industry: Internet

Equal Opportunity:

Meta is proud to be an Equal Employment Opportunity and Affimative Action employer. We do not discriminate based upon race, religion, color, national origin, sex (including pregnancy, childbirth, or related medical conditions), sexual orientation, gender, gender identity, gender expression, transgender status, sexual stereotypes, age, status as a protected veteran, status as an individual with a disability, or other applicable legally protected characteristics. We also consider qualified applicants with criminal histories, consistent with applicable federal, state and local law. Meta participates in the E-Verify program in certain locations, as required by law. Please note that Meta may leverage artificial intelligence and machine learning technologies in connection with applications for employment.

Meta is committed to providing reasonable accommodations for candidates with disabilities in our recruiting process. If you need any assistance or accommodations due to a disability, please let us know at accommodations-ext@meta.com.

Get your free, confidential resume review.
or drag and drop your file here.
Similar jobs

Similar jobs worth comparing

Reliability & Asset Management
Reliability & Asset Management

Meta • Charleston (WV)

On-site
USD 143,000 - 198,000
Data Center Facility Operations Reliability Engineer
Data Center Facility Operations Reliability Engineer

Meta • United States

On-site
USD 143,000 - 198,000
Data Center Facility Operations Reliability Engineer
Data Center Facility Operations Reliability Engineer

Meta • Atlanta (GA)

On-site
USD 143,000 - 198,000
Data Center Facility Operations Reliability Engineer
Data Center Facility Operations Reliability Engineer

Meta • Augusta (ME)

On-site
USD 143,000 - 198,000
Bonus
Equity
Data Center Facility Operations Reliability Engineer
Data Center Facility Operations Reliability Engineer

Meta • Olympia (WA)

On-site
USD 143,000 - 198,000
Data Center Facility Operations Reliability Engineer
Data Center Facility Operations Reliability Engineer

Meta • Trenton (NJ)

On-site
USD 143,000 - 198,000
Data Center Facility Operations Reliability Engineer
Data Center Facility Operations Reliability Engineer

Meta • Lansing (MI)

On-site
USD 143,000 - 198,000
Data Center Facility Operations Reliability Engineer
Data Center Facility Operations Reliability Engineer

Meta • Lincoln (NE)

On-site
USD 143,000 - 198,000
Data Center Facility Operations Reliability Engineer
Data Center Facility Operations Reliability Engineer

Meta • Madison (WI)

On-site
USD 143,000 - 198,000
Data Center Facility Operations Reliability Engineer
Data Center Facility Operations Reliability Engineer

Meta • Phoenix (AZ)

On-site
USD 114,000 - 168,000
Bonus
Equity
Benefits