Jobs · Information Technology · Tennessee

Data Center Reliability Engineer (Nashville, TN on-site)

Oracle · Nashville, TN · 1 mo ago
Information Technology$102k–$210k/yrFull-time

Responsibilities

  • Support reliability activities for critical electrical, mechanical, and controls-related infrastructure across assigned sites or programs.
  • Review commissioning and startup plans to ensure systems meet design intent and are operationally supportable at turnover.
  • Aid in developing maintenance programs that improve operability, reduce downtime, and balance lifecycle cost.
  • Analyze equipment performance, maintenance data, and operational trends to identify risks and improvement opportunities.
  • Support root cause analysis and corrective action development for reliability-related issues and recurring failures.
  • Partner with Site Operations to provide technical guidance during equipment failures, abnormal conditions, or troubleshooting efforts.
  • Review construction submittals, O&M documentation, and turnover materials to evaluate maintainability and operational readiness.
  • Support risk assessments, spare parts analysis, lifecycle planning, and end-of-useful-life considerations for critical assets.
  • Contribute feedback to Design Engineering teams on reliability, maintainability, and operating experience from live sites.
  • Help improve site response procedures, documentation quality, and repeatable reliability practices across the portfolio.

Requirements

  • 3–5 years of experience in critical facilities, data center operations, industrial maintenance, commissioning, or reliability-related environments.
  • Working knowledge of mission-critical facility systems across electrical, mechanical, and/or controls domains.
  • Experience supporting maintenance planning, system testing, troubleshooting, or failure analysis in operational environments.

Qualifications

  • Bachelor’s degree in Engineering or related field preferred; equivalent field experience also valued.
  • Strong analytical and problem-solving capability.
  • Ability to work across multiple teams in a fast-paced environment.
  • Strong written and verbal communication skills.
  • Attention to detail and process discipline.
  • Ability to balance technical rigor with practical operational needs.

Skills And Competencies

  • Familiarity with CMMS, asset management systems, commissioning processes, or maintenance planning tools.
  • Exposure to RAM analysis, spare parts analysis, or lifecycle cost analysis.
  • Working knowledge of one-lines, P&IDs, sequences of operation, or controls architecture documentation.
  • Data center, utility, healthcare, semiconductor, telecom, or other uptime-critical experience is a plus.

Similar jobs