Data Center Reliability Engineer (Nashville, TN on-site)
Oracle · Nashville, TN · 1 mo ago
Information Technology$102k–$210k/yrFull-time
Responsibilities
- Support reliability activities for critical electrical, mechanical, and controls-related infrastructure across assigned sites or programs.
- Review commissioning and startup plans to ensure systems meet design intent and are operationally supportable at turnover.
- Aid in developing maintenance programs that improve operability, reduce downtime, and balance lifecycle cost.
- Analyze equipment performance, maintenance data, and operational trends to identify risks and improvement opportunities.
- Support root cause analysis and corrective action development for reliability-related issues and recurring failures.
- Partner with Site Operations to provide technical guidance during equipment failures, abnormal conditions, or troubleshooting efforts.
- Review construction submittals, O&M documentation, and turnover materials to evaluate maintainability and operational readiness.
- Support risk assessments, spare parts analysis, lifecycle planning, and end-of-useful-life considerations for critical assets.
- Contribute feedback to Design Engineering teams on reliability, maintainability, and operating experience from live sites.
- Help improve site response procedures, documentation quality, and repeatable reliability practices across the portfolio.
Requirements
- 3–5 years of experience in critical facilities, data center operations, industrial maintenance, commissioning, or reliability-related environments.
- Working knowledge of mission-critical facility systems across electrical, mechanical, and/or controls domains.
- Experience supporting maintenance planning, system testing, troubleshooting, or failure analysis in operational environments.
Qualifications
- Bachelor’s degree in Engineering or related field preferred; equivalent field experience also valued.
- Strong analytical and problem-solving capability.
- Ability to work across multiple teams in a fast-paced environment.
- Strong written and verbal communication skills.
- Attention to detail and process discipline.
- Ability to balance technical rigor with practical operational needs.
Skills And Competencies
- Familiarity with CMMS, asset management systems, commissioning processes, or maintenance planning tools.
- Exposure to RAM analysis, spare parts analysis, or lifecycle cost analysis.
- Working knowledge of one-lines, P&IDs, sequences of operation, or controls architecture documentation.
- Data center, utility, healthcare, semiconductor, telecom, or other uptime-critical experience is a plus.