Site Reliability Engineer - Infrastructure
VERISIGN · Reston, VA · 1 mo ago
Hybrid$136k–$184k/yrFull-time
Responsibilities
- Serve as a subject matter expert in Linux systems administration, including performance tuning, OS hardening, and advanced troubleshooting
- Architect, install, configure, and maintain production and non-production systems supporting enterprise application delivery and security platforms
- Design, maintain, and optimize enterprise CI/CD pipelines with emphasis on CloudBees Jenkins and GitHub Actions administration, automation, integrations, credential management, and platform scalability
- Administer and optimize key enterprise platforms including: CI/CD platforms (CloudBees Jenkins, GitHub Actions), work management systems (Jira), source control and collaboration tools (GitHub, GitHub Enterprise), artifact repositories (JFrog Artifactory)
- Administer and support software supply chain security and DevSecOps tooling, including Nexus IQ Firewall, JFrog Xray, GitHub Advanced Security (GHAS)
- Ensure platforms and processes meet security, audit, and compliance requirements, including SOC and SOX controls
- Design and implement automation to improve system reliability, scalability, and operational efficiency
- Lead incident response efforts, including troubleshooting, root cause analysis, and long-term remediation
- Maintain and support Kubernetes containerized workloads where applicable
- Develop and maintain infrastructure-as-code using tools such as Terraform, Ansible, or similar
- Participate in a 24x7 on-call rotation supporting critical enterprise platforms
Requirements
- Bachelor’s degree in computer science, engineering, or equivalent work experience
- 8+ years of experience in systems engineering, site reliability engineering, or systems administration in enterprise environments
- Expert-level experience with Linux/Unix systems administration in production environments
- Hands-on experience administering: CloudBees Jenkins/GitHub Actions (CI/CD pipeline administration, scaling, and maintenance), GitHub / GitHub Enterprise (repository management, access controls, integrations), Jira (project configuration, workflows, automation), Artifactory (repository management and artifact lifecycle)
- Expertise in application delivery and security tools (such as Nexus IQ, Xray, or GitHub Advanced Security)
- Strong understanding of SOC and SOX compliance frameworks, including audit controls and evidence management
- Proven experience with automation and infrastructure-as-code (such as Terraform, Ansible, Puppet, or Chef)
- Strong scripting and programming skills (such as Python, Bash, or similar)
- Solid understanding of networking fundamentals (TCP/IP, DNS, routing, firewalls)
- Experience operating and troubleshooting container platforms (Kubernetes, Docker)
- Experience with monitoring and observability tools (such as Prometheus, ELK, Nagios, or similar)
- Demonstrated ability to troubleshoot complex, cross-platform production issues
Preferred Qualifications
- Experience implementing DevSecOps practices and secure CI/CD pipelines
- Familiarity with identity and access management systems (LDAP, SSO, RBAC models)
- Experience with private cloud or virtualization platforms (such as OpenStack, VMware, or similar)
- Knowledge of vulnerability management, patching strategies, and system hardening best practices
- Experience working in regulated or compliance-driven environment