Jobs / IFS
Principal Site Reliability Engineer – Performance (A&D, Ultra HA/Exadata)
IFS · Ottawa, ON, Canada
Ottawa, ON, CanadaExp: 10+ yrs134,000-179,000 CAD/yearlyRemote
Remuneration
134,000-179,000 CAD/yearly
Location
Ottawa, ON, Canada
Visa sponsorship
Not specified
Job summary
The Principal Site Reliability Engineer – Performance at IFS will lead the Site Reliability Engineering practices within the Unified Support organization, focusing on delivering 24x7x365 support excellence for Ultra High Availability environments in the Aerospace & Defense industry.
Qualifications
- Minimum 10+ years of experience in cloud computing services or site reliability engineering
- Minimum 7-8 years in hands-on SRE, DevOps, or cloud operations roles
- Proven experience leading SRE teams and establishing SRE practices
- Expertise in performance engineering including load testing and system optimization
- Experience operating or supporting Oracle Exadata platforms in production
Responsibilities
- Set technical direction and establish long-term reliability strategies for IFS cloud products supporting the A&D industry
- Own proactive performance monitoring for Ultra HA on Exadata customers
- Lead resolution of complex incidents affecting A&D customers
- Champion the elimination of toil through intelligent automation
- Establish knowledge management frameworks for cloud-based applications
Skills
AnsibleAppDynamicsAWSAzureBashCloudFormationDatadogDockerDynatraceElastic APMElasticsearchGCPGoGrafanaJiraKafkaKibanaKubernetesLinuxLogstashNew RelicNGINXOpenTelemetryPowerShellPrometheusPythonRabbitMQServiceNowSplunkTerraformJava
Relocation
No