Principal Site Reliability Engineer

Fidelity Financial Services

Confirmed live today High trust

Quick summary

Work type
On-site
Location
Westlake, TX
Posted
39 days ago
Freshness
Confirmed live today

Market check

Salary context

How this pay compares to similar roles

Similar $184k
$132k most similar roles pay here $239k

This listing doesn't post a salary. Most similar roles pay $152,186–$215,000.

Based on 238 similar postings.

Employer

About Fidelity Financial Services

Fidelity Investments is one of the largest financial services companies in the world, offering brokerage services, mutual funds, retirement planning, wealth management, and life insurance to individuals and institutions. Industry: Financial Services & Investment Management

Fidelity Financial Services currently has 32 open roles on FindRole.

Listed pay typically runs $150,000–$180,000 across 9 roles with salary data.

Most-posted roles

View all roles at Fidelity Financial Services

At a glance

TL;DR · Principal Site Reliability Engineer

As a Principal Site Reliability Engineer, you will join the team to deliver high-scale services with resilience by utilizing automation and Infrastructure Code. You will build reliability into the ecosystem by developing tools for observability and chaos testing of pipelines while creating products that improve platform availability. Your daily work involves designing containerized workloads on Kubernetes, managing cloud and on-premises systems using Azure ARM, Terraform, and CloudFormation Template, and automating business processes with Python scripts. You will also manage distributed systems using Datadog, Splunk, PowerBi, and Grafana while supporting DevOps practices through Jenkins and Azure DevOps. The role focuses on solving reliability challenges for workplace investing, healthcare, and defined benefits organizations by implementing chaos engineering, real-time metrics, and automated remediation strategies to ensure stable user experiences across both AWS and Azure cloud environments.

What does a Site Reliability Engineer earn?

Median $188000 from 129 postings across 39 companies.

See salary data

What you'll do

  • Deliver high-scale services using automation, Infrastructure as Code, and Site Reliability Engineering principles.
  • Develop and enhance internal chaos engineering frameworks to streamline executions and reporting.
  • Facilitate the adoption of chaos testing for application teams to identify and mitigate system weaknesses.
  • Design products and tools focused on improving platform stability and availability for containerized workloads.
  • Create scripts and applications to automate repeatable business processes across various platforms.
  • Manage cloud and on-premises systems using Terraform, Azure ARM, and Kubernetes.
  • Build monitoring, logging, and alerting services using tools like Datadog, Splunk, and Grafana.
  • Provide technical leadership and mentorship to team members regarding Site Reliability Engineering competencies.

What we're looking for

  • Bachelor's degree in Computer Science, Engineering, Information Technology, Information Systems, or a related field and experience as a Principal Site Reliability Engineer.
  • Master's degree in Computer Science, Engineering, Information Technology, Information Systems, or a related field and experience as a Principal Site Reliability Engineer.
  • Experience designing and automating container and Cloud-based platform products and infrastructure solutions within a production environment.
  • Expertise developing SRE products for containerized workloads and on-premises services using Kubernetes.
  • Experience managing datasets using query languages and developing reports using PowerBI and Grafana.
  • Expertise managing Cloud and on-premises systems using Infrastructure as Code tools like Azure ARM and Terraform.
  • Experience building, operating, monitoring, logging, and alerting distributed systems using Datadog and Splunk.
  • Proficiency in Python for automation and experience with AWS (Lambda, API Gateway, FIS), Azure Chaos Studio, Jenkins, and Azure DevOps.

More like this

Similar roles

Site Reliability Engineer

Balyasny Asset Management

Warsaw, Poland 87 days ago
Prometheus Grafana Loki Tempo OTEL Kubernetes Docker AWS Python Bash Go CI/CD DevOps SRE Agile
5+ yrs exp

Lead Site Reliability Engineer

JPMorgan Chase

Jersey City, NJ 54 days ago
Site Reliability Engineering Python Java Spring Boot .Net AI CI/CD Container Orchestration AWS Observability Monitoring Telemetry Networking System Architecture SDLC
5+ yrs exp

Senior Site Reliability Engineer

Fiserv

Berkeley Heights, NJ 15 days ago $128,000$216,000
AWS Kubernetes Terraform CI/CD GitHub Actions Python Bash Ruby on Rails Docker Linux Unix RDBMS Document Storage New Relic Dynatrace Datadog DNS Load Balancing Virtual Networking

Lead Site Reliability Engineer

JPMorgan Chase

Plano, TX 53 days ago
Site Reliability Engineering Python Java Spring Boot .NET CI/CD Docker Kubernetes Terraform AWS Prometheus Grafana Dynatrace Datadog Splunk infrastructure-as-code CloudFormation ECS Incident Management Observability
5+ yrs exp

Lead Site Reliability Engineer

JPMorgan Chase

New York, NY 52 days ago
Site Reliability Engineering SRE CI/CD Observability Monitoring Automation Change Management Dynatrace Splunk Geneos Grafana ITIL AWS Azure GCP Python Shell PowerShell Ansible Terraform Kubernetes OpenShift Microservices
5+ yrs exp

Site Reliability Engineer III

JPMorgan Chase

Chicago, IL 17 days ago
SRE Python Ansible Terraform Kubernetes Docker AWS Prometheus Grafana Dynatrace Datadog Splunk Linux Windows Jenkins GitLab Network as Code
3+ yrs exp