75 staff site reliability engineer jobs at 53 companies in United States

3mo
Save
Mark Applied
Hide
Staff Site Reliability Engineer
Austin, Texas, United States
$132k-$210k/yr HybridFull Time
Visa
VisaNYSE: V: Global payment technology facilitating electronic funds transfers.
Lead CI/CD, IaC, and cloud initiatives; mentor engineers; ensure platform resilience.
CI/CD, Infrastructure as Code, Cloud, Kubernetes, Terraform
3mo
Save
Mark Applied
Hide
Staff Site Reliability Engineer
New York City or Chicago or Denver or Houston
$240k-$300k/yr OnsiteFull Time
Legora: AI workspace for legal document research and drafting.
Extensive experience designing and operating large-scale production systems; lead reliability initiatives; strong distributed systems architecture; in-person NYC role.
2mo
Save
Mark Applied
Hide
Staff Site Reliability Engineer
United States
$165k-$230k/yr RemoteFull Time
SimSpace
SimSpace: Provides high-fidelity cyber ranges for cybersecurity training and testing.
8+ YOE8+ years SRE/DevOps, expert software engineering, multi-cluster Kubernetes, GitOps, observability, security mindset, strong communicator.
Jsonnet, Grafana Tanka, Kustomize, Kubernetes, GitHub Actions, ArgoCD, CI/CD, Observability, Grafana, Terraform
2w
Save
Mark Applied
Hide
Staff Site Reliability Engineer
Santa Clara, California, United States
$163k-$214k/yr OnsiteFull Time
IonQ
IonQNYSE: IONQ: Develops and sells trapped-ion quantum computers and cloud services.
7+ YOE7+ years production engineering experience; hands-on AWS/GCP reliability, observability and SLO ownership, incident command, resilience testing, and multi-team technical leadership.
AWS, GCP, Amazon Bedrock Agent Core
2mo
Save
Mark Applied
Hide
Staff Site Reliability Engineer
Glastonbury, Connecticut, United States
$180k-$250k/yr RemoteFull Time
Finalsite
Finalsite: Software platform for school websites, communications, and enrollment management.
10+ YOE10+ years as Staff SRE or senior infra engineer; strong AWS/GCP; Kubernetes; CI/CD; IaC; observability; AI tool experience.
AWS, GCP, Terraform, Kubernetes, CI/CD, Observability tools, AI-assisted development tools
1mo
Save
Mark Applied
Hide
Staff Site Reliability Engineer
United States
RemoteFull Time
StackBlitz
StackBlitz: Build and deploy full-stack web apps in the browser.
Significant SRE/production engineering experience across multi-cloud (AWS/GCP/Azure), Terraform, TypeScript and Ruby on Rails; strong software engineering, technical leadership, and incident management skills.
AWS, GCP, Azure, Terraform, TypeScript, Ruby on Rails
2mo
Save
Mark Applied
Hide
Staff Site Reliability Engineer
Argentina or Toronto or United States
RemoteFull Time
Domino Data Lab
Domino Data Lab: Enterprise MLOps platform for developing and managing AI models.
Deep SRE/platform engineering experience, hands-on operational ownership, fluency with Kubernetes and Linux, strong software engineering skills in Python or Go, observability and SLO/SLI expertise, mentoring and cross-team influence.
Kubernetes, Linux, Python, Go, LLM
2mo
Save
Mark Applied
Hide
Staff Site Reliability Engineer
Chicago, Illinois, United States
$132k-$220k/yr HybridFull Time
CME Group
CME GroupNASDAQ: CME: Operates global derivatives marketplaces for trading futures and options.
10+ YOE3+ Mgmt10+ years in SRE/Systems/Software engineering; 3+ years in a staff/principal/tech lead role; experience leading cloud migrations or re-architecting platforms; GCP/Kubernetes; Python; Go; financial/regulatory environment familiarity.
Python, Go, Kafka, Kubernetes, GCP, Terraform, ArgoCD, Node.js
3mo
Save
Mark Applied
Hide
Senior/Staff Site Reliability Engineer
San Francisco, California, United States
$325k-$485k/yr OnsiteFull Time
Ivo
Ivo: AI-powered contract review and intelligence platform for legal teams.
Senior/Staff Site Reliability Engineer focusing on uptime, SLO/SLI/SLA, disaster recovery, data residency, security controls, observability, and incident response.
1mo
Save
Mark Applied
Hide
Staff Engineer, Site Reliability
United States or Canada
$227k-$272k/yr RemoteFull Time
Babylist
Babylist: Operates an e-commerce platform and universal registry for baby products.
Hands-on Terraform and AWS (EKS, RDS) expertise; production Kubernetes operation; CI/CD design and reliability; observability (Datadog, Sentry, PagerDuty, Cronitor); on-call and incident management; strong developer support skills.
Ruby on Rails, AWS, Sidekiq, MySQL, Redis, Terraform, EKS, RDS, Kubernetes, CircleCI, GitHub Actions, Datadog, Sentry, PagerDuty, Cronitor
2w
Save
Mark Applied
Hide
Staff Site Reliability Engineer
Portland or Denver
$148k-$193k/yr HybridFull Time
DAT Freight & Analytics: Software platform for freight matching and logistics data analytics.
10+ YOE10+ years industry experience, 3+ years software engineering, cloud and observability expertise (Datadog,AWS), Kubernetes, IaC (Terraform), on-call experience, leadership and incident response skills.
JavaScript, Python, Go, Java, Kotlin, C++, Datadog, AWS, Kubernetes, ArgoCD, Terraform, Github Actions
2mo
Save
Mark Applied
Hide
Staff Site Reliability Engineer
Mountain View, California, United States
$252k-$308k/yr HybridFull Time
EarnIn
EarnIn: Provides immediate access to earned wages through a mobile app.
7+ YOE7+ years in SRE or related field; experience applying AI/LLMs to operations; strong SLO/SLI and incident management; software engineering in Python or Go; observability and IaC proficiency; AI-assisted development tools; fintech/regulated environment experience.
Datadog, CloudWatch, OpenTelemetry, Terraform, Kubernetes, AWS, Python, Go, Cursor, Claude Code, Copilot
1mo
Save
Mark Applied
Hide
Staff Cyber Site Reliability Engineer (SRE)
Bethesda or Palo Alto or Dallas or Seattle
$110k-$230k/yr HybridFull Time
GEICO
GEICO: Provides vehicle and property insurance services to consumers.
8+ YOE8+ years in software or site reliability engineering; 5+ years in SRE/DevOps; strong Python; Golang preferred; AWS/Azure/GCP experience; CI/CD and IaC; observability and incident response; security tooling familiarity.
Python, Golang, Grafana, Prometheus, GitHub Actions, Jenkins, Terraform, Ansible
2mo
Save
Mark Applied
Hide
Sr. Staff Site Reliability Engineer
Palo Alto, California, United States
$232k-$263k/yr OnsiteFull Time
Obsidian Security
Obsidian Security: Provides cybersecurity and threat detection for enterprise SaaS applications.
5+ YOE5+ years in SRE/Production Engineering; 3+ years in senior/leadership role; expertise in AWS/GCP, Kubernetes/Helm, observability stacks, CI/CD; experience with multi-tenant SaaS reliability.
AWS, GCP, Kubernetes, Helm, Prometheus, Grafana, GitLab CI/CD, ArgoCD
1mo
Save
Mark Applied
Hide
Staff Site Reliability Engineer - Volcano
United States
$150k-$210k/yr RemoteFull Time
Kong
Kong: Provides cloud-native API management and service mesh platforms.
B.S. in Computer Science or equivalent; substantial Staff/Principal-level SRE/platform engineering experience; deep Kubernetes expertise; experience defining SLOs, incident response, and operating multi-tenant data services; familiarity with ArgoCD, Helm, Terraform/Terragrunt, Datadog, Prometheus, and Grafana.
Kubernetes, ArgoCD, Helm, Terraform, Terragrunt, PostgreSQL, Redis, Datadog, Prometheus, Grafana, GitOps, CI/CD, CNI
3mo
Save
Mark Applied
Hide
Staff Site Reliability Engineer
Chicago or Reston or Crum Lynne or Greenwood Village or Boca Raton or White Plains
$113k-$188k/yr HybridFull Time
TransUnion
TransUnionNYSE: TRU: Provides global credit reporting and risk management information solutions.
5+ YOE5+ years in cloud/SRE/Platform engineering; expert in GCP, Kubernetes, CI/CD, monitoring; on-call; architectural leadership; IaC; scripting; security; capacity planning.
Google Cloud Platform, Kubernetes, CI/CD, Datadog, Prometheus, Grafana, PagerDuty, Linux, PostgreSQL, MySQL, Redis, Terraform, Pulumi, Python, Bash, Go, Security architecture, IaC tooling
4w
Save
Mark Applied
Hide
Staff Site Reliability Engineer
Oak Brook, Illinois, United States
$103k-$193k/yr OnsiteFull Time
Chamberlain Group
Chamberlain Group: Provides smart access solutions and residential garage door openers.
7+ YOEBachelor's in CS or related, 7+ years infrastructure/operations experience, software development experience, cloud (AWS) and Linux/Windows expertise, Terraform/Argo CD, Kubernetes, observability tools, Agile/Scrum experience.
AWS, Terraform, Argo CD, Kubernetes, Prometheus, Grafana, Datadog, New Relic, Linux, Windows, Active Directory, PowerShell, Python, Go, Bash, SIEM, GitOps, Infrastructure as Code (IaC)
2w
Save
Mark Applied
Hide
Staff Site Reliability Engineer
United States
HybridFull Time
Tenex
Tenex: AI-powered managed detection and response cybersecurity services.
10+ YOE10+ years SRE/DevOps experience managing production systems at scale; cloud (AWS/GCP/Azure), Kubernetes, IaC (Terraform/Pulumi), observability, distributed systems, incident leadership, strong communication.
AWS, GCP, Azure, Kubernetes, EKS, GKE, Terraform, Pulumi, Prometheus, Grafana, ELK, Datadog, Agno, Temporal
1mo
Save
Mark Applied
Hide
Staff Site Reliability Engineer
Newton, Massachusetts, United States
$160k-$205k/yr OnsiteFull Time
Manifold
Manifold: AI platform for life sciences data and research collaboration.
7+ YOE7+ years in infrastructure/DevOps/SRE with deep cloud (AWS/GCP/Azure), Terraform, CI/CD (Github Action), container tooling, identity systems, data platform services, and experience operating secure multi-account environments.
AWS, GCP, Azure, Terraform, Github Action, Okta, Auth0, Docker, ECS, Packer, Tailscale, WireGuard, Snowflake, Airflow, dbt, PostgreSQL, LLM, CI/CD
3mo
Save
Mark Applied
Hide
Staff Site Reliability Engineer
San Francisco, California, United States
$200k-$260k/yr HybridFull Time
Sight Machine
Sight Machine: Developer of an AI-powered manufacturing data analytics platform.
10+ YOE10+ years experience with Kubernetes/Docker and major cloud providers, 10+ years coding (Python/Go/Java), IaC/CI-CD expertise, experience operating LLM/agentic AI systems, strong Linux and networking fundamentals.
Kubernetes, Docker, Azure, GCP, AWS, Python, Go, Java, Terraform, OpenTofu, FluxCD, Jenkins, GitHub Actions, Prometheus, Grafana, Loki, Sentry, Signoz, Helm Charts, Elasticsearch, Kafka, Postgres, LLM