Senior Site Reliability Engineer

Gridcare
Redwood City
Workplace: HybridFull timeUSD 180,000 - 230,000Function: DevOps, Cloud & InfrastructureSkills: ["Incident response","Partnership","Reliability focus"]

Own reliability, scalability, and observability for production systems serving utilities and data center operators. Design and operate AWS infrastructure with Terraform and Kubernetes, build monitoring/alerting with SLOs/SLIs, and automate deployment and self-healing to reduce toil. Partner with engineering on architecture reviews and lead incident response. Drive database and real-time grid data pipeline reliability while advancing security and compliance best practices.

Loading

Loading job details...

Preparing the role view and application actions.

FursaFursa
Gridcare
Gridcare
2 days ago

Senior Site Reliability Engineer

✓ Verified Job

Canonical indexed version, validated from employer's careers page.

Source: Company careers pageValidated by: Fursa AI
Last checked: 7 hours agoStatus: Live

Job Summary

Own reliability, scalability, and observability for production systems serving utilities and data center operators. Design and operate AWS infrastructure with Terraform and Kubernetes, build monitoring/alerting with SLOs/SLIs, and automate deployment and self-healing to reduce toil. Partner with engineering on architecture reviews and lead incident response. Drive database and real-time grid data pipeline reliability while advancing security and compliance best practices.
Location: Redwood City
Workplace: Hybrid
Employment Type: Full time
Job Function: DevOps, Cloud & Infrastructure
Seniority: Mid level

Key Responsibilities

  • •Design and operate infrastructure on AWS using Terraform and Kubernetes.
  • •Build monitoring, alerting, and observability with meaningful SLOs/SLIs.
  • •Automate away toil via deployment pipelines, capacity management, and self-healing systems.
  • •Partner with engineering on architecture reviews to identify reliability and scalability risks.
  • •Manage database and data pipeline reliability for large-scale, real-time grid data processing, while driving security and compliance best practices.

Pay and Benefits

Salary: USD 180,000 - 230,000
Perks:Health InsuranceDentalVision

Key Requirements

  • •5+ years in SRE, DevOps, or infrastructure engineering roles.
  • •Deep experience with Kubernetes and Terraform/IaC, plus cloud platforms (AWS preferred).
  • •Strong scripting/programming ability (Python, Bash).
  • •Observability experience (Prometheus, Grafana, Datadog).
  • •Track record running on-call and leading incident response.
Skills:Incident responsePartnershipReliability focus
Tech Stack:AWSTerraformKubernetesPrometheusGrafanaDatadogPythonBashGitHub ActionsArgoCDFluxGitOps

Company Brief

Gridcare
Provides an AI-powered platform that unlocks near-term electricity capacity on existing grids to accelerate data center and AI infrastructure deployment, partnering with utilities and developers to speed interconnections and reduce time-to-power.
Industry: Utilities
Company Size: Small (11 to 50 employees)
Growth: Early Stage Startup
Funding: Seed
Headquarters: Redwood City, United States
Founded: 2024
WebsiteLinkedIn