Senior Site Reliability Engineer, IaaS

Algolia
Paris
Workplace: OnsiteFull timeFunction: DevOps, Cloud & InfrastructureSkills: ["Problem-solving","Judgement","Communication","Mentorship"]

Shape Algolia’s next-generation IaaS production infrastructure by leading cloud baseline and reliable lifecycle capabilities for a cloud-native, Kubernetes-based platform. Own major initiatives such as cloud identity, networking, security, auditability, cluster lifecycle automation, upgrade strategies, and infrastructure drift reduction. Build self-service interfaces and automated guardrails for compliance, security, reliability, and safe change management, while improving fleet efficiency and leading complex production issue resolution.

Loading

Loading job details...

Preparing the role view and application actions.

FursaFursa
Algolia
Algolia
1 year ago

Senior Site Reliability Engineer, IaaS

✓ Verified Job

Canonical indexed version, validated from employer's careers page.

Source: Company careers pageValidated by: Fursa AI
Last checked: 13 hours agoStatus: Live

Job Summary

Shape Algolia’s next-generation IaaS production infrastructure by leading cloud baseline and reliable lifecycle capabilities for a cloud-native, Kubernetes-based platform. Own major initiatives such as cloud identity, networking, security, auditability, cluster lifecycle automation, upgrade strategies, and infrastructure drift reduction. Build self-service interfaces and automated guardrails for compliance, security, reliability, and safe change management, while improving fleet efficiency and leading complex production issue resolution.
Location: Paris
Workplace: Onsite
Employment Type: Full time
Job Function: DevOps, Cloud & Infrastructure
Seniority: Mid level

Key Responsibilities

  • •Lead the design and evolution of Cloud Baseline capabilities across cloud providers, including identity and access, networking, security, auditability, tagging, inventory, and cost visibility.
  • •Design and automate cloud infrastructure foundations that enable a growing fleet of production Kubernetes clusters.
  • •Lead complex infrastructure initiatives such as cloud-environment standardisation, cluster lifecycle automation, upgrade strategies, or infrastructure-drift reduction.
  • •Ensure cloud and Kubernetes lifecycle operations and guardrails are reliable and scalable for large-scale workload migration.
  • •Participate in on-call and lead resolution of complex production issues; mentor engineers and raise infrastructure design/operations quality across the team.

Key Requirements

  • •Strong hands-on production expertise with AWS or GCP.
  • •Deep practical Kubernetes knowledge and its operational challenges.
  • •Ability to design, build, and operate reliable cloud infrastructure in production.
  • •Infrastructure-as-code and automation skills, ideally Terraform with Python, Go, or equivalents.
  • •Solid knowledge of Linux, networking, distributed systems, and production operations.
Experience:KubernetesCloud infrastructureProduction operationsPlatform engineering
Skills:Problem-solvingJudgementCommunicationMentorship
Languages:English
Tech Stack:AWSGCPKubernetesCloud infrastructureTerraformPythonGoLinuxNetworkingDistributed systemsArgo CDHelmOPAKyvernoGitOpsPolicy-as-codeAI-assisted engineering tools

Company Brief

Algolia
Provides a hosted search and discovery API that enables developers and product teams to build fast, relevant search and discovery experiences across websites and applications with features like instant search, personalization, and analytics.
Industry: API Platforms
Company Size: Enterprise (1,001+ employees)
Growth: Scaleup
Valuation: Unicorn (USD 1B+)
Funding: Series D
Headquarters: San Francisco, United States
Founded: 2012
WebsiteLinkedIn