Ansökan
Senior SRE Engineer – Multi-Cloud & Observability
Vill du ta ett helhetsansvar för driftsäkerhet, observability och kostnadsoptimering i en komplex molnplattform? I den här seniora SRE-rollen arbetar du nära produktionskritiska system och driver långsiktiga förbättringar i en multi-cloud-miljö.
Om rollen
- Ta ett tekniskt ledande ansvar för SRE, plattformstabilitet och produktionsdrift.
- Utforma, implementera och vidareutveckla observability från infrastruktur till affärsflöden.
- Driva systematiskt arbete med tillförlitlighet, riskreducering och molnkostnader.
- Delta i beredskap enligt rullande schema.
Det här kommer du göra
- Bygga en enhetlig observability-arkitektur för metrics, loggar och traces.
- Införa dashboards, larmnivåer, SLI/SLO:er och principer för error budgets.
- Optimera kostnader och resursutnyttjande i AWS och GCP enligt FinOps-principer.
- Förbättra Kubernetes-kluster, incidentprocesser, rotorsaksanalyser och återställningsmekanismer.
- Ta fram ramverk för incidenthantering, utrullningar, rollback och tekniska risker.
Vi söker dig som har
- Minst fem års erfarenhet inom DevOps, SRE eller cloud platform.
- Erfarenhet av tekniskt ledarskap i senior eller ledande specialistroll.
- Vana att drifta storskaliga distribuerade system i produktionsmiljö.
- Djup kunskap om Kubernetes och dess centrala komponenter.
- Erfarenhet av att designa och etablera observability-lösningar från grunden.
Teknik & Verktyg
- AWS och GCP, inklusive plattformstjänster, lagring, databaser och nätverk.
- Kubernetes, EKS och GKE.
- Terraform, Pulumi eller CDK.
- Prometheus, Grafana, Loki, Elastic, Kibana och OpenTelemetry.
- Python, Go eller Java; kunskap om eBPF, chaos engineering och disaster recovery är meriterande.
Praktisk information
- Ort: Göteborg.
- Arbetssätt: Ej specificerat.
- Språk: Engelska i professionell arbetsmiljö. Mandarin är meriterande.
Sök rollen
Skicka in dina uppgifter och ditt CV här.