Senior SRE Engineer – Multi-Cloud & Observability
Agile Resources AB · Göteborg
posted 2d ago, verified live
Key factors at a glance
- Seniority
- Senior
- Experience
- 5+ years
- Work mode
- —
- Salary
- Not stated
- Required working language
- English
Must-haves
- 5+ years DevOps, SRE or cloud platform experience
- Technical leadership experience in senior or lead specialist role
- Production experience with large-scale distributed systems
- Deep Kubernetes knowledge and core components
- Design and establish observability solutions from scratch
- AWS and GCP (platform services, storage, databases, networking)
- Prometheus, Grafana, Loki, Elastic, Kibana, OpenTelemetry
- Terraform, Pulumi or CDK
- Python, Go or Java
Nice-to-haves
- eBPF knowledge
- Chaos engineering experience
- Disaster recovery knowledge
- Mandarin language skills
How you match
See how your skills match this role — and what to learn to close the gap.
UnlockCompany hiring signal
See whether Agile Resources AB is scaling up or slowing down, from its posting history.
Original posting
SwedishDriv observability, driftsäkerhet och kostnadsoptimering i en komplex multi-cloud-miljö. Rollen passar dig som vill förbättra plattformar, incidenthantering och produktionsstabilitet. Vill du ta ett helhetsansvar för driftsäkerhet, observability och kostnadsoptimering i en komplex molnplattform? I den här seniora SRE-rollen arbetar du nära produktionskritiska system och driver långsiktiga förbättringar i en multi-cloud-miljö. Om rollen Ta ett tekniskt ledande ansvar för SRE, plattformstabilitet och produktionsdrift. Utforma, implementera och vidareutveckla observability från infrastruktur till affärsflöden. Driva systematiskt arbete med tillförlitlighet, riskreducering och molnkostnader. Delta i beredskap enligt rullande schema. Det här kommer du göra Bygga en enhetlig observability-arkitektur för metrics, loggar och traces. Införa dashboards, larmnivåer, SLI/SLO:er och principer för error budgets. Optimera kostnader och resursutnyttjande i AWS och GCP enligt FinOps-principer. Förbättra Kubernetes-kluster, incidentprocesser, rotorsaksanalyser och återställningsmekanismer. Ta fram ramverk för incidenthantering, utrullningar, rollback och tekniska risker. Vi söker dig som har Minst fem års erfarenhet inom DevOps, SRE eller cloud platform. Erfarenhet av tekniskt ledarskap i senior eller ledande specialistroll. Vana att drifta storskaliga distribuerade system i produktionsmiljö. Djup kunskap om Kubernetes och dess centrala komponenter. Erfarenhet av att designa och etablera observability-lösningar från grunden. Teknik & Verktyg AWS och GCP, inklusive plattformstjänster, lagring, databaser och nätverk. Kubernetes, EKS och GKE. Terraform, Pulumi eller CDK. Prometheus, Grafana, Loki, Elastic, Kibana och OpenTelemetry. Python, Go eller Java; kunskap om eBPF, chaos engineering och disaster recovery är meriterande. Praktisk information Ort: Göteborg. Arbetssätt: Ej specificerat. Språk: Engelska i professionell arbetsmiljö. Mandarin är meriterande.
Shown in its original Swedish. To apply, continue to the company's own page.