Unlock Full Resume Report

New offer - be the first one to apply!

September 4, 2026

Senior Site Reliability Engineer (Azure, Monitoring & Observability)

Senior • Remote

Warsaw, Poland

Budowany jest niewielki, 2–3-osobowy zespół odpowiedzialny za stworzenie i rozwój platformy Monitoring & Observability (M&O) oraz Data Quality dla całej organizacji.

Jako Senior Site Reliability Engineer będziesz odpowiadać za projektowanie, budowę i rozwój platformy M&O w środowisku Azure i data platform. Twoim zadaniem będzie rozwój monitoringu aplikacji, infrastruktury i danych, proaktywne wykrywanie problemów, alerting, analiza metryk, logów i trace’ów oraz automatyzacja procesów operacyjnych.

Informacje organizacyjne

  • Tryb realizacji usług: 100% zdalnie
  • Start: ASAP
  • Forma współpracy: kontrakt B2B, stabilne i długofalowe zaangażowanie
  • Język angielski: wymagany na poziomie zaawansowanym (C1) — codzienna współpraca w międzynarodowym środowisku
  • Sektor: FMCG

Zakres zadań

  • Projektowanie i rozwój platformy Monitoring & Observability dla środowiska Azure/data platform
  • Monitoring aplikacji, infrastruktury i Kubernetes/AKS oraz konfiguracja alertingu
  • Analiza metryk, logów i trace’ów, troubleshooting oraz root cause analysis
  • Budowanie mechanizmów proaktywnego wykrywania problemów i anomalii
  • Dbanie o reliability, availability, stability i performance środowisk produkcyjnych
  • Automatyzacja procesów operacyjnych oraz rozwój Infrastructure as Code i CI/CD
  • Udział w incident management oraz wdrażaniu praktyk Site Reliability Engineering
  • Optymalizacja wykorzystania zasobów i kosztów Azure (FinOps)

Oczekiwania

  • Minimum 5 lat doświadczenia w obszarze Site Reliability Engineering, DevOps lub Cloud Engineering, w tym doświadczenie na stanowisku SRE
  • Bardzo dobra znajomość Microsoft Azure oraz doświadczenie w pracy z infrastrukturą produkcyjną
  • Praktyczna znajomość Kubernetes, w szczególności Azure Kubernetes Service (AKS)
  • Doświadczenie z Kafka, w szczególności Kafka on AKS
  • Bardzo dobra znajomość narzędzi Monitoring & Observability, w szczególności Grafana Enterprise/Grafana Cloud, Prometheus, Loki i Thanos
  • Doświadczenie w pracy z metrykami, logami i trace’ami, tworzeniu dashboardów oraz konfiguracji alertingu
  • Dobra znajomość praktyk SRE, w tym incident management, troubleshooting, root cause analysis oraz performance monitoring i optimization
  • Doświadczenie z Infrastructure as Code, w szczególności Terraform
  • Praktyczna znajomość CI/CD, w szczególności GitHub Actions i/lub Azure DevOps/ADO Pipelines
  • Umiejętność automatyzacji z wykorzystaniem Python i Shell scripting

Mile widziane

  • Znajomość Databricks
  • Doświadczenie z Azure SQL Server
  • Znajomość Fivetran
  • Znajomość Apache Flink

Oferujemy

  • Długofalową, stabilną współpracę w oparciu o kontrakt B2B
  • Szansę na rozwój w dużej strukturze i bezpośredni kontakt z Managerem zespołu
  • Współpracę z ekspertami w dojrzałym, globalnym środowisku IT, w którym respektowane są metodyki zwinne
  • Dopłatę do karty MultiSport oraz ubezpieczenia
  • Sprawny proces rekrutacyjny: wideokonferencja i maksymalnie 2 spotkania online — pierwsze z osobą z zespołu, drugie z Managerem

Similar jobs you might like