Unknown Company

Site Reliability Engineer (SRE)

los angeles, ca • Posted 6 days ago
Onsite Full Time IT & Technology

Opis projektu:

Rozwój i utrzymanie infrastruktury chmurowej oraz lokalnej dla międzynarodowej firmy z sektora telekomunikacyjnego. Praca z narzędziami monitorującymi takimi jak Zabbix, Site 24×7, Azure Monitor, Grafana i Prometheus w celu zapewnienia stabilności i wydajności systemów.

Wymagania:

  • Minimum 1 rok doświadczenia na podobnym stanowisku
  • Doświadczenie z platformą Microsoft Azure i jej usługami będzie dodatkowym atutem
  • Doświadczenie w rozwiązywaniu problemów wydajnościowych
  • Znajomość różnych komponentów chmurowych (AKS, Azure Front Door, Application Gateway, NSG, Azure Firewall, Service Bus, VPN Gateway)
  • Głęboka znajomość systemów operacyjnych serwerowych, w tym Windows Server 2022 i Linux
  • Biegłość w używaniu narzędzi monitorujących (Zabbix, Azure Monitor, Site 24×7, Prometheus, Grafana)
  • Znajomość języków zapytań (Kusto Query Language) i narzędzi automatyzacji (Logic Apps)
  • Doświadczenie z MS SQL i Azure SQL
  • Doświadczenie z narzędziami IaC (Terraform, ARM templates, Ansible, DSC)

Zakres obowiązków:

  • Monitorowanie i wsparcie środowisk chmurowych Azure oraz lokalnych, szybkie reagowanie na incydenty
  • Ciągłe doskonalenie funkcji monitorowania w firmie
  • Generowanie raportów SLA i zapewnienie zgodności z umowami o poziomie usług
  • Optymalizacja infrastruktury w celu zwiększenia stabilności i wydajności
  • Ścisła współpraca z zespołami infrastruktury, administratorami baz danych, DevOps i TechOps w celu poprawy ogólnej niezawodności systemów

#J-18808-Ljbffr
Back to Job Search