Nebius is seeking a Site Reliability Engineer to build and run the Network infrastructure for a global AI cloud platform. You will set reliability targets, create tooling, and automate operations to scale safely.
Responsibilities include defining SLIs/SLOs, driving improvements across inter-site connectivity, owning incident responses, and evolving observability. Strong Linux, networking, and automation skills are required.
#J-18808-Ljbffr