ვაკანსიებზე დაბრუნება

Senior Site Reliability Engineer

  • Tbilisi

როლი პასუხისმგებელია პროდაქშენში ინციდენტების გამოძიებასა და სერვისების საიმედოობის გაუმჯობესებაზე. გუნდი მუშაობს სერვისების გაშვებაზე და ოპერირებაზე, მონიტორინგისა და ავტომატიზაციის სისტემებთან ერთად.

რას გააკეთებთ

  • პროდაქშენ ინციდენტების გამოძიება და გადაწყვეტამდე მიყვანა
  • RCA შესრულება და პოსტმორტემებში მონაწილეობა
  • მონიტორინგისა და ალერტინგის გაუმჯობესება სერვისებისთვის
  • SLI/SLO განსაზღვრა და საიმედოობის მეტრიკების ანალიზი
  • ონქოლ როტაციებში მონაწილეობა და რთული ინციდენტების მხარდაჭერა

ვის ეძებენ

  • SRE ან მსგავს როლში მუშაობის გამოცდილება
  • პროდაქშენ ინციდენტების გამოძიებისა და RCA გამოცდილება
  • მონიტორინგის, ალერტინგის და ობსერვაბილიტის ცოდნა
  • SLA, SLI, SLO და error budget კონცეფციების ცოდნა
  • დისტრიბუციული სისტემებისა და high-load გარემოს გაგება

უნარები

  • SLA
  • SLI
  • SLO
  • Prometheus
  • Grafana
  • OpenTelemetry
  • CKA
  • CKAD

შეჯამება მოამზადა StartupJobs-მა კომპანიის ვაკანსიის მიხედვით. სრული ვაკანსია კომპანიის საიტზეა.

ეს ვაკანსია TradingView კომპანიის კარიერის გვერდიდანაა. ბმული პირდაპირ წყაროზე მიდის.

განაცხადის გაგზავნა კომპანიის საიტზე