Senior Site Reliability Engineer (f / m/x)
Białystok, Polska, Bydgoszcz, Polska, Kraków, Polska +9Najważniejsze cechy oferty
Min. 5 lat doświadczenia
DevOps / Cloud: AWS, Azure, Docker, Kubernetes
Pełny etat
Praca zdalna - bez dojazdów
Prywatna opieka medyczna
Opis
Szukamy doświadczonego Senior Site Reliability Engineer, który dołączy do naszego zespołu, aby projektować, budować i obsługiwać produktową, wysoko zautomatyzowaną wielochmurową platformę provisioningową. W tej roli będziesz pełnić funkcję kluczowego autorytetu technicznego, napędzając automatyzację i definiując standardy niezawodności, jednocześnie mentorując zespół inżynierski. Jeśli pasjonujesz się doskonałością inżynierską i niezawodnością systemów, ta oferta może być dla Ciebie odpowiednia.
Benefity
Great Place to Work
Stabilna sytuacja finansowa
Kontrakty z globalnymi markami
Centrum szkoleń wewnętrznych
Wielu ekspertów, od których możesz się uczyć
Otwarty i dostępny zarząd
Profit sharing
Program Sponsoringu Pasji
Cykliczne imprezy i wyjazdy integracyjne
Komfortowe i dobrze wyposażone biura
Aplikacja MySii
Opieka medyczna
Wymagania
Minimum 8 lat praktycznego doświadczenia w inżynierii oprogramowania, DevOps lub infrastrukturze systemowej
Co najmniej 3 lata zaawansowanej wiedzy z AWS, w tym projektowanie i rozwiązywanie problemów w środowiskach chmurowych
Udokumentowane doświadczenie w zarządzaniu, skalowaniu i udostępnianiu klastrów Kubernetes w środowisku produkcyjnym
Samodzielność w podejmowaniu decyzji architektonicznych oraz dostarczaniu gotowej do produkcji, zautomatyzowanej infrastruktury bez codziennego nadzoru
Dobre umiejętności komunikacji technicznej z możliwością współpracy z Technical Leads i zespołami inżynierskimi
Język angielski na poziomie zaawansowanym oraz zamieszkanie w Polsce
Zakres obowiązków
Projektowanie i rozwijanie niezawodności, skalowalności i wydajności naszej wielochmurowej platformy provisioningowej we wszystkich środowiskach produkcyjnych
Wdrażanie kompleksowych pipeline'ów automatyzacji w celu wyeliminowania ręcznej interwencji i zmniejszenia nakładu pracy technicznej
Definiowanie, monitorowanie i ulepszanie kluczowych wskaźników zdrowia systemu (SLI/SLO) w celu podejmowania decyzji architektonicznych opartych na danych
Współpraca z zespołami produktowymi i międzyfunkcyjnymi w celu wczesnego uwzględniania niezawodności i bezpieczeństwa w cyklu życia oprogramowania (SDLC)
Projektowanie solidnych mechanizmów wykrywania incydentów, triage krytycznych incydentów oraz prowadzenie dogłębnej analizy przyczyn źródłowych (RCA) w celu wdrażania długoterminowych rozwiązań zapobiegawczych
Audyt operacji platformy w celu identyfikacji wąskich gardeł, eliminacji pojedynczych punktów awarii oraz redukcji złożoności strukturalnej