Inżynierka / Inżynier SRE - Automatyzacja Operacyjna
Warszawa, Polska, mazowieckie, PolskaNajważniejsze cechy oferty
Min. 3 lata doświadczenia
Wymagana niekaralność
DevOps / Cloud: AWS, Azure, Docker, Kubernetes
Model hybrydowy - część pracy zdalnie
Pełny etat
Dział
IT
Oferujemy
Możliwość rozwoju w #świeciebardziejvelo - opartym na innowacji, przywództwie, zaufaniu, inicjatywie i wspólnym sukcesie.😊
Bezpieczeństwo finansowe - zatrudnienie w oparciu o umowę o pracę, wzbogacone kwartalnym systemem premiowym.
Zwinną, nowoczesną organizację pracy nastawioną na współpracę, efekty i szybkie wdrażanie dobrych pomysłów.
VeloActive – wspieramy aktywny tryb życia poprzez inicjatywy sportowe, m.in. grupę rowerową i biegową, które integrują, tworzą społeczności i pomagają dbać o zdrowie oraz dobrą energię każdego dnia. 🚲
Udział w inicjatywach społecznych wspierających odpowiedzialność organizacji- m.in. inicjatywa „Sadzimy i chronimy razem #VeloLas”. 🌲
Program wellbeingowy z bezpłatnym wsparciem psychologicznym, prawnym, finansowym i coachingowym realizowany przy pomocy platformy Mindgram. Dodatkowe inicjatywy jak społeczność #VeloBeing - Dobre Życie, której misją jest ambasadorstwo na rzecz dobrego życia, a także WellBeing Officerowie, czyli grupa pierwszego kontaktu i wsparcia w trudnych momentach.
Program opieki zdrowotnej dla pracowniczek, pracowników i ich rodzin, ubezpieczenie na życie, kartę sportową. ☺️
Możliwość nauki języka angielskiego, niemieckiego i włoskiego na platformie internetowej eTutor.
Pracę w systemie hybrydowym – 1/2 dni w biurze tygodniowo. 💻
Atrakcyjną ofertę pracowniczą na produkty bankowe #velobank.
Wymagania
Minimum 2–3 lata doświadczenia w administracji systemami, DevOps, automatyzacji operacyjnej, SRE lub pracy przy środowiskach produkcyjnych.
Doświadczenie w utrzymaniu systemów produkcyjnych o wysokiej dostępności.
Doświadczenie w pracy z incydentami produkcyjnymi oraz dyżurami technicznymi.
Bardzo dobra znajomość Jenkins CI/CD, w tym samodzielne tworzenie, rozwijanie i utrzymywanie złożonych pipeline’ów jako kodu.
Praktyczne doświadczenie z Ansible, w tym tworzenie playbooków, ról, inventory i wzorców automatyzacji gotowych do utrzymania przez zespół.
Podstawowa znajomość baz PostgreSQL.
Dobra znajomość Linux.
Praktyczna znajomość Kubernetes / OpenShift na poziomie pracy z aplikacjami produkcyjnymi: analiza stanu workloadów, logów, zdarzeń, konfiguracji i podstawowych problemów uruchomieniowych.
Podstawowa znajomość Microsoft Azure lub gotowość do rozwoju w tym obszarze, szczególnie w kontekście integracji, automatyzacji i usług wspierających środowiska produkcyjne.
Umiejętność samodzielnej analizy logów oraz przyczyn awarii.
Praktyczna znajomość Kibana, Elasticsearch, Graylog lub podobnych rozwiązań.
Znajomość zagadnień observability: logi, metryki, alerting, tracing.
Umiejętność pracy z REST API.
Umiejętność tworzenia narzędzi, skryptów i automatyzacji wspierających pracę operacyjną, z naciskiem na czytelność, prostotę, modularność, ograniczanie duplikacji, review zmian i wersjonowanie w Git.
Umiejętność tworzenia skryptów i prostych narzędzi w Pythonie wspierających diagnostykę, automatyzację operacyjną i integrację z API.
Praktyczna znajomość Git oraz pracy z kodem automatyzacji w modelu zespołowym, obejmująca branche, pull requesty, code review i czytelną historię zmian.
Dobra znajomość: DNS, HTTP/HTTPS, TLS/SSL, Load Balancing, Routing, Firewall / WAF.
Samodzielność w analizie problemów.
Umiejętność podejmowania decyzji podczas incydentów.
Podejście „reduce->simplify->automate” rozumiane jako trwałe zastępowanie powtarzalnej pracy operacyjnej kodem, pipeline’ami i playbookami, które są czytelne, testowalne i możliwe do utrzymania przez cały zespół.
Myślenie systemowe.
Chęć ograniczania pracy manualnej poprzez standaryzację i automatyzację, budowanie narzędzi, które zmniejszają liczbę powtarzalnych zadań wykonywanych ręcznie podczas utrzymania, wdrożeń i obsługi incydentów.
Umiejętność współpracy z programistami i biznesem.
Dbałość o bezpieczeństwo danych i zgodność z procedurami bankowymi.
Na etapie finalizacji procesu rekrutacji wymagane aktualne zaświadczenie o niekaralności w zakresie przestępstw przeciwko ochronie informacji.
Doświadczenie w bankowości lub sektorze regulowanym
Doświadczenie w wykorzystaniu narzędzi AI w procesach IT
ELK stack (Logstash, Elasticsearch, Kibana)
OpenTelemetry (otel collector, auto-instrumentacja)
Zabbix
Groovy lub Java
Certyfikat AZ-104
Certyfikat AZ-400
Azure DevOps
Grafana
Prometheus
React
PHP
Dynatrace
Terraform
Opis stanowiska
Utrzymanie środowisk bankowości elektronicznej.
Monitorowanie dostępności, wydajności i bezpieczeństwa usług produkcyjnych.
Analiza oraz obsługa incydentów produkcyjnych.
Udział w rotacyjnych dyżurach on-call.
Projektowanie, tworzenie i rozwój automatyzacji operacyjnej jako kodu: pipeline’ów Jenkins, playbooków Ansible, skryptów oraz konfiguracji wersjonowanych w Git, rozwijanych w sposób czytelny, modularny i możliwy do utrzymania przez zespół. Rola nie dotyczy pełnego zarządzania infrastrukturą jako kodem, ale obejmuje pracę z istniejącymi zalążkami tego podejścia, takimi jak Helm charty i Argo CD w wybranych systemach.
Projektowanie, tworzenie i utrzymywanie złożonych pipeline’ów CI/CD w Jenkinsie, w tym pipeline’ów parametryzowanych, wieloetapowych, z obsługą walidacji, rollbacku, kontroli jakości i integracji z narzędziami zewnętrznymi.
Administracja platformami aplikacyjnymi opartymi o serwery Linux lub środowiska konteneryzowane.
Współpraca z zespołami programistycznymi podczas wdrożeń i rozwiązywania problemów produkcyjnych.
Wykorzystywanie narzędzi AI do przyspieszania analizy logów, tworzenia skryptów, dokumentacji, runbooków i podsumowań incydentów - tam, gdzie realnie ogranicza to pracę manualną.
Rozwijanie monitoringu i obserwowalności: alertów, dashboardów, logów, metryk i śladów diagnostycznych, tak aby szybciej wykrywać problemy, ograniczać fałszywe alarmy i skracać czas diagnozy.
Przygotowywanie dokumentacji technicznej, runbooków i procedur operacyjnych.
Udział w analizach post-mortem oraz działaniach zapobiegających powtarzaniu się awarii.
Współpraca z zespołami infrastruktury, sieci, baz danych oraz bezpieczeństwa.