Cloud AWS & Site Reliability Engineer/ka

Když si klient Air Bank otevře aplikaci, očekává, že všechno bude fungovat. Rychle, bezpečně a bez výpadků. Právě o to se starají naše technologické týmy – a nyní hledáme nového kolegu nebo kolegyni do SRE týmu pro věrnostní program Unity.

V roli Cloud AWS & SRE nám pomůže stavět, provozovat a dál rozvíjet cloudové prostředí pro služby s vysokými nároky na dostupnost, bezpečnost a výkon.

Nemusíte být expert na úplně všechno. Důležité je, abyste měli pevný základ v AWS a zkušenosti alespoň s některými oblastmi, jako jsou Kubernetes, automatizace, observabilita, provozní spolehlivost nebo řešení incidentů. Hledáme člověka, který se dokáže samostatně rozhodovat, umí převzít odpovědnost a své řešení srozumitelně vysvětlit, těší se na spolupráci s ostatními a chce cloud prostředí dlouhodobě zlepšovat.

AWS u nás není experiment ani vedlejší projekt. Je to strategické prostředí, které intenzivně rozvíjíme. Budete mít možnost ovlivnit nejen jednotlivé služby, ale také architekturu, automatizaci, provozní standardy a způsob, jakým cloud v rámci Air Bank a Unity používáme.

Co vás u nás čeká?

  • AWS infrastruktura a cloudové služby
    Budete navrhovat, konfigurovat a provozovat služby v AWS. Podle svých zkušeností se můžete věnovat například síťové infrastruktuře, IAM, compute službám, databázím, storage, integračním službám nebo návrhu vysoce dostupných řešení.
  • Site Reliability Engineering
    Pomůžete nám nastavovat prostředí tak, aby bylo stabilní, měřitelné a dlouhodobě udržitelné. Budete pracovat s principy SLI, SLO a error budgetů a řešit kapacitu, výkon, dostupnost i odolnost vůči výpadkům.
  • Amazon EKS a kontejnerové platformy
    Čeká vás práce s Kubernetes v AWS, provoz a rozvoj EKS clusterů i podpora týmů při nasazování kontejnerizovaných aplikací. Budete řešit dostupnost, škálování, konektivitu, bezpečnost i efektivní využití prostředků.
  • Infrastructure as Code a automatizace
    Cloudovou infrastrukturu chceme řídit jako kód. Budete vytvářet a rozvíjet automatizaci pomocí Terraform a dalších nástrojů, odstraňovat ruční kroky a pomáhat budovat opakovatelné a auditovatelné postupy.
  • CI/CD a GitOps
    Budete spolupracovat na bezpečném a automatizovaném doručování změn do cloudového prostředí. Pomůžete nám rozvíjet deployment pipelines, GitOps postupy, automatizované kontroly i řízení konfigurací.
  • Observabilita a proaktivní dohled
    Zapojíte se do rozvoje monitoringu, logování, trasování a alertingu. Cílem není mít co nejvíc alertů, ale správné informace ve správný čas – ideálně dříve, než problém zaznamenají naši klienti.
  • Řešení incidentů a odstraňování jejich příčin
    Když nastane problém, budete ho řešit napříč aplikacemi, Kubernetes, sítí i AWS službami. Po obnovení provozu se zaměříte na skutečnou příčinu, automatizaci nápravy a prevenci opakování. Součástí role bude podle nastavení týmu také pohotovostní podpora kritických služeb.
  • Bezpečnost a odolnost prostředí
    Budete spolupracovat na nastavení přístupů, síťové bezpečnosti, správy tajemství, šifrování, zálohování a disaster recovery. V bankovním prostředí potřebujeme, aby byly bezpečnost a dohledatelnost přirozenou součástí každého řešení.
  • Spolupráce napříč Air Bank a Unity
    Budete v každodenním kontaktu s vývojáři, architekty, aplikační podporou, bezpečností, databázovými i infrastrukturními týmy. Pomůžete nám sjednocovat technické standardy, sdílet know-how a vytvářet cloudovou platformu, která týmům skutečně usnadní práci.

Jak si vás představujeme?

  • Máte praktické, alespoň 2-3 leté zkušenosti s provozem produkčních služeb a návrhem řešení a architektury v AWS.
  • Umíte pracovat s Infrastructure as Code a automatizovat pomocí Terraform a Teragrunt (min. 2 roky praxe).
  • Orientujete se alespoň v části služeb jako EKS, EC2, VPC, IAM, Route 53, Elastic Load Balancing, S3, RDS/Aurora nebo CloudWatch.
  • Rozumíte Linuxu, sítím a provozu distribuovaných aplikací.
  • Máte zkušenosti s Kubernetes a kontejnerizovanými aplikacemi.
  • Rozumíte principům CI/CD a automatizovaného nasazování.
  • Dokážete analyzovat problémy napříč více technologickými vrstvami a hledat jejich skutečnou příčinu.
  • Přemýšlíte nad dostupností, škálováním, bezpečností, výkonem i náklady.
  • Dokážete fungovat samostatně, ale zároveň sdílet informace a spolupracovat s týmem.
  • V produkčním prostředí pracujete pečlivě – změny automatizujete, testujete, měříte a umíte je bezpečně vrátit.
  • Aktivně využíváte AI nástroje při analýze problémů, automatizaci nebo každodenní technické práci.
  • Domluvíte se česky a zvládnete technickou komunikaci v angličtině.

Co oceníme jako výhodu navíc?

  • Zkušenost s migracemi mezi cloudovými platformami, zejména mezi MS Azure a AWS.
  • Návrh AWS prostředí pro větší organizace nebo regulované společnosti (banka, pojišťovna, fintech nebo jiné prostředí s vysokými nároky na dostupnost a bezpečnost).
  • AWS Organizations, Control Tower nebo víceúčtová AWS architektura.
  • GitOps a nástroje jako Argo CD nebo Flux.
  • Prometheus, Grafana, Loki, OpenTelemetry nebo AWS observability služby.
  • Správa identit, IAM, KMS, Secrets Manager a bezpečnostní služby AWS.
  • Automatizované řešení incidentů a provozní runbooky.
  • Disaster recovery, multi-region architektura a pravidelné testování obnovy.
  • Relační i NoSQL databáze a řešení aplikační konektivity.
  • Optimalizace výkonu a cloudových nákladů.
  • Python, Bash, Go nebo jiný jazyk používaný pro automatizaci.

Jak probíhá výběrko?

1.   Pošlete nám svůj životopis a ozve se vám Helča z náborového týmu.

2.   Pokud vše klapne, potkáte se s budoucím šéfem a společně proberete technické detaily možné spolupráce.

3.   Nakonec poznáte další členy týmu a vzájemně si ověříte, jestli vám spolupráce dává smysl.