AI/ML Platform Cloud Infrastructure Engineer | Branża farmaceutyczna
Edge One Solutions Sp. z o.o.
AI/ML Platform Cloud Infrastructure Engineer | Branża farmaceutyczna
Miejsce pracy: Kraków
Technologie, których używamy
Wymagane
- Google Cloud Platform
- Terraform
- HCL
- GitHub Actions
Mile widziane
- Compute Engine
- GKE Node Pools
- Kubernetes
- GKE
- Kubernetes Autoscaling Runner Controller
- Managed Instance Groups
- Slurm
O projekcie
Klient to to globalna organizacja działająca w sektorze farmaceutycznym i rozwijająca zaawansowane rozwiązania technologiczne wspierające obszary związane ze zdrowiem i nauką.
O projekcie
Dołączysz do nowego, długoterminowego projektu, którego celem jest rozwój i utrzymanie skalowalnej platformy AI/ML stanowiącej fundament jednego z kluczowych produktów klienta.
Rola koncentruje się na infrastrukturze chmurowej w Google Cloud Platform, ze szczególnym naciskiem na środowiska GPU wykorzystywane przez obciążenia AI/ML. Będziesz pracować również nad automatyzacją infrastruktury, platformą CI/CD, zaawansowaną architekturą sieciową oraz governance środowiska obejmującego ponad 50 projektów GCP.
Tak organizujemy naszą pracę
Tak pracujemy
- wewnątrz organizacji
- możesz zmienić projekt
- agile
Twój zakres obowiązków
- Projektowanie wdrażanie i utrzymywanie infrastruktury GPU dla obciążeń AI/ML w GCP
- Rozwijanie skalowalnej i bezpiecznej platformy AI/ML
- Tworzenie oraz utrzymywanie infrastruktury jako kodu z wykorzystaniem Terraform
- Zarządzanie środowiskiem obejmującym ponad 50 projektów GCP
- Rozwijanie governance polityk organizacyjnych kontroli dostępu audytu oraz monitoringu
- Budowa i utrzymanie platformy GitHub Actions Self-Hosted Runners
- Projektowanie skalowalnych środowisk runnerów działających na VM oraz GKE
- Projektowanie i rozwój zaawansowanej architektury sieciowej w Google Cloud
- Automatyzacja wdrożeń infrastruktury oraz integracja narzędzi IaC z procesami CI/CD
- Zapewnienie wysokich standardów bezpieczeństwa zgodności niezawodności i kontroli kosztów
- Planowanie dostępności zasobów GPU oraz zarządzanie limitami i zapotrzebowaniem
- Diagnozowanie problemów infrastrukturalnych i sieciowych
- Współpraca z zespołami technicznymi oraz interesariuszami biznesowymi
- Raportowanie postępów i przygotowywanie dokumentacji technicznej
Nasze wymagania
- Praktyczne doświadczenie w projektowaniu i utrzymaniu infrastruktury GPU dla obciążeń AI/ML w Google Cloud Platform
- Znajomość GPU NVIDIA A100 H100 L4 lub T4
- Doświadczenie w konfiguracji GPU w Compute Engine lub GKE Node Pools
- Umiejętność automatyzacji instalacji sterowników GPU bibliotek CUDA oraz środowisk runtime
- Doświadczenie w zarządzaniu limitami GPU planowaniu dostępności zasobów i capacity planningu
- Bardzo dobra znajomość Terraform i języka HCL wykorzystywanych w dużych środowiskach produkcyjnych
- Doświadczenie w tworzeniu modułów Terraform zarządzaniu remote state dynamic blocks lifecycle rules oraz integracji IaC z pipeline’ami CI/CD
- Znajomość narzędzi Terragrunt tflint tfsec oraz Infracost
- Bardzo dobra znajomość Google Cloud Platform oraz pracy w środowiskach multi-project
- Doświadczenie w obszarze GCP IAM Organization Policies centralnego audytu monitoringu billing management oraz cost controls
- Praktyczna znajomość GitHub Actions oraz projektowania self-hosted runners w GCP
- Doświadczenie z runnerami wdrażanymi na VM lub GKE w tym autoscalingiem ephemeral runners i środowiskami multi-tenant
- Zaawansowana znajomość sieci w GCP obejmująca VPC DNS Cloud NAT VPC Service Controls HA VPN Cloud Interconnect oraz BGP
- Umiejętność diagnozowania problemów sieciowych z wykorzystaniem VPC Flow Logs Connectivity Tests i Firewall Insights
- Znajomość Kubernetes lub GKE
- Doświadczenie w automatyzacji CI/CD oraz wdrażaniu mechanizmów plan-review gates i approval workflows
- Swoboda w komunikacji w języku angielskim
- Samodzielność ownership oraz security-first mindset
- Umiejętność współpracy z interesariuszami planowania pracy i tworzenia dokumentacji technicznej
Mile widziane
- Doświadczenie z Kubernetes Autoscaling Runner Controller
- Znajomość Managed Instance Groups i autoscalingu sterowanego webhookami
- Doświadczenie w integracji infrastruktury GPU ze Slurm
- Praktyka w budowaniu rozwiązań zgodnych z wymaganiami compliance i governance
- Doświadczenie w optymalizacji kosztów infrastruktury chmurowej i GPU
To oferujemy
- Zyskujesz indywidualne wsparcie Service Delivery Managera, który pomoże Ci zaplanować ścieżkę kariery i zadba o Twój komfort i satysfakcję z pracy w projekcie
- Szkolenia, certyfikaty i konferencje - dofinansowujemy lub w pełni pokrywamy koszty rozwoju kompetencji technicznych
- SmartChange – umożliwiamy zmianę projektu i dobieramy kolejny zgodnie z Twoimi preferencjami
- Dbamy o Twój work-life balance, dlatego poza pracą oferujemy wyjścia integracyjne, aktywności sportowe i inspirujące webinary #edge1talks, które rozwijają i łączą ludzi
- Aktywność fizyczna – wspieramy sportowe inicjatywy i wynajem sal treningowych
- Pakiet zdrowotny – prywatna opieka, karta sportowa, ubezpieczenie i wsparcie psychologiczne
- Elastyczne benefity – sam decydujesz, na co przeznaczasz punkty w naszym systemie benefitowym
Tak pracujemy nad projektem
- dokumentacja
- narzędzia do trackowania zadań
- zarządzanie długiem technologicznym
Takie dajemy możliwości rozwoju
- budżet rozwojowy
- konferencje w Polsce
- szkolenia wewnątrzfirmowe
- szkolenia zewnętrzne
Benefity
- dofinansowanie zajęć sportowych
- prywatna opieka medyczna
- ubezpieczenie na życie
- możliwość pracy zdalnej
- elastyczny czas pracy
- wsparcie psychologiczne
- lekcje języka angielskiego
Etapy rekrutacji
- Nie podano szczegółów w ofercie.
Nie spełniasz wszystkich wymagań, a projekt Cię zainteresował?
Nie wahaj się i aplikuj. Porozmawiajmy!
Edge One Solutions Sp. z o.o.
Społeczność Edge One Solutions powstała z miłości do nowych technologii. Liczymy ponad 350 ekspertów, a w Grupie Euvic, której jesteśmy częścią, jest nas już 5500. Indywidualne podejście pozwala na dopasowanie projektów do umiejętności, przez co realnie wspieramy się w rozwoju kompetencji.
Administratorem Danych Osobowych w rozumieniu Rozporządzenia Parlamentu Europejskiego i Rady (UE) 2016/679 z 27.04.2016 w sprawie ochrony osób fizycznych w związku z przetwarzaniem danych osobowych i w sprawie swobodnego przepływu takich danych oraz uchylenia dyrektywy 95/46/WE („RODO") jest Edge One Solutions Sp. z o.o. z siedzibą w Warszawie (02-305) Aleje Jerozolimskie 132. Aby skontaktować się z nami, wyślij wiadomość pod e-mail: Wyświetl e-mail na pracuj.pl lub zadzwoń pod numer tel. +48 Wyświetl numer telefonu na pracuj.pl. Szczegóły dotyczące przetwarzania Twoich danych oraz przysługujących Ci praw możesz przeczytać na stronie: Wszelką korespondencję dotyczącą danych osobowych należy kierować pod adres e-mail:Wyświetl e-mail na pracuj.pl. Wszelką korespondencję na tematy związane z rekrutacją prosimy kierować na adres: Wyświetl e-mail na pracuj.pl. Przesłane dane osobowe przetwarzane będą w celu prowadzenia procesu rekrutacji przez Edge One Solutions Sp. z o.o.
*Jeśli chcesz brać udział w przyszłych rekrutacjach, dopisz to w swoim zgłoszeniu „Wyrażam zgodę na przetwarzanie przez Edge One Solutions podanych danych w celu prowadzenia przyszłych rekrutacji zgodnie z art.6 ust.1 lit. a RODO”.
Aby cofnąć zgodę na prowadzenie przyszłych procesów rekrutacyjnych napisz żądanie na adres: Wyświetl e-mail na pracuj.pl