Utwórz profil, aby pracodawcy mogli Cię znaleźć, otrzymywać lepiej dopasowane oferty pracy i szybciej aplikować.
  • Wyszukiwanie ofert pracy
  • Zapisane
  • Stwórz CV
    Nowe
  • Wynagrodzenia
  • Subskrypcje

ML/AI Infrastructure Engineer

180 - 190 zł / stawka godzinowa

SQUARE ONE RESOURCES sp. z o.o.

ML/AI Infrastructure Engineer

Miejsce pracy: Warszawa

Technologie, których używamy

Wymagane

  • GPU
  • Ansible
  • Terraform
  • Linux
  • Kubernetes
  • Slurm
  • HPC

System operacyjny

  • Linux

O projekcie

Dołącz do projektu, którego celem jest budowa nowoczesnej infrastruktury AI/ML opartej na GPU. Będziesz mieć realny wpływ na projektowanie, wdrażanie i rozwój środowisk High Performance Computing (HPC), wykorzystywanych do trenowania modeli sztucznej inteligencji oraz realizacji zaawansowanych obliczeń.

Twój zakres obowiązków

  • Projektowanie, wdrażanie i rozwój środowisk HPC.
  • Budowa oraz administracja klastrami GPU dla obciążeń AI/ML.
  • Zarządzanie i optymalizacja środowisk opartych o Linux i Kubernetes.
  • Konfiguracja oraz administracja schedulerem Slurm.
  • Wdrażanie i utrzymanie wydajnych systemów storage (Ceph i/lub Lustre).
  • Optymalizacja wydajności infrastruktury oraz profilowanie aplikacji HPC.
  • Monitoring, diagnozowanie i rozwiązywanie problemów w środowiskach produkcyjnych.
  • Automatyzacja wdrożeń z wykorzystaniem Ansible i Terraform.
  • Współpraca z zespołami odpowiedzialnymi za rozwiązania AI oraz infrastrukturę centrów danych.

Nasze wymagania

  • Praktyczne doświadczenie w projektowaniu i administracji środowisk HPC.
  • Bardzo dobra znajomość systemu Linux.
  • Bardzo dobra znajomość Kubernetes.
  • Doświadczenie z systemem kolejkowania Slurm.
  • Znajomość technologii InfiniBand.
  • Doświadczenie z systemami plików Ceph i/lub Lustre.
  • Umiejętność optymalizacji wydajności infrastruktury oraz aplikacji HPC.
  • Umiejętność diagnozowania problemów w środowiskach o wysokiej dostępności.

Mile widziane

  • Doświadczenie z platformami GPU dla AI.
  • Znajomość NVIDIA AI Enterprise.
  • Doświadczenie z GPUaaS lub Run.
  • Znajomość Ansible i Terraform.
  • Doświadczenie w automatyzacji oraz Infrastructure as Code.
  • Wiedza z zakresu monitoringu i wydajności środowisk produkcyjnych.

Tak organizujemy naszą pracę

Tak pracujemy

  • u klienta

To oferujemy

  • Praca w pełni zdalnie
  • Zatrudnienie na B2B
  • Długoterminowa współpraca

Benefity

  • dofinansowanie zajęć sportowych
  • prywatna opieka medyczna

SQUARE ONE RESOURCES sp. z o.o.

At Square One Poland we link IT experts with the business. With over 25 years of experience, we specialize in recruitment processes on a global scale. Despite years of experience, we still have a startup DNA and this is our advantage. Our offices are located in London and Warsaw, however, we can reach clients from all over the world, from start-ups to big worldwide corporations.

Oferta pracy dodana 14 dni temu