Apply

Ready to go for it?

AI Apply speeds things up—apply directly if you prefer.

FREE ACCESS
5,000–10,000 jobs/day
Scoutfield Logo

See all jobs on Scoutfield

Search thousands of fresh jobs every day.

Discover
  • Fresh listings
  • Fast filters
  • No subscription required
Create a free account and start exploring right away.
MARGO

Senior Linux, HPC Infrastructure Engineer

MARGO

. Utrzymanie i rozwój infrastruktury Linux oraz klastrów HPC/GPU .

Posted 10/8/2026full-timeRemote • FranceSenior💰 PLN 200 - PLN 250 per hourWebsite

Core Competencies

Role fit
Core Competencies

Use this summary to align your resume positioning with the role.

Proficient in maintaining and developing Linux infrastructure, particularly Debian-like systems, with strong experience in HPC and GPU clusters. Capable of diagnosing and resolving system, network, and performance issues while automating infrastructure management and enhancing monitoring solutions.

Highest-signal resume keywords
Linux AdministrationHPC Cluster ManagementAnsible AutomationNetwork TroubleshootingMonitoring Tools (Prometheus, Grafana)

ATS Keywords

Tailor your resume
Applicant Tracking System Keywords

Tip: use these terms in your resume and cover letter to boost ATS matches.

Hard Skills
Linux (Debian-like)Bash ScriptingPython ScriptingData Center InfrastructureTCP/IP NetworkingInfiniBandRDMASLURMNVIDIA TechnologiesDistributed File Systems (Lustre, Ceph)
Soft Skills
Problem SolvingTeam CollaborationEffective Communication
Tools & Technologies
AnsibleGitPrometheusGrafanaGitLab CI/CDNVIDIA Container Toolkit
Industry Keywords
HPCGPU InfrastructureData Center NetworkingSystem MonitoringIncident Resolution

Tech Stack

Tools & technologies
AnsibleDNSGrafanaLinuxPrometheusTCP/IP

About the role

Key responsibilities & impact
  • Utrzymanie i rozwój infrastruktury Linux oraz klastrów HPC/GPU
  • Diagnozowanie i rozwiązywanie produkcyjnych problemów systemowych, sprzętowych i sieciowych
  • Automatyzacja konfiguracji i zarządzania infrastrukturą
  • Rozwijanie monitoringu i poprawianie stabilności środowiska
  • Współpraca przy wdrożeniach i rozwiązywaniu incydentów
  • Dokumentowanie rozwiązań i usprawnianie codziennej pracy
  • Praca z fizycznymi serwerami, sieciami Data Center i technologiami NVIDIA
  • Praca w około 10-osobowym zespole operacyjnym SRE i projektowym, w Scrumie oraz bezpośredniej komunikacji

Requirements

What you’ll need
  • Bardzo dobra znajomość Linuxa Debian-like i doświadczenie z systemami produkcyjnymi
  • Doświadczenie z bare-metal i infrastrukturą Data Center
  • Dobra znajomość sieci (TCP/IP, DNS, VLAN, routing)
  • Umiejętność samodzielnego diagnozowania problemów systemowych, sieciowych i wydajnościowych
  • Znajomość Ansible, Git oraz umiejętność pisania skryptów w Bashu i Pythonie
  • Doświadczenie z monitoringiem i narzędziami diagnostycznymi
  • Angielski pozwalający na swobodną codzienną komunikację
  • Doświadczenie z HPC, klastrami obliczeniowymi lub infrastrukturą GPU
  • Znajomość technologii NVIDIA (Cumulus, DCGM, NCCL, NHC, NVIDIA Container Toolkit)
  • Znajomość InfiniBand, RDMA, SLURM
  • Doświadczenie z Prometheus, Grafana, GitLab CI/CD
  • Doświadczenie z rozproszonymi i klastrowymi systemami plików (Lustre, Ceph)

Benefits

Comp & perks
  • Pracę z dużymi klastrami GPU i infrastrukturą AI/HPC
  • Sporo samodzielności i realny wpływ na to, jak działa infrastruktura
  • Bezpośrednią współpracę z doświadczonymi inżynierami i Tech Leadem
  • Możliwość poznania i rozwijania się w technologiach HPC/AI GPU
  • Krótką ścieżkę decyzyjną, bez zbędnych formalności