
Santa Clara, California • Yesterday WHAT THIS CANDIDATE WILL BE DOING Administer large-scale Linux environments supporting AI training, inference, and HPC workloads. Own deep troubleshooting of OS, kernel, boot, package, firmware, driver, filesystem, service, and resource-consumption issues across bare-metal server fleets. Diagnose failures across BIOS, BMC, PXE, DHCP, DNS, NFS, local disk, RAID,NVMe,systemd, and GPU driver stacks. Build andmaintaingolden images, provisioning pipelines, configuration baselines, and post-deployment
Easy Apply
Contract
50 - 60