HighPerformance Computing ( HPC) Administrator

VIT

Chennai District

On-site

INR 900,000 - 1,300,000

Full time

7 days ago
Be an early applicant
Application generator

Stand out for this role — generate a tailored resume and cover letter in about a minute.

Get past ATS filters

Job summary

VIT in Chennai seeks an experienced HPC Administrator to manage and optimize our high-performance computing infrastructure, enabling researchers and data scientists to run compute-heavy workloads efficiently.

You will install and maintain clusters, manage schedulers, ensure security and reliability, and collaborate with researchers to tune applications for HPC environments.

The role emphasizes scripting, automation, and documentation to keep systems robust and scalable.

Qualifications

  • 1-3 years of Linux system administration experience, preferably in HPC environments.
  • Strong knowledge of Linux OS (RHEL, CentOS, Ubuntu).
  • Experience with HPC workload managers (Slurm, PBS, Torque).
  • Familiarity with MPI, OpenMP, CUDA, or GPU computing.
  • Knowledge of networking (InfiniBand, high-speed interconnects).
  • Hands-on experience with monitoring tools (Nagios, Ganglia, Prometheus).
  • Proficiency in scripting and automation (Bash, Python, Ansible).

Responsibilities

  • Install, configure, and maintain HPC clusters, nodes, and associated hardware.
  • Manage job scheduling systems (e.g., Slurm, PBS, Torque, Grid Engine).
  • Monitor cluster performance, troubleshoot issues, and optimize resource utilization.
  • Implement and maintain storage solutions (parallel file systems like Lustre, GPFS, BeeGFS).
  • Ensure system security, patching, and compliance with organizational policies.
  • Support users in running scientific, engineering, and AI/ML workloads.
  • Automate administrative tasks using scripting (Bash, Python, Ansible).
  • Collaborate with researchers to optimize applications for HPC environments
  • Maintain documentation for system architecture, processes, and best practices.
  • Plan and execute upgrades, expansions, and performance tuning.
  • Provide training and technical support to endusers.

Skills

Linux administration
HPC environments
Slurm / PBS / Torque
MPI / OpenMP / CUDA
Networking InfiniBand
Scripting Bash / Python
Automation Ansible
Containerization Singularity

Education

Bachelor’s or Master’s in CS/Engineering
Certifications: RHCE / CompTIA Linux+ / LPIC / HPC training

Tools

Slurm
PBS
Torque
MPI
OpenMPI
CUDA
Singularity
Docker
Kubernetes
Ansible
Nagios
Prometheus

Job description

Job Summary

We are seeking an experienced HPC Administrator to manage, optimize, and support our highperformance computing infrastructure. This role involves maintaining largescale clusters, ensuring system reliability, and enabling researchers, engineers, and data scientists to run computeintensive workloads efficiently.

Key Responsibilities
  • Install, configure, and maintain HPC clusters, nodes, and associated hardware.
  • Manage job scheduling systems (e.g., Slurm, PBS, Torque, Grid Engine).
  • Monitor cluster performance, troubleshoot issues, and optimize resource utilization.
  • Implement and maintain storage solutions (parallel file systems like Lustre, GPFS, BeeGFS).
  • Ensure system security, patching, and compliance with organizational policies.
  • Support users in running scientific, engineering, and AI/ML workloads.
  • Automate administrative tasks using scripting (Bash, Python, Ansible).
  • Collaborate with researchers to optimize applications for HPC environments
  • Maintain documentation for system architecture, processes, and best practices.
  • Plan and execute upgrades, expansions, and performance tuning.
  • Provide training and technical support to endusers.
Required Skills & Qualifications
  • 1-3 years of experience in Linux system administration, preferably in HPC environments.
  • Strong knowledge of Linux operating systems (RHEL, CentOS, Ubuntu).
  • Experience with HPC workload managers (Slurm, PBS, Torque).
  • Familiarity with MPI, OpenMP, CUDA, or GPU computing.
  • Knowledge of networking (InfiniBand, highspeed interconnects).
  • Handson experience with monitoring tools (Nagios, Ganglia, Prometheus).
  • Proficiency in scripting and automation (Bash, Python, Ansible).
  • Experience with containerization (Singularity, Docker) in HPC contexts.
  • Implement resource scheduling and workload management tools (Slurm, Kubernetes GPU scheduling).
  • Strong troubleshooting and performance optimization skills.
Education & Certifications
  • Bachelors or Masters degree in Computer Science, Engineering, or related field.
  • Certifications such as RHCE, CompTIA Linux+, LPIC, or HPCspecific training preferred.
Desired Attributes
  • Ability to work closely with researchers and technical teams.
  • Strong analytical and problemsolving skills.
  • Commitment to system reliability and performance.
  • Adaptability to emerging HPC technologies (cloud HPC, AI/ML workloads).
Get your free, confidential resume review.
or drag and drop your file here.
Similar jobs

Similar jobs worth comparing

Cognizant Hiring For Sr. HPC Engineer
Cognizant Hiring For Sr. HPC Engineer

Cognizant • Pune District, Chennai District, Bengaluru

On-site
INR 3,000,000 - 6,000,000
Sr. HPC ENGINEER
Sr. HPC ENGINEER

Cognizant • Hyderabad

On-site
INR 800,000 - 1,200,000
Linux System Administrator
Linux System Administrator

SISL Global • Chennai District

On-site
INR 800,000 - 1,200,000
HPC Senior System Integrator/System Administrator
HPC Senior System Integrator/System Administrator

GBB • Mumbai

On-site
INR 1,000,000 - 1,500,000
Staff Data Engineer (HPC cluster software such as Slurm, NC, LSF or Grid Engine) experience wit[...]
Staff Data Engineer (HPC cluster software such as Slurm, NC, LSF or Grid Engine) experience wit[...]

SanDisk • Bengaluru

On-site
INR 3,000,000 - 5,000,000
Senior HPC Engineer
Senior HPC Engineer

Binaire Private Limited • New Delhi

On-site
INR 1,500,000 - 2,500,000
Opportunity to influence hardware selection
Ownership of high-performance compute infrastructure
Service Delivery Manager - HPC & ITIL/ITSM
Service Delivery Manager - HPC & ITIL/ITSM

Epam Systems • Hyderabad, Chennai District, Bengaluru

On-site
INR 1,800,000 - 3,200,000
HPC Admin
HPC Admin

5 Star Recruitment • Chennai District

On-site
INR 2,000,000 - 4,000,000
Lead HPC Engineer
Lead HPC Engineer

Clovertex • Hyderabad

On-site
INR 2,000,000 - 3,000,000
HPC Cloud Engineer
HPC Cloud Engineer

5 Star Recruitment • Chennai District

On-site
INR 1,500,000 - 3,500,000