LLM Efficiency Architect: Cross-Layer Performance Leader

NVIDIA Gruppe

Santa Clara (CA)

Hybrid

USD 184,000 - 357,000

Full time

6 days ago
Be an early applicant
Application generator

Stand out for this role — generate a tailored resume and cover letter in about a minute.

Get past ATS filters

Benefits offered by this job

Equity
Benefits

Job summary

NVIDIA is seeking a strong technical leader to drive a unified strategy for making LLMs more efficient from research through deployment. This role blends model innovation, systems expertise, and hardware awareness to ensure capabilities fit compute, memory, power, and cost constraints.

The candidate will lead a multidisciplinary effort, define the direction for LLM efficiency, and influence future model and computing platform designs.

Qualifications

  • MS or PhD in Computer Science, Electrical Engineering, Computer Engineering, or related field.
  • 5+ years in AI systems, model architecture, computer architecture, HPC, or performance optimization.
  • Strong understanding of LLM architectures, training and inference workloads and tradeoffs.
  • Strong background in performance analysis, roofline modeling, workload characterization, benchmarking and hardware-aware optimization.
  • Proven ability to lead complex optimization projects from concept to production.

Responsibilities

  • Lead cross-layer efforts to improve LLM efficiency across model architecture, training and inference systems.
  • Analyze LLM workloads mapping to GPUs, memory, interconnects, and distributed infrastructure for co-design opportunities.
  • Establish a measurement-driven efficiency roadmap; lead projects from investigation to production deployment.
  • Partner with model researchers, systems engineers, compiler/kernel developers, and hardware architects to shape roadmaps.

Skills

AI systems
Model architecture
Computer architecture
High-performance computing
Performance optimization
Technical leadership

Education

MS or PhD degree

Job description

NVIDIA is seeking a strong technical leader to drive a unified strategy for making LLMs more efficient from research through deployment. This role blends model innovation, systems expertise, and hardware awareness to ensure capabilities fit compute, memory, power, and cost constraints.

The candidate will lead a multidisciplinary effort, define the direction for LLM efficiency, and influence future model and computing platform designs.

Get your free, confidential resume review.
or drag and drop your file here.
Similar jobs

Similar jobs worth comparing

Senior LLM Efficiency Architect — Model-System Optimizer
Senior LLM Efficiency Architect — Model-System Optimizer

NVIDIA • Santa Clara (CA)

Hybrid
USD 184,000 - 357,000
Senior LLM Efficiency Architect: Model Systems Co-Design
Senior LLM Efficiency Architect: Model Systems Co-Design

Nvidia Corporation in • Santa Clara (CA)

Hybrid
USD 184,000 - 357,000
Equity
Benefits
Senior LLM Training Performance Architect
Senior LLM Training Performance Architect

NVIDIA • Santa Clara (CA)

Hybrid
USD 184,000 - 356,500
Equity
Benefits
Lead Architect, High-Performance LLM Training
Lead Architect, High-Performance LLM Training

NVIDIA Gruppe • Santa Clara (CA)

On-site
USD 272,000 - 432,000
Senior LLM Inference Engineer: Performance & Optimization
Senior LLM Inference Engineer: Performance & Optimization

Confidential • United States

On-site
USD 180,000 - 240,000
Lead High-Performance LLM Training Architect (Equity)
Lead High-Performance LLM Training Architect (Equity)

NVIDIA • Santa Clara (CA)

On-site
USD 272,000 - 431,250
Equity
Benefits
Senior DL Performance Efficiency Architect
Senior DL Performance Efficiency Architect

Nvidia Corporation in • Santa Clara (CA)

Hybrid
USD 184,000 - 357,000
Equity
Benefits
Senior DL Performance Efficiency Architect
Senior DL Performance Efficiency Architect

NVIDIA • Santa Clara (CA)

Hybrid
USD 184,000 - 357,000
Senior DL Performance Efficiency Architect
Senior DL Performance Efficiency Architect

NVIDIA Gruppe • Santa Clara (CA)

Hybrid
USD 184,000 - 357,000
Equity
Benefits
Principal High-Performance LLM Training Engineer
Principal High-Performance LLM Training Engineer

NVIDIA • Santa Clara (CA)

On-site
USD 272,000 - 431,250
Equity
Benefits