LLM Efficiency Architect – Optimize Models & Compute

Thomas To

Santa Clara (CA)

On-site

USD 184,000 - 357,000

Full time

2 days ago
Be an early applicant
Application generator

Turn this role into an interview — a resume and cover letter built around what this employer wants.

Get past ATS filters

Benefits offered by this job

Equity
Benefits

Job summary

NVIDIA in Santa Clara is seeking a strong technical leader to drive a unified strategy for making LLMs more efficient from research through deployment. You will lead cross‑discipline efforts across model innovation, systems, and hardware awareness to ensure new capabilities fit compute, memory, power, and cost constraints.

The ideal candidate is hands‑on, identifies bottlenecks, and translates research ideas into scalable, real‑world improvements.

Qualifications

  • MS or PhD in Computer Science, Electrical Engineering, Computer Engineering, or related field.
  • 5+ years of AI systems, model architecture, computer architecture, HPC, or performance optimization.
  • Strong understanding of LLM architectures, training and inference workloads, and tradeoffs between quality, cost, memory, latency, throughput, and power.
  • Background in performance analysis, roofline modeling, workload characterization, benchmarking, and hardware-aware optimization.

Responsibilities

  • Lead cross-layer efforts to improve LLM efficiency across model architecture, training and inference systems.
  • Analyze how LLM workloads map to GPUs, memory systems, interconnects, and distributed infrastructure for co-design opportunities.
  • Establish a measurement-driven efficiency roadmap and lead projects from investigation through production deployment.
  • Partner with researchers, systems engineers, compiler/kernel developers, and hardware architects on roadmaps.

Skills

AI systems
Model architecture
High-performance computing
Performance optimization
Technical leadership

Education

MS or PhD in CS/EE/CE or related field

Job description

NVIDIA in Santa Clara is seeking a strong technical leader to drive a unified strategy for making LLMs more efficient from research through deployment. You will lead cross‑discipline efforts across model innovation, systems, and hardware awareness to ensure new capabilities fit compute, memory, power, and cost constraints.

The ideal candidate is hands‑on, identifies bottlenecks, and translates research ideas into scalable, real‑world improvements.

Get your free, confidential resume review.
or drag and drop your file here.
Similar jobs

Similar jobs worth comparing

Senior LLM Efficiency Architect — Model-System Optimizer
Senior LLM Efficiency Architect — Model-System Optimizer

NVIDIA • Santa Clara (CA)

Hybrid
USD 184,000 - 357,000
LLM Efficiency Architect: Cross-Layer Performance Leader
LLM Efficiency Architect: Cross-Layer Performance Leader

NVIDIA Gruppe • Santa Clara (CA)

Hybrid
USD 184,000 - 357,000
Equity
Benefits
LLM Efficiency Architect — Lead Cross‑Layer Optimization (Equity)
LLM Efficiency Architect — Lead Cross‑Layer Optimization (Equity)

NVIDIA AI • Santa Clara (CA)

On-site
USD 184,000 - 357,000
Equity
Benefits
Senior LLM Efficiency Architect: Model Systems Co-Design
Senior LLM Efficiency Architect: Model Systems Co-Design

Nvidia Corporation in • Santa Clara (CA)

Hybrid
USD 184,000 - 357,000
Equity
Benefits
Senior DL Performance Efficiency Architect
Senior DL Performance Efficiency Architect

Thomas To • Santa Clara (CA)

On-site
USD 184,000 - 357,000
Equity
Benefits
Senior DL Performance Efficiency Architect
Senior DL Performance Efficiency Architect

NVIDIA AI • Santa Clara (CA)

On-site
USD 184,000 - 357,000
Equity
Benefits
Lead Architect, High-Performance LLM Training
Lead Architect, High-Performance LLM Training

NVIDIA Gruppe • Santa Clara (CA)

On-site
USD 272,000 - 432,000
Senior LLM Inference Architect - Equity Eligible
Senior LLM Inference Architect - Equity Eligible

NVIDIA • Santa Clara (CA)

On-site
USD 184,000 - 357,000
Equity
Benefits
Senior DL Performance Efficiency Architect
Senior DL Performance Efficiency Architect

Nvidia Corporation in • Santa Clara (CA)

Hybrid
USD 184,000 - 357,000
Equity
Benefits
Senior LLM Training Performance Architect
Senior LLM Training Performance Architect

NVIDIA • Santa Clara (CA)

Hybrid
USD 184,000 - 356,500
Equity
Benefits