Member of Technical Staff - Efficient ML

embedding-vc

San Francisco (CA)

On-site

USD 100,000 - 150,000

Full time

14 days+
Application generator

Get a reply from this employer — a resume and cover letter tailored to exactly what they’re hiring for.

Get past ATS filters

Job summary

A tech-focused company in San Francisco seeks candidates with expertise in AI simulation development. The role emphasizes optimizing training efficiency, enhancing GPU performance, and ensuring low-latency inference. Applicants should be proficient in methodologies for gradient checkpointing, Nsight profiling, and job management tools like SLURM. The company values in-person collaboration in its dynamic team environment, providing opportunities for innovation and cutting-edge technology implementation.

Responsibilities

  • Optimize training efficiency with ML techniques.
  • Enhance GPU and kernel performance for AI models.
  • Implement inference optimization strategies for low-latency serving.
  • Ensure infra reliability with job management tools.

Skills

Dataloaders, fusion, activation remat
Gradient checkpointing
Nsight profiling
Triton/CUDA kernels
Quantization (GPTQ/AWQ)

Tools

SLURM
Kubernetes

Job description

Introducing Moonlake, AI for creating world simulations.

Scope of Work

Training efficiency

  • Dataloaders, fusion, activation remat, gradient checkpointing.
  • FSDP/ZeRO/tensor+pipeline parallel; NCCL tuning.

GPU + kernel performance

  • Nsight profiling, Triton/CUDA kernels, fused ops.
  • Flash-attention–style speedups, sequence packing, KV-cache tricks.

Inference optimization

  • Low-latency serving, continuous batching, speculative decoding.
  • Quantization (GPTQ/AWQ), distillation, pruning.

Infra + reliability

  • SLURM/K8s multi-node jobs, checkpoint hygiene.
  • Determinism, env pinning, GPU failure handling.

We are committed to being an on-site, in-person team currently based in San Mateo

Get your free, confidential resume review.
or drag and drop your file here.
Similar jobs

Similar jobs worth comparing

Member of Technical Staff - Code Generation
Member of Technical Staff - Code Generation

embedding-vc • San Mateo (CA)

On-site
USD 120,000 - 160,000
Member of Technical Staff - Product Engineer
Member of Technical Staff - Product Engineer

Socket.dev • San Francisco (CA)

On-site
USD 120,000 - 190,000
Member of Technical Staff - Robotics & Simulation
Member of Technical Staff - Robotics & Simulation

Socket.dev • San Francisco (CA)

On-site
USD 120,000 - 190,000
Member of Technical Staff - Product Engineer
Member of Technical Staff - Product Engineer

Embedding VC • San Francisco (CA)

On-site
USD 120,000 - 160,000
Member of Technical Staff, MLSys
Member of Technical Staff, MLSys

Bake AI • San Mateo (CA), Northern (KY)

Hybrid
USD 180,000 - 240,000
Member of Technical Staff - Simulation Engineer
Member of Technical Staff - Simulation Engineer

Socket.dev • San Francisco (CA)

On-site
USD 180,000 - 240,000
Member of Technical Staff - Robotics & Simulation
Member of Technical Staff - Robotics & Simulation

Moonlake AI • San Francisco (CA)

On-site
USD 180,000 - 240,000
Member of Technical Staff - Simulation Engineer
Member of Technical Staff - Simulation Engineer

Embedding VC • San Francisco (CA)

On-site
USD 150,000 - 210,000
Member of Technical Staff - ML Performance
Member of Technical Staff - ML Performance

Veeda Innovation • Northern (KY)

Hybrid
USD 150,000 - 230,000
Member of Technical Staff - Robotics & Simulation
Member of Technical Staff - Robotics & Simulation

Embedding VC • San Francisco (CA)

On-site
USD 180,000 - 260,000