ML Engineer, Large-Scale Pre-Training

Mindbeam

United States

On-site

USD 100,000 - 140,000

Full time

14 days+

Get more replies from employers

Send a job-specific resume in minutes.

Job summary

Mindbeam is looking for an expert to design and optimize large-scale pre-training systems for their generative AI models. You will build scalable pipelines and implement distributed training strategies while collaborating closely with researchers.

Ideal candidates possess strong Python skills, experience with large-scale training, and familiarity with ML frameworks like PyTorch and TensorFlow. This role promises impactful innovations in AI development within a collaborative environment.

Qualifications

  • 2+ years of experience with large-scale model training.
  • Strong coding skills in Python.
  • Experience with GPU scheduling and memory optimization.

Responsibilities

  • Build scalable pre-training pipelines for foundation models.
  • Implement distributed training strategies across GPUs/TPUs.
  • Collaborate with researchers to develop production-ready workflows.

Skills

Large-scale model training
Distributed systems
Python
ML frameworks (PyTorch, TensorFlow, JAX)
GPU scheduling
Memory optimization
Docker
Kubernetes

Education

Bachelor’s, Master’s, or PhD in Computer Science or related field

Job description

Mindbeam is looking for an expert to design and optimize large-scale pre-training systems for their generative AI models. You will build scalable pipelines and implement distributed training strategies while collaborating closely with researchers.

Ideal candidates possess strong Python skills, experience with large-scale training, and familiarity with ML frameworks like PyTorch and TensorFlow. This role promises impactful innovations in AI development within a collaborative environment.

Get your free, confidential resume review.
or drag and drop your file here.
Similar jobs

Similar jobs worth comparing

Machine Learning Engineer - Pre Training
Machine Learning Engineer - Pre Training

Mindbeam • United States

On-site
USD 100,000 - 140,000
ML Engineer: Scale AI Deployment & Optimization
ML Engineer: Scale AI Deployment & Optimization

Mindbeam • United States

On-site
USD 100,000 - 150,000
Machine Learning Engineer - Post Training
Machine Learning Engineer - Post Training

Mindbeam • United States

On-site
USD 100,000 - 150,000
Research Engineer
Research Engineer

Mind Robotics • Palo Alto (CA)

On-site
USD 180,000 - 240,000
Staff ML Engineer: Large-Scale Training & Post-Training
Staff ML Engineer: Large-Scale Training & Post-Training

Cohere • New York (NY), San Francisco (CA)

Hybrid
USD 170,000 - 250,000
Weekly lunch stipend
Health and dental benefits
Pension/RRSP matching
+2
Remote AI Operations Engineer for Large-Scale ML Pipelines
Remote AI Operations Engineer for Large-Scale ML Pipelines

Bright Vision Technologies • Flower Mound (TX)

On-site
USD 150,000 - 165,000
Model Systems Engineer
Model Systems Engineer

Mind Robotics • Palo Alto (CA)

On-site
USD 180,000 - 240,000
Research Engineer - Large-Scale AI Models & Pipelines
Research Engineer - Large-Scale AI Models & Pipelines

Magic • San Francisco (CA)

On-site
USD 120,000 - 160,000
Distributed ML Training Systems Engineer
Distributed ML Training Systems Engineer

Mind Robotics • Palo Alto (CA)

On-site
USD 180,000 - 240,000
Senior ML Infra Engineer - Large-Scale Training & Pipelines
Senior ML Infra Engineer - Large-Scale Training & Pipelines

Kindredventures • San Francisco (CA)

On-site
USD 160,000 - 220,000