Staff Visual AI Engineer: Vision & Diffusion

Pinterest

San Francisco (CA)

Hybrid

USD 189,000 - 390,000

Full time

14 days+

Get more replies from employers

Send a job-specific resume in minutes.

Benefits offered by this job

Equity

Job summary

Pinterest is seeking research engineers and scientists to advance visual AI capabilities. You will train large-scale vision models, develop multimodal representations, and collaborate across teams to ship production-ready features.

The role emphasizes research excellence, plus opportunities to publish and present at conferences. Applicants should have strong PyTorch experience and a PhD or equivalent work background. US-based location is supported with flexible hybrid work.

Qualifications

  • Experience building and training large-scale vision models.
  • Strong background in multimodal representations and visual language modeling.

Responsibilities

  • Build state-of-the-art visual encoders, VLMs, and diffusion models.
  • Experiment with billion-scale image datasets on GPU clusters.
  • Develop visual reasoning tools for image retrieval and editing.
  • Read research papers and contribute to our AI strategy discussions.
  • Create data agents to assemble training data for multimodal models.
  • Collaborate with product and infrastructure teams to ship capabilities.
  • Publish work at conferences and maintain project blogs.
  • Mentor researchers and interns in Pinterest Labs.
  • Collaborate across teams in SF, Seattle, NYC, and remote roles.

Skills

Vision models
Multimodal ML
Research proficiency
Collaboration

Education

MS/PhD in ML or related

Tools

PyTorch
Large-scale training

Job description

Pinterest is seeking research engineers and scientists to advance visual AI capabilities. You will train large-scale vision models, develop multimodal representations, and collaborate across teams to ship production-ready features.

The role emphasizes research excellence, plus opportunities to publish and present at conferences. Applicants should have strong PyTorch experience and a PhD or equivalent work background. US-based location is supported with flexible hybrid work.

Get your free, confidential resume review.
or drag and drop your file here.
Similar jobs

Similar jobs worth comparing

Staff ML Engineer — Vision & Multimodal AI
Staff ML Engineer — Vision & Multimodal AI

Jobtailor • San Francisco (CA)

On-site
USD 150,000 - 220,000
Senior ML Engineer - Generative Vision & Diffusion
Senior ML Engineer - Generative Vision & Diffusion

Pinterest • San Francisco (CA)

Hybrid
USD 161,000 - 333,000
Senior ML Engineer: Generative Vision & Diffusion Models
Senior ML Engineer: Generative Vision & Diffusion Models

Pinterest • San Francisco (CA)

Hybrid
USD 161,000 - 333,000
Staff Computer Vision ML Engineer — Multimodal Vision
Staff Computer Vision ML Engineer — Multimodal Vision

Segment (Twilio) • San Francisco (CA)

Hybrid
USD 189,000 - 390,000
Staff Machine Learning Engineer, Computer Vision
Staff Machine Learning Engineer, Computer Vision

Jobtailor • San Francisco (CA)

On-site
USD 150,000 - 220,000
Staff Machine Learning Engineer, Visual AI
Staff Machine Learning Engineer, Visual AI

Pinterest • San Francisco (CA)

Hybrid
USD 189,000 - 390,000
Equity
Staff Machine Learning Engineer, Computer Vision
Staff Machine Learning Engineer, Computer Vision

Segment (Twilio) • San Francisco (CA)

Hybrid
USD 189,000 - 390,000
Staff Computer Vision & Multimodal ML Engineer
Staff Computer Vision & Multimodal ML Engineer

Pinterest • San Francisco (CA)

Hybrid
USD 189,000 - 390,000
Staff Machine Learning Engineer, Visual AI
Staff Machine Learning Engineer, Visual AI

Pinterest • San Francisco (CA)

Hybrid
USD 189,308 - 389,753
Vision AI Engineer for Multimodal LLMs (Equity Eligible)
Vision AI Engineer for Multimodal LLMs (Equity Eligible)

Pinterest • San Francisco (CA)

Hybrid
USD 139,000 - 286,000
Equity