Vision AI Engineer for Multimodal LLMs (Equity Eligible)

Pinterest

San Francisco (CA)

Hybrid

USD 139,000 - 286,000

Full time

14 days+
Application generator

Turn this role into an interview — a resume and cover letter built around what this employer wants.

Get past ATS filters

Benefits offered by this job

Equity

Job summary

Pinterest Labs is seeking researchers to advance vision-centric large language models. You will help build VLMs that perceive visual details and aesthetics, enabling communication through visual assets with multimodal search and text-to-image tools. The role supports collaboration across a core visual pod and production-ready research.

You will contribute to evaluation benchmarks, work with Pinterest Canvas data for RLHF and fine-tuning, and publish findings to the broader research community.

Qualifications

  • Experience with generative computer vision models.
  • 2+ years of industry computer vision experience.
  • MS/PhD in Machine Learning, Computer Science, or related areas.

Responsibilities

  • Prototype new model architectures for Pinterest VLMs and finetuning.
  • Develop evaluation benchmarks for vision-centric capabilities.
  • Read research papers and brainstorm our visual generative strategy.
  • Collect relevant visual training data for Pinterest Canvas (RLHF, fine-tuning).
  • Publish and publicize your work via conferences, papers, blogs.

Skills

Generative CV models
Vision encoders
LLMs
Python / ML tooling

Education

MS/PhD in ML/CS

Tools

Cursor
Copilot
Codex

Job description

Pinterest Labs is seeking researchers to advance vision-centric large language models. You will help build VLMs that perceive visual details and aesthetics, enabling communication through visual assets with multimodal search and text-to-image tools. The role supports collaboration across a core visual pod and production-ready research.

You will contribute to evaluation benchmarks, work with Pinterest Canvas data for RLHF and fine-tuning, and publish findings to the broader research community.

Get your free, confidential resume review.
or drag and drop your file here.
Similar jobs

Similar jobs worth comparing

Vision-Language ML Engineer II
Vision-Language ML Engineer II

Pinterest • California (MO)

Hybrid
USD 139,000 - 286,000
Equity
Hybrid work model
Conference publication support
Senior Visual AI ML Engineer — Large-Scale Vision Models
Senior Visual AI ML Engineer — Large-Scale Vision Models

Pinterest • California (MO)

Hybrid
USD 189,000 - 389,000
Staff Computer Vision ML Engineer — Multimodal Vision
Staff Computer Vision ML Engineer — Multimodal Vision

Segment (Twilio) • San Francisco (CA)

Hybrid
USD 189,000 - 390,000
Staff Computer Vision & Multimodal ML Engineer
Staff Computer Vision & Multimodal ML Engineer

Pinterest • San Francisco (CA)

Hybrid
USD 189,000 - 390,000
Staff ML Engineer, Applied Research & LLMs
Staff ML Engineer, Applied Research & LLMs

Pinterest • San Francisco (CA)

On-site
USD 189,308 - 389,753
Machine Learning Engineer II, Visual AI
Machine Learning Engineer II, Visual AI

Pinterest • California (MO)

Hybrid
USD 139,000 - 286,000
Equity
Hybrid work model
Conference publication support
Machine Learning Engineer II, Visual AI
Machine Learning Engineer II, Visual AI

Pinterest • San Francisco (CA)

Hybrid
USD 139,000 - 286,000
Equity
Staff Machine Learning Engineer, Visual AI
Staff Machine Learning Engineer, Visual AI

Pinterest • San Francisco (CA)

Hybrid
USD 189,308 - 389,753
Staff Machine Learning Engineer, Visual AI
Staff Machine Learning Engineer, Visual AI

Pinterest • California (MO)

Hybrid
USD 189,000 - 389,000
Staff Machine Learning Engineer, Visual AI
Staff Machine Learning Engineer, Visual AI

Pinterest • San Francisco (CA)

Hybrid
USD 189,000 - 390,000
Equity