ML Engineer: Multimodal Perception & Authentication

OpenAI

San Francisco (CA)

Hybrid

USD 342,000 - 399,000

Full time

13 days ago
Application generator

Turn this role into an interview — a resume and cover letter built around what this employer wants.

Get past ATS filters

Benefits offered by this job

Relocation assistance
Hybrid work model

Job summary

OpenAI in San Francisco is seeking a Machine Learning Engineer focused on multimodal perception and authentication. You will advance perception models that fuse visual and audio signals, work with larger multimodal models, and collaborate with hardware, firmware, software, and product teams to ship research as real-world systems.

The role emphasizes cross-disciplinary collaboration, privacy-aware applications, and the ability to design robust experiments and evaluations.

Qualifications

  • Strong background in computer vision, audio or speech ML, multimodal learning, or sensing.
  • Experience developing specialized ML models or larger multimodal models.
  • Experience bringing research ideas into practical systems or prototypes.
  • Ability to design experiments, build evaluations, and analyze model behavior.

Responsibilities

  • Research and develop multimodal perception and authentication methods across visual, audio, and sensing signals.
  • Explore how specialized perception models and larger multimodal models can work together.
  • Design data, training, and evaluation approaches for real-world conditions.
  • Study model behavior, robustness, and failure modes across sensing, data, and deployment environments.
  • Integrate and validate new capabilities in real-time or resource-constrained systems.
  • Collaborate with hardware, firmware, software, and product teams to deploy research as working systems.

Skills

Computer vision
Audio ML
Multimodal learning
Sensing

Tools

Python
PyTorch
C++

Job description

OpenAI in San Francisco is seeking a Machine Learning Engineer focused on multimodal perception and authentication. You will advance perception models that fuse visual and audio signals, work with larger multimodal models, and collaborate with hardware, firmware, software, and product teams to ship research as real-world systems.

The role emphasizes cross-disciplinary collaboration, privacy-aware applications, and the ability to design robust experiments and evaluations.

Get your free, confidential resume review.

or drag and drop your file here.

Similar jobs

Similar jobs worth comparing

Multimodal ML Engineer: Perception & Authentication
Multimodal ML Engineer: Perception & Authentication

Slope • San Francisco (CA)

On-site
USD 150,000 - 230,000
Machine Learning Engineer, Multimodal Perception and Authentication
Machine Learning Engineer, Multimodal Perception and Authentication

Slope • San Francisco (CA)

On-site
USD 150,000 - 230,000
Machine Learning Engineer, Multimodal Perception and Authentication
Machine Learning Engineer, Multimodal Perception and Authentication

OpenAI • San Francisco (CA)

Hybrid
USD 342,000 - 399,000
Relocation assistance
Hybrid work model
ML Engineer for Multimodal Robotics & Embodied AI
ML Engineer for Multimodal Robotics & Embodied AI

Human Archive • San Francisco (CA)

On-site
USD 120,000 - 160,000
Multimodal ML Engineer - Vision, Audio & Text AI
Multimodal ML Engineer - Vision, Audio & Text AI

AI Breaking Wire • Mountain View (CA)

Hybrid
USD 200,000 - 320,000
Comprehensive health programs
Generous vacation & family leave
On-site gourmet cafeterias
Multimodal AI Engineer: Vision, Audio & Text
Multimodal AI Engineer: Vision, Audio & Text

AI Breaking Wire • Mountain View (CA), Northern (KY)

Hybrid
USD 210,000 - 310,000
Equity program
Healthcare
On-site gym
+3
Multimodal AI Systems Engineer - End-to-End Impact
Multimodal AI Systems Engineer - End-to-End Impact

Perplexity AI Inc. • San Francisco (CA)

On-site
USD 120,000 - 150,000
Robotics ML Engineer: Multimodal Perception & Action
Robotics ML Engineer: Multimodal Perception & Action

Human Computer Lab • San Francisco (CA)

On-site
USD 120,000 - 150,000
Multimodal AI Engineer — Image/Video & Audio
Multimodal AI Engineer — Image/Video & Audio

xAI • Seattle (WA)

On-site
USD 180,000 - 440,000
Equity
Comprehensive medical, vision, and dental coverage
401(k) retirement plan
+2
Senior Multimodal API Engineer
Senior Multimodal API Engineer

OpenAI • San Francisco (CA)

On-site
USD 200,000 - 270,000