Research Intern - Multimodal AI for Robotic Vision

Varian Medical Systems, Inc.

United States

On-site

USD 48,000 - 75,000

Full time

9 days ago
Application generator

Turn this role into an interview — a resume and cover letter built around what this employer wants.

Get past ATS filters

Benefits offered by this job

medical insurance
dental insurance
vision insurance
401(k) retirement plan
life insurance
long-term and short-term disability
paid parking/public transportation
paid time off
paid sick and safe time

Job summary

Siemens Healthineers seeks a Research Intern to work on developing multimodal vision/language/action models for downstream robotic tasks. You will design pipelines that fuse multi-sensor imaging and kinematic signals into unified spatial representations, enabling perception to planning and control through VLA-based policies and AI decision-making frameworks.

The role targets highly motivated students or recent graduates pursuing advanced studies in Computer Science, Robotics, Electrical

Qualifications

  • Currently enrolled in and pursuing studies at a foreign degree‑or‑certificate‑granting post‑secondary academic institution outside the United States OR has graduated from such an institution no more than 12 months prior to the exchange visitor program start date.

Responsibilities

  • Developing and fine‑tuning multimodal vision/language/action models for downstream robotic tasks
  • Designing pipelines that fuse multi-sensor imaging and kinematic signals into unified spatial representations
  • Connecting perception to planning and control through VLA‑based policies and agentic AI decision‑making frameworks

Skills

Computer Vision
Deep Learning
Multimodal ML

Education

MS/PhD or postdoc in Computer Science/Robotics/Electrical/Biomedical Engineering

Tools

Python
PyTorch

Job description

Siemens Healthineers seeks a Research Intern to work on developing multimodal vision/language/action models for downstream robotic tasks. You will design pipelines that fuse multi-sensor imaging and kinematic signals into unified spatial representations, enabling perception to planning and control through VLA-based policies and AI decision-making frameworks.

The role targets highly motivated students or recent graduates pursuing advanced studies in Computer Science, Robotics, Electrical

Get your free, confidential resume review.

or drag and drop your file here.

Similar jobs

Similar jobs worth comparing

Research Intern: Multimodal AI for Robotic Healthcare
Research Intern: Multimodal AI for Robotic Healthcare

563d Siemens Medical Solutions USA, Inc. • United States

On-site
USD 48,000 - 75,000
Medical insurance
Dental insurance
Vision insurance
+7
Research Intern: Multimodal Vision & Robotics AI
Research Intern: Multimodal Vision & Robotics AI

Siemens Healthineers AG • Princeton (NJ)

On-site
USD 3,800 - 75,000
Medical insurance
Dental insurance
Vision insurance
+5
AI Research Intern: Multimodal Surgical Robotics
AI Research Intern: Multimodal Surgical Robotics

Intuitive • Sunnyvale (CA)

On-site
USD 34,000 - 48,000
AI Research Intern
AI Research Intern

Intuitive • Sunnyvale (CA)

On-site
USD 34,000 - 48,000
PhD Research Intern: AI/ML, RL & Multimodal Vision
PhD Research Intern: AI/ML, RL & Multimodal Vision

Simular Inc. • Palo Alto (CA)

On-site
USD 30,000 - 50,000
Research Intern: 3D Vision for Autonomous Systems
Research Intern: 3D Vision for Autonomous Systems

Applied Intution • Sunnyvale (CA)

On-site
USD 29,016 - 42,408
Research Engineer - Vision Language Models / Multimodal AI / Computer Vision
Research Engineer - Vision Language Models / Multimodal AI / Computer Vision

Acceler8 Talent • Mountain View (CA)

Hybrid
USD 180,000 - 240,000
Research Scientist: Vision-Language-Action for Autonomy
Research Scientist: Vision-Language-Action for Autonomy

Bosch Group • Sunnyvale (CA)

On-site
USD 165,000 - 185,000
Premium health coverage
401(k) with generous matching
Resources for financial planning and目标
Research Engineer
Research Engineer

Acceler8 Talent • Mountain View (CA)

Hybrid
USD 140,000 - 190,000
Senior Vision-Language AI Research Scientist
Senior Vision-Language AI Research Scientist

Lever, Inc. • Sunnyvale (CA)

On-site
USD 150,000 - 450,000