Remote AI Evaluation Engineer for Simulations & Design

Benture

San Francisco (CA)

Remote

USD 83,000 - 138,000

Part time

14 days+
Application generator

Don’t send a generic resume — generate a resume and cover letter tailored to this exact role.

Get past ATS filters

Job summary

Turing, based in San Francisco, seeks experienced AI Evaluation Engineers specializing in engineering simulation and design to author and validate complex problems that train and evaluate state-of-the-art AI agents. This high-impact contractor role operates across Electrical, Mechanical, Control Systems, Aerospace, Systems, and Robotics Engineering.

Responsibilities include designing model-breaking tasks, integrating environments, analyzing trajectories, calibrating difficulty, and collaborating

Qualifications

  • Master’s degree or PhD in Electrical, Mechanical, Aerospace, Control Systems, Systems Engineering, Robotics, or an applied science discipline.
  • 3+ years of hands-on engineering design experience.
  • Proficiency with at least one domain-relevant open-source simulation package and strong Python scripting skills.
  • Hands-on experience with modern LLMs/coding agents and evaluation concepts.
  • Uncompromising attention to physical plausibility, unit consistency, boundary conditions, convergence criteria, and technical documentation.
  • Weekend on-call availability (part-time engagement acceptable).
  • Personal desktop or laptop with a stable, high-speed internet connection.

Responsibilities

  • Author original engineering design tasks with constraints, targets, reference solutions, and autograders.
  • Build, run, and validate problem environments using open-source simulation tools and Python test benches.
  • Evaluate agent outputs and logs to identify systemic failure modes.
  • Iteratively refine problem difficulty based on performance data.
  • Collaborate with AI researchers and domain experts to integrate benchmarks into evaluation pipelines.

Skills

Python scripting
Engineering design
LLM evaluation
Domain rigor
Cross-disciplinary collaboration

Education

Master’s or PhD in Electrical/Mechanical/Aerospace/Control Systems/Robotics

Tools

ngspice
PySpice
OpenFOAM
FEniCSx
CalculiX
python-control
CadQuery
OpenModelica
Cantera
Gmsh

Job description

Turing, based in San Francisco, seeks experienced AI Evaluation Engineers specializing in engineering simulation and design to author and validate complex problems that train and evaluate state-of-the-art AI agents. This high-impact contractor role operates across Electrical, Mechanical, Control Systems, Aerospace, Systems, and Robotics Engineering.

Responsibilities include designing model-breaking tasks, integrating environments, analyzing trajectories, calibrating difficulty, and collaborating

Get your free, confidential resume review.

or drag and drop your file here.

Similar jobs

Similar jobs worth comparing

AI Evaluation Engineer: Simulation & Design (Contract)
AI Evaluation Engineer: Simulation & Design (Contract)

Turing Global India • United States

Remote
USD 124,000 - 193,000
AI Evaluation Engineer · Turing Turing · TBD · remote · 3w ago TBD 3w ago
AI Evaluation Engineer · Turing Turing · TBD · remote · 3w ago TBD 3w ago

Benture • San Francisco (CA)

Remote
USD 83,000 - 138,000
Global AI Evaluation Engineer - Simulation & Design
Global AI Evaluation Engineer - Simulation & Design

Dover • United States

Remote
USD 1,200 - 2,500
Engineering Expert
Engineering Expert

Turing Global India • United States

Remote
USD 124,000 - 193,000
AI Evaluation Engineer: RL Environments & Agents
AI Evaluation Engineer: RL Environments & Agents

MaxIT Consulting - Max Corporate Group • San Francisco (CA)

On-site
USD 140,000 - 210,000
AI Evaluation Engineer – Reinforcement Learning & Agents
AI Evaluation Engineer – Reinforcement Learning & Agents

MaxIT Consulting - Max Corporate Group • San Francisco (CA)

On-site
USD 140,000 - 210,000
Remote Java Engineer for AI Code Evaluation
Remote Java Engineer for AI Code Evaluation

turing • San Francisco (CA)

Remote
USD 14,000 - 55,000
Remote AI Agent Evaluation Engineer
Remote AI Agent Evaluation Engineer

YO AI Labs • Los Angeles (CA)

Remote
USD 83,000 - 138,000
Remote Electrical Engineering AI Evaluation Specialist
Remote Electrical Engineering AI Evaluation Specialist

OpenTrain AI, Inc. • Northern (KY)

Hybrid
USD 99,000 - 165,000
AI Evaluation & Task Design Engineer
AI Evaluation & Task Design Engineer

Biz Tech Consultants • United States

Remote
USD 120,000 - 180,000