Engineering Expert

Turing

United States

Remote

USD 120,000 - 180,000

Part time

10 days ago
Application generator

Don’t send a generic resume — generate a resume and cover letter tailored to this exact role.

Get past ATS filters

Benefits offered by this job

Remote contractor role

Job summary

Turing, based in San Francisco, seeks AI Evaluation Engineers (Engineering Simulation & Design) to author and validate model-breaking engineering design problems across Electrical, Mechanical, and Aerospace domains. You will configure open-source simulators, analyze agent outputs, and develop objective autograders to elevate frontier AI agents.

Requirements include a Master’s or PhD in a relevant field with 10+ years’ hands-on design experience, proficiency in Python, and familiarity with tools

Qualifications

  • Master’s degree or PhD in a relevant engineering domain (Electrical, Mechanical, Aerospace).
  • 10+ years hands-on engineering design experience.

Responsibilities

  • Design self-contained engineering design tasks with explicit constraints and targets.
  • Build and validate problem environments using open-source tools and Python benches.
  • Analyze trajectories and identify failure modes across trials to improve benchmarks.
  • Collaborate with AI researchers and domain experts to integrate high-rigor benchmarks.

Skills

Engineering design
Python scripting
Open-source simulation tools
LLM evaluation
Failure diagnostics
Trajectory log analysis
Convergence criteria

Education

Master’s or PhD in Electrical Engineering
Master’s or PhD in Mechanical Engineering
Master’s or PhD in Aerospace Engineering

Tools

ngspice
PySpice
OpenFOAM
FEniCSx
Cantera

Job description

About Turing:
Based in San Francisco, California, Turing is the world’s leading research accelerator for frontier AI labs and a trusted partner for global enterprises deploying advanced AI systems. Turing supports customers in two ways: first, by accelerating frontier research with high-quality data, advanced training pipelines, plus top AI researchers who specialize in coding, reasoning, STEM, multilinguality, multimodality, and agents; and second, by applying that expertise to help enterprises transform AI from proof of concept into proprietary intelligence with systems that perform reliably, deliver measurable impact, and drive lasting results on the P&L.

Role Overview

We are seeking experienced AI Evaluation Engineers (Engineering Simulation & Design) to author and validate "model-breaking," simulation-based engineering design problems to train and evaluate state-of-the-art AI agents. Operating across major engineering disciplines—including Electrical, Mechanical, Control Systems, Aerospace, Systems, and Robotics—you will create complex, multi-constraint tasks where AI agents must interpret requirements, navigate trade-offs, configure open-source simulation tools, diagnose failures, and iterate toward valid solutions. You will analyze agent execution logs, expose systemic reasoning gaps, and build automated, objective graders to elevate frontier model performance.

Job Requirements:

  • Education & Expertise: Master’s degree or PhD in Electrical, Mechanical, Aerospace, with 10+ years of hands-on engineering design experience.
  • Simulation Tooling: Proficiency with at least one domain-relevant open-source simulation package (e.g., ngspice, PySpice, OpenFOAM, FEniCSx, CalculiX, python-control, CadQuery, build123d, OpenModelica, Cantera, Gmsh) combined with strong Python scripting skills.
  • AI Evaluation & Failure Diagnostics: Hands-on experience with modern LLMs/coding agents and evaluation concepts (pass@k, failure-mode analysis, nondeterministic behavior), with the ability to audit trajectory logs and isolate core reasoning/tool-use failures.
  • Domain Rigor & Precision: Uncompromising attention to physical plausibility, unit consistency, boundary conditions, convergence criteria, and technical documentation.
  • Availability & Commitment: Talent must have weekend on-call availability (part-time engagement is acceptable).
  • Technical Infrastructure: Personal desktop/laptop equipped with a stable, high-speed internet connection in a remote setup.

Job Responsibilities:

  • Model-Breaking Problem Design: Author original, self-contained engineering design tasks with competing constraints, explicit optimization targets, validated reference solutions, and objective autograders.
  • Environment & Simulation Integration: Build, run, and validate problem environments using open-source simulation tools and custom Python test benches.
  • Trajectory Analysis & Failure Mode Taxonomy: Evaluate coding agent outputs and execution logs across repeated trials to identify systemic failure modes (e.g., misinterpreting simulator feedback, premature design convergence, physically impossible geometries).
  • Difficulty Calibration & Benchmark Refinement: Iteratively refine problem difficulty based on empirical model performance data without introducing ambiguity or missing information.
  • Cross-Functional Collaboration: Partner with AI researchers, pod leads, and domain experts to integrate high-rigor benchmarks into the model evaluation pipeline.
Domains:
  • Electrical Engineering
  • Mechanical Engineering
  • Aerospace Engineering

Education & Experience

  • Master or PhD from relevant engineering domain is a must for this position.
  • Experience in AI evaluation, data annotation, content review, quality assurance, or a related analytical role is required.

Offer Details:

  • Commitments Required: 40 hours per week with 4 hours of overlap with PST.
  • Engagement type: Contractor
  • Engagement Length: upto 24 weeks

Evaluation Process -

  • Shortlisted candidates will be sent a Job Interest Form.
  • Finalized talents will go through delivery review & proceeded further accordingly.
Get your free, confidential resume review.

or drag and drop your file here.

Similar jobs

Similar jobs worth comparing

Engineering Expert
Engineering Expert

Turing Global India • United States

Remote
USD 124,000 - 193,000
Remote Senior Software Developer
Remote Senior Software Developer

turing • United States

Remote
USD 83,000 - 152,000
Remote Software Engineer - C++
Remote Software Engineer - C++

Turing • United States

Remote
USD 55,000 - 110,000
LLM Engineering Expert- Simulation & Design
LLM Engineering Expert- Simulation & Design

Dover • United States

Remote
USD 1,200 - 2,500
Remote C/C++ Developer
Remote C/C++ Developer

Turing • United States

Remote
USD 55,000 - 96,000
Flexible hours
1 month contract
Remote Software Developer – AI Research & Evaluation
Remote Software Developer – AI Research & Evaluation

turing • San Francisco (CA)

Remote
USD 69,000 - 138,000
AI Evaluation Engineer: Simulation & Design (Contract)
AI Evaluation Engineer: Simulation & Design (Contract)

Turing Global India • United States

Remote
USD 124,000 - 193,000
AI Evaluation Engineer - Simulation & Design
AI Evaluation Engineer - Simulation & Design

Turing • United States

Remote
USD 120,000 - 180,000
Remote contractor role
Remote Java Developer
Remote Java Developer

turing • San Francisco (CA)

Remote
USD 14,000 - 55,000
AI-Focused Java Engineer: Code Curation & Evaluation
AI-Focused Java Engineer: Code Curation & Evaluation

Turing • San Francisco (CA)

On-site
USD 69,000 - 96,000
Flexible hours
Contractor engagement