LLM Evaluation & Engineering Simulation Lead (Freelance)

Zettamine Labs

United States

Remote

USD 165,000 - 276,000

Full time

9 days ago
Application generator

Turn this role into an interview — a resume and cover letter built around what this employer wants.

Get past ATS filters

Job summary

Zettamine Labs is seeking an experienced LLM Engineering Expert for freelance AI evaluation and engineering simulation work. The project focuses on creating complex simulation problems, validating outputs, and analyzing AI trajectories using open-source tools.

Strong background in engineering and Python is required for remote collaboration and rapid deployment. Ideal candidates have 10+ years in engineering design, advanced degrees, and hands-on experience with LLMs and AI evaluation.

Qualifications

  • 10+ years of hands-on engineering design experience.
  • Master's degree or PhD in Electrical, Mechanical, Aerospace Engineering or closely related field.
  • Strong Python programming/scripting skills.
  • Experience with engineering simulation/tooling platforms listed.
  • Experience with LLMs, AI coding agents, or AI evaluation.

Responsibilities

  • Create complex, self-contained engineering design and simulation problems for AI evaluation.
  • Define technical constraints, objectives, reference solutions, and evaluation criteria.
  • Build and validate engineering simulation environments using open-source tools.
  • Develop Python-based scripts, test benches, and automated graders.
  • Analyze AI agent outputs, trajectories, and execution logs to identify issues.
  • Identify failure modes such as simulator interpretation errors, premature convergence, and tool-use mistakes.
  • Refine task difficulty based on model performance and evaluation results.
  • Ensure physical plausibility, unit consistency, boundary conditions, convergence, and accuracy.
  • Collaborate with AI researchers and engineering teams to improve benchmarks.

Skills

Engineering design
Python programming
AI evaluation
Engineering simulation
LLMs / AI agents

Education

Master's or PhD in Electrical, Mechanical, or Aerospace Engineering

Tools

ngspice
PySpice
OpenFOAM
FEniCSx
CalculiX
python-control
CadQuery
build123d
OpenModelica
Cantera
Gmsh

Job description

Zettamine Labs is seeking an experienced LLM Engineering Expert for freelance AI evaluation and engineering simulation work. The project focuses on creating complex simulation problems, validating outputs, and analyzing AI trajectories using open-source tools.

Strong background in engineering and Python is required for remote collaboration and rapid deployment. Ideal candidates have 10+ years in engineering design, advanced degrees, and hands-on experience with LLMs and AI evaluation.

Get your free, confidential resume review.

or drag and drop your file here.

Similar jobs

Similar jobs worth comparing

LLM Engineering Expert (Freelancing)
LLM Engineering Expert (Freelancing)

Zettamine Labs • United States

Remote
USD 165,000 - 276,000
Remote AI Engineer: LLM Alignment & Evaluation
Remote AI Engineer: LLM Alignment & Evaluation

Prolific Academic Ltd • United States

Remote
USD 96,000 - 138,000
Competitive pay rates
Flexible hours
Work from home
LLM Training & Evaluation Engineer (Remote)
LLM Training & Evaluation Engineer (Remote)

Prolific • United States

Remote
USD 130,000 - 190,000
LLM Evaluation & Verification Lead
LLM Evaluation & Verification Lead

DeepRec.ai • Redwood City (CA)

On-site
USD 180,000 - 240,000
High autonomy
Strong technical peers
Meaningful equity
LLM AI Training & Evaluation Engineer (Remote)
LLM AI Training & Evaluation Engineer (Remote)

Prolific Academic Ltd • United States

Remote
USD 83,000 - 110,000
Flexible hours
Work from home
Competitive pay up to $80/hr
LLM AI Engineer: Train, Evaluate & Align Models
LLM AI Engineer: Train, Evaluate & Align Models

Prolific Academic Ltd • United States

Remote
USD 66,000 - 110,000
LLM Evaluation Engineering Lead
LLM Evaluation Engineering Lead

DeepRec.ai • Redwood City (CA)

On-site
USD 180,000 - 240,000
High autonomy
Strong technical peers
Meaningful equity
LLM Engineering Expert- Simulation & Design
LLM Engineering Expert- Simulation & Design

Dover • United States

Remote
USD 1,200 - 2,500
LLM Evaluation Scenario Architect
LLM Evaluation Scenario Architect

Mindrift • Mississippi

Remote
USD 90,921 - 129,494
Competitive hourly rates
Flexible work hours
Valuable experience for portfolio
Remote Applied AI Research Scientist (LLM & Evaluation)
Remote Applied AI Research Scientist (LLM & Evaluation)

Rex.zone • United States

Remote
USD 41,328 - 68,880