AI Model Evaluation Engineer - Data Pipelines & ETL

Mercor

Greater London

On-site

GBP 136,000 - 204,000

Part time

14 days+
Application generator

A complete application in a minute — tailored resume and cover letter, ready to send.

Get past ATS filters

Job summary

Mercor partners with a leading AI research lab to support a Frontier Code Agents project. Contributors evaluate frontier AI coding models within realistic data engineering workflows, focusing on ETL pipelines, data warehouses, analytics platforms, and distributed data systems.

The role involves reviewing model-generated implementations, identifying bugs and scalability issues, and applying engineering judgment to complex scenarios.

Qualifications

  • 2+ years of professional data engineering experience.
  • Experience building ETL pipelines, data warehouses, analytics platforms, or distributed data systems.
  • Regular use of AI coding agents such as Cursor, Claude Code, Codex, Windsurf, Gemini CLI, or similar tools.
  • Ability to evaluate model-generated data infrastructure and pipeline implementations.
  • Experience operating large-scale data platforms is preferred.

Responsibilities

  • Use frontier AI coding agents to complete and evaluate complex data engineering tasks.
  • Review model-generated implementations involving ETL pipelines, data warehouses, analytics platforms, and distributed data systems.
  • Identify bugs, edge cases, scalability issues, and failure modes.
  • Compare outputs from multiple frontier models and assess their strengths and weaknesses.
  • Apply professional engineering judgment to realistic data engineering scenarios.

Skills

Data engineering
ETL pipelines
Distributed data systems
AI coding agents

Tools

Cursor
Claude Code
Codex
Windsurf
Gemini CLI

Job description

Mercor partners with a leading AI research lab to support a Frontier Code Agents project. Contributors evaluate frontier AI coding models within realistic data engineering workflows, focusing on ETL pipelines, data warehouses, analytics platforms, and distributed data systems.

The role involves reviewing model-generated implementations, identifying bugs and scalability issues, and applying engineering judgment to complex scenarios.

Get your free, confidential resume review.
or drag and drop your file here.
Similar jobs

Similar jobs worth comparing

Data Engineer for Frontier AI Model Evaluation
Data Engineer for Frontier AI Model Evaluation

Obsidian • Greater London

On-site
GBP 122,000 - 408,000
Frontier AI Data Engineer & Model Evaluator
Frontier AI Data Engineer & Model Evaluator

Obsidian • Greater London

Remote
GBP 327,000 - 491,000
Data Engineer - AI Model Evaluation
Data Engineer - AI Model Evaluation

Obsidian • Greater London

On-site
GBP 122,000 - 408,000
Remote Data Engineer for Frontier AI Code Agents
Remote Data Engineer for Frontier AI Code Agents

Mercor • Greater London

Remote
GBP 102,000 - 205,000
DevOps Engineer - AI Model Evaluator
DevOps Engineer - AI Model Evaluator

Mercor • Greater London

On-site
GBP 136,000 - 205,000
ML Engineer: Frontier AI Coding & Model Evaluation
ML Engineer: Frontier AI Coding & Model Evaluation

Obsidian • Greater London

On-site
GBP 408,000 - 612,000
Frontier ML Engineer — AI Coding Model Evaluator (Contract)
Frontier ML Engineer — AI Coding Model Evaluator (Contract)

Obsidian • Greater London

Remote
GBP 136,000 - 204,000
ML Engineer - AI Coding Expert
ML Engineer - AI Coding Expert

Mercor • Greater London

On-site
GBP 184,000 - 255,000
Python AI Code Evaluator for Frontier Models
Python AI Code Evaluator for Frontier Models

Turing • City Of London

On-site
GBP 61,000 - 102,000
UK Data Engineer for Frontier AI Model Training
UK Data Engineer for Frontier AI Model Training

Mercor • Greater London

On-site
GBP 13,225,000 - 19,837,000