AI-Powered DevOps Evaluator for Frontier Coding Agents

Mercor

Wien

Vor Ort

EUR 167.000 - 239.000

Vollzeit

14 Tage+

Erhalte mehr Antworten von Arbeitgebern

Versende in nur wenigen Minuten einen passgenauen Lebenslauf.

Zusammenfassung

Mercor is partnering with a leading AI research lab to support a Frontier Code Agents project. Contributors help evaluate and improve frontier AI coding models through structured technical assessments, focusing on realistic infrastructure engineering workflows and model evaluation.

Spots are limited and filling quickly on a first come, first serve basis. Join a sprint-based program with compensation per accepted task, typically 2–3 hours per task after ramp-up, and engage with AI coding agents

Qualifikationen

  • 2+ years of professional DevOps, SRE, or Cloud Engineering experience.
  • Experience with AWS, Azure, GCP, Kubernetes, Terraform, CI/CD pipelines, or observability tooling.
  • Regular use of AI coding agents such as Cursor, Claude Code, Codex, Windsurf, Gemini CLI, or similar tools.
  • Ability to evaluate model-generated infrastructure and reliability engineering solutions.

Aufgaben

  • Use frontier AI coding agents to complete and evaluate complex infrastructure engineering tasks.
  • Review model-generated implementations involving cloud platforms, Kubernetes, CI/CD systems, observability, and infrastructure automation.
  • Identify bugs, edge cases, reliability issues, and failure modes.
  • Compare outputs from multiple frontier models and assess their strengths and weaknesses.
  • Apply professional engineering judgment to realistic infrastructure engineering scenarios.

Kenntnisse

DevOps
SRE
Cloud
Kubernetes
Terraform
CI/CD
Observability

Tools

AWS
Azure
GCP
Kubernetes
Terraform
CI/CD pipelines
Observability tooling

Jobbeschreibung

Mercor is partnering with a leading AI research lab to support a Frontier Code Agents project. Contributors help evaluate and improve frontier AI coding models through structured technical assessments, focusing on realistic infrastructure engineering workflows and model evaluation.

Spots are limited and filling quickly on a first come, first serve basis. Join a sprint-based program with compensation per accepted task, typically 2–3 hours per task after ramp-up, and engage with AI coding agents

Hol dir deinen kostenlosen, vertraulichen Lebenslauf-Check.
oder ziehe deine Datei hierhin.
Similar jobs

Ähnliche Jobs, die dir auch gefallen könnten

DevOps Engineer - AI Model Evaluator
DevOps Engineer - AI Model Evaluator

Mercor • Wien

Vor Ort
EUR 167.000 - 239.000
Remote DevOps Engineer for AI Model Evaluation
Remote DevOps Engineer for AI Model Evaluation

Mercor • Wien

Vor Ort
Frontier AI Safety Red Teamer
Frontier AI Safety Red Teamer

Mercor • Wien

Remote
EUR 70.000 - 110.000
Remote AI Model Evaluator for DevOps & Cloud
Remote AI Model Evaluator for DevOps & Cloud

Mercor • Österreich

Vor Ort
EUR 83.000 - 119.000
Senior AI Safety Evaluator for Frontier Models
Senior AI Safety Evaluator for Frontier Models

Mercor • Wien

Vor Ort
EUR 70.000 - 110.000
Senior Frontier AI Safety Red Team Leader
Senior Frontier AI Safety Red Team Leader

Mercor • Wien

Vor Ort
EUR 70.000 - 110.000
Remote AI Safety Red Teamer
Remote AI Safety Red Teamer

Mercor • Österreich

Vor Ort
EUR 84.000 - 100.000
Forward-Deployed AI Engineer
Forward-Deployed AI Engineer

accilium • Wien

Vor Ort
EUR 55.000 - 75.000
Public transport ticket
Corporate benefits
Team events
+1
AI Safety Red Team Expert (Remote)
AI Safety Red Team Expert (Remote)

name • Österreich

Vor Ort
EUR 84.000 - 100.000
Applied AI Engineer (all genders)
Applied AI Engineer (all genders)

Accenture DACH • Wien

Vor Ort
EUR 41.000 - 50.000
Attractive compensation package
Flexible working hours
Modern work environment
+2