Remote DevOps Engineer for AI Model Evaluation

Mercor

Lacaussade

Sur place

EUR 84 000 - 119 000

Plein temps

Il y a 7 jours
Soyez parmi les premiers à postuler

Recevez plus de réponses des employeurs

Envoyez un CV adapté au poste en quelques minutes.

Résumé du poste

Mercor is seeking a DevOps / SRE / Cloud Engineer on a contract basis to leverage frontier AI coding agents for infrastructure tasks. The role focuses on evaluating model-generated implementations across cloud platforms, Kubernetes, CI/CD, and observability tooling.

You will identify reliability issues, compare model outputs, and apply professional judgment to realistic infrastructure scenarios. Remote work is supported for this position.

Qualifications

  • 2+ years of professional DevOps, SRE, or Cloud Engineering experience.
  • Experience with AWS, Azure, GCP, Kubernetes, Terraform, CI/CD pipelines, or observability tooling.
  • Regular use of AI coding agents such as Cursor, Claude Code, Codex, Windsurf, Gemini CLI.
  • Ability to evaluate model-generated infrastructure and reliability engineering solutions.

Responsabilités

  • Use frontier AI coding agents to complete and evaluate complex infrastructure engineering tasks.
  • Review model-generated implementations involving cloud platforms, Kubernetes, CI/CD systems, observability, and infrastructure automation.
  • Identify bugs, edge cases, reliability issues, and failure modes in model outputs.
  • Compare outputs from multiple frontier models to assess their strengths and weaknesses.
  • Apply professional engineering judgment to realistic infrastructure engineering scenarios.

Connaissances

DevOps experience
Cloud platforms
Kubernetes
Terraform
CI/CD pipelines
observability tooling
AI coding agents
evaluate model outputs

Outils

Cursor
Claude Code
Codex
Windsurf
Gemini CLI

Description du poste

Mercor is seeking a DevOps / SRE / Cloud Engineer on a contract basis to leverage frontier AI coding agents for infrastructure tasks. The role focuses on evaluating model-generated implementations across cloud platforms, Kubernetes, CI/CD, and observability tooling.

You will identify reliability issues, compare model outputs, and apply professional judgment to realistic infrastructure scenarios. Remote work is supported for this position.

Obtenez votre examen gratuit et confidentiel de votre CV.
ou faites glisser et déposez votre fichier ici.
Similar jobs

Postes similaires à comparer

DevOps Engineer - AI Model Evaluator
DevOps Engineer - AI Model Evaluator

Mercor • Lacaussade

Sur place
EUR 84 000 - 119 000
DevOps Engineer - AI Model Evaluator
DevOps Engineer - AI Model Evaluator

Mercor • Paris

Sur place
EUR 406 000 - 549 000
AI DevOps Evaluator for Frontier Code Agents
AI DevOps Evaluator for Frontier Code Agents

Mercor • Paris

Sur place
EUR 406 000 - 549 000
Remote AI Safety Evaluator (Contract)
Remote AI Safety Evaluator (Contract)

Visa Hunt • France

À distance
EUR 71 000 - 83 000
Remote Computational Mechanics Expert (PhD) for AI Benchmarks
Remote Computational Mechanics Expert (PhD) for AI Benchmarks

Mercor • Lacaussade

Sur place
EUR 83 000 - 101 000
Remote Cloud Security Analyst for AI Training & Evaluation
Remote Cloud Security Analyst for AI Training & Evaluation

Alignerr • France

Sur place
EUR 83 000 - 124 000
Remote freelance work
Flexible schedule
Global collaboration
Remote AI Safety Red Teamer: Stress-Test Frontier Models
Remote AI Safety Red Teamer: Stress-Test Frontier Models

Mercor • Paris

Sur place
EUR 83 000 - 100 000
Remote ML DevOps Engineer — Cloud & Pipelines
Remote ML DevOps Engineer — Cloud & Pipelines

Pathway • Paris

À distance
EUR 70 000 - 110 000
Senior Python Engineer (Contract) — AI Evaluation Lead, Flexible Hours
Senior Python Engineer (Contract) — AI Evaluation Lead, Flexible Hours

Mindrift • France

Sur place
Remote AI Engineer — Build Scalable ML Pipelines
Remote AI Engineer — Build Scalable ML Pipelines

YO IT Consulting • Paris

Sur place
EUR 50 000 - 80 000