AI Developer (Remote, Brazil)
Build, fine‑tune, and deploy ML and LLM‑backed features for products serving users in Brazil and global markets, collaborating remotely with distributed teams.
Key Responsibilities
- Design and implement ML/LLM services (APIs, batch jobs, streaming pipelines) with production reliability and measurable quality targets.
- Create evaluation harnesses for LLM training pipelines, including rubric‑based grading, pairwise preference testing, and prompt regression suites.
- Implement evaluation and monitoring to measure model quality (prompt evaluation, QA evaluation, offline/online testing) and drive model performance improvement.
- Contribute to RLHF‑adjacent workflows by integrating human feedback signals, preference data, and safety policies into training and evaluation loops.
- Partner with data operations to define annotation guidelines, improve training data quality, and resolve edge cases in data labeling and content safety labeling.
- Develop and maintain training pipelines, experiment tracking, CI/CD, and reliable model release processes.
Required Qualifications
- Mid‑Senior experience shipping ML systems to production.
- Strong Python skills and experience with ML frameworks and model serving patterns.
- Hands‑on knowledge of LLMs, prompt engineering, prompt evaluation, and model evaluation metrics.
- Understanding of data labeling workflows and training data quality practices.
- MLOps experience: experiment tracking, model registries, monitoring, and rollback strategies.
Work Model
Remote role targeting Brazil‑focused hiring needs.
Employment Type: Full‑time.