Stand out for this role — generate a tailored resume and cover letter in about a minute.
Obsidian is seeking an evaluation-focused ML scientist to assess applied ML rigor in frontier AI research settings. You will critique experiment designs, model-selection reasoning, and evaluation methodologies, delivering rubric-based feedback to improve reproducibility and validity.
Responsibilities emphasize identifying data leakage, metric gaming, and CV hygiene issues, ensuring claims are well-supported by evidence and experiments are replicable across datasets and baselines.
Obsidian is seeking an evaluation-focused ML scientist to assess applied ML rigor in frontier AI research settings. You will critique experiment designs, model-selection reasoning, and evaluation methodologies, delivering rubric-based feedback to improve reproducibility and validity.
Responsibilities emphasize identifying data leakage, metric gaming, and CV hygiene issues, ensuring claims are well-supported by evidence and experiments are replicable across datasets and baselines.