Remote AI Research Scientist: LLM Evaluation & Experiments
Rex.zone
United States
Remote
USD 41,328 - 68,880
Part time
14 days+
Application generator
Stand out for this role — generate a tailored resume and cover letter in about a minute.
Get past ATS filters
Job summary
A tech company is seeking an AI Researcher to support end-to-end research for modern AI systems. This remote role involves designing experiments, defining evaluation protocols, and improving evaluation rigor for large language models. Key responsibilities include developing AI research experiments, performing error analysis, and supporting data quality practices. Ideal candidates will have a fundamental understanding of AI and machine learning, along with experience in NLP or computer vision. Competitive pay ranges from $30 to $50 per hour.
Qualifications
Experience with hands-on RLHF concepts including preference data and reward modeling.
Familiarity with training data quality practices.
Ability to collaborate cross-functionally with engineering teams.
Responsibilities
Develop and run AI research experiments.
Design evaluation harnesses for model evaluation.
Define RLHF and preference modeling evaluation protocols.
Perform error analysis and prompt evaluation.
Build reproducible pipelines for data curation.
Skills
AI research fundamentals
Machine learning research fundamentals
Experience with large language models
Strong experiment design
Statistics basics
NLP knowledge
Computer vision knowledge
Job description
A tech company is seeking an AI Researcher to support end-to-end research for modern AI systems. This remote role involves designing experiments, defining evaluation protocols, and improving evaluation rigor for large language models. Key responsibilities include developing AI research experiments, performing error analysis, and supporting data quality practices. Ideal candidates will have a fundamental understanding of AI and machine learning, along with experience in NLP or computer vision. Competitive pay ranges from $30 to $50 per hour.