Mathematics PhD - AI Evaluation Expert
Mercor · United States · 2 days ago
RemoteRemoteResearch$70/hrPart-time
Mercor connects elite creative and technical talent with leading AI research labs. Headquartered in San Francisco, our investors include Benchmark, General Catalyst, Peter Thiel, Adam D'Angelo, Larry Summers, and Jack Dorsey.
About the role
Contract position, remote, 6 weeks, 20+ hours/week. Compensation: $70/hour.
Responsibilities
- Source material from published papers, Kaggle datasets, open-source repositories, or self-designed scenarios.
- Write scientific prompts based on sourced inputs.
- Build grading criteria to define correct answers.
- Calibrate tasks against frontier models, ensuring tasks ship only when strong models fail more often than succeed.
- Work independently and asynchronously to meet deadlines while improving AI model performance.
Requirements
- PhD in mathematics, applied mathematics, computational mathematics, or a closely related field.
- Depth in at least two subdomains: numerical linear algebra, computational mechanics, computational finance.
- Working proficiency in Python for scientific computing.
- Comfortable with Git/GitHub and running code in Docker.
Qualifications
- Publications in peer-reviewed journals (preferred).
- Prior scientific software or research engineering experience (preferred).
Start Date: Immediate