Jobs / AI Evaluator
AI Evaluator jobs
AI training roles for rating, reviewing and comparing AI model responses, listed by several platforms. Pay and details are shown as each platform lists them.
Open AI evaluator jobs
54 open roles listed.
- Primary Care Physician (MD) - Clinical Documentation & AI Evaluation — Mercor · $170–$190/hr
- AI Agent Evaluator — micro1 · $25–$45/hr
- GenAI Security Evaluation Engineer (Up to $150/hr) — Turing · $150/hr
- Database Systems Evaluation Expert — Mercor · $2,200/task
- Behavioral Health Expert, AI Safety and Model Evaluation — Mercor · $45–$70/hr
- Hospitalist Reviewer — micro1 · $100–$150/hr
- Software Engineers: Paid Code Review for AI Agent Evaluation — Terac · $65/hr
- Photography Evaluators: Paid Task on Image Quality and Brand Guidelines — Terac · $60/hr
- South Asian Software Engineers: Coding Tasks for AI Evaluation — Terac · $40/hr
- Brazil & Argentina Software Engineers: Coding Tasks for AI Evaluation — Terac · $40/hr
- Generalist — U.S. Tax Workflow Evaluation — micro1 · $30–$110/hr
- Brand Evaluators: Image Evaluation Task — Terac · $85/hr
- Clinical Mental Health Expert — AI Conversation Evaluation — Mercor · $100/hr
- Accounting Professionals: Workflow Evaluation Study — Terac · $100/hr
- Pharmacist / Pharmacy Technician — Medication Pronunciation Reviewer — Mercor · $70/hr
- Staff Research Engineer – Frontier AI, RL & Evaluation — Turing
- Senior Code Quality Engineer – LLM Training and Evaluation — Turing
- Architecture Operations Specialists: Structured Data for Post-Training Evaluation — Terac · $100/hr
- Data Analyst (AI Evaluation) — micro1 · $30–$60/hr
- Gmail & Google Calendar AI Assistant Evaluator — micro1 · $15–$30/hr
- AI Safety and Policy Evaluator — Turing
- Context Elicitation & Conversation Evaluation Specialists - Latam, Southeastern Europe, Asia, Africa — Turing
- Context Elicitation & Conversation Evaluation Specialists - USA, Canada, Western Europe — Turing
- AI Safety and Policy Evaluator — Turing
- Management Consultants: Paid AI Output Evaluation — Terac · $70/task
- Python Engineering Manager – LLM Training & Evaluation — Turing
- Research Engineer - Code Generation & Model Evaluation — micro1 · $50–$100/hr
- Fire & Life Safety Reviewer — Vulcan — Mercor · $45–$60/hr
- Code Plan Reviewer (Plans Examiner) — Vulcan — Mercor · $45–$60/hr
- Engineering Manager – LLM Evaluation — Turing
- Cantonese Language Evaluator — micro1 · $30–$40/hr
- Certified Medical Coder (ICD-10) — Multilingual Clinical Documentation & AI Evaluation — Mercor · $45–$65/hr
- Multilingual Primary Care Physician (MD) — Clinical Documentation & AI Evaluation — Mercor · $170–$190/hr
- Multilingual Inpatient Hospitalist (MD) — Clinical Documentation & AI Evaluation — Mercor · $170/hr
- AI Evaluators: Assessing a Shopping Assistant — Terac · $30/hr
- Senior Hospitalist Clinical Reviewer — micro1 · $70–$100/hr
- Legal Domain Expert — AI Training & Evaluation — Mercor · $60–$100/hr
- Finance Domain Expert — AI Training & Evaluation — Mercor · $60–$100/hr
- AI Rater Guidelines Writer (Linguist / Instructional Designer) — Mercor · $45–$65/hr
- Software Engineer – AI Code Evaluation & Benchmarking (US candidates only) — Turing
- Board Game Reasoning Expert (AI Training & Evaluation) — Turing
- Small business owners (AI response evaluation) - Japanese Business Document — Turing
- Small business owners (AI response evaluation) - Korean Business Document — Turing
- Small business owners (AI response evaluation) - Spanish Business Documents — Turing
- Senior Software Engineer – LLM Evaluation (US/Canada/WEU based) — Turing
- Senior Software Engineer – C#(LLM Evaluation & Repository Validation) — Turing
- Senior Software Engineer – Go (LLM Evaluation & Repository Validation) — Turing
- Senior Software Engineer – Ruby (LLM Evaluation & Repository Validation) — Turing
- Senior Software Engineer – Rust (LLM Evaluation & Repository Validation) — Turing
- Senior Software Engineer – C++ (LLM Evaluation & Repository Validation) — Turing
- Senior Software Engineer – Python (LLM Evaluation & Repository Validation) — Turing
- Senior Software Engineer – LLM Evaluation — Turing
- Applied Engineer, Evaluations Role — Mercor · $100–$120/hr
- Senior Software Engineer – LLM Evaluation & Repository Validation — Turing
Common questions about AI evaluator jobs
What do AI evaluator jobs involve?
Rating, reviewing and comparing AI model responses. Each listing describes its own tasks, requirements and assessment.
Which platforms list AI evaluator jobs?
Right now: Turing (23), Mercor (14), Terac (9) and micro1 (8). Counts are open roles listed on this site and change as platforms add and close roles.
Are AI evaluator jobs remote?
52 of the 54 listed roles are remote; 2 are hybrid or on-site and name a location. Remote roles can still limit which countries applicants can be in.
How much do AI evaluator jobs pay?
It varies by role and platform. 32 of these 54 listings state pay, and each job shows it exactly as the platform lists it (hourly, per task or a fixed amount). This site doesn’t verify or estimate earnings, so confirm pay on the platform before applying.
How do I apply for AI evaluator jobs?
Open a role and select Apply. You sign up, are screened and get paid on the platform that lists the role, not on this site. Apply links are referral links; see the disclosure at the bottom of the page.