AI Evaluation Jobs in Columbus OH
3 days ago
331.
Remote AI Safety Red Team (English & Dutch
Business (AI Evaluation)
Position: Remote AI Safety Red Team (English & Dutch) - Mercor is recruiting AI safety experts to remotely assess and strengthen AI...
Remote AI Safety Red Team (English & Dutch JobListing for: Mercor |
3 days ago
332.
Project-Based AI Writer & Trainer (English
IT/Tech (Data Annotation/ AI Labeling, AI Evaluation)
Position: Project - Based AI Writer & Trainer (English) - Mindrift connects specialists with project - based AI opportunities for...
Project-Based AI Writer & Trainer (English JobListing for: Socket.dev |
3 days ago
333.
Child Safety Risk Evaluator
Science (AI Evaluation, Data Annotation/ AI Labeling)
Child Safety Risk Evaluator is a remote evaluation track for reviewing child safety risk evaluation prompts and responses against Aura...
Child Safety Risk Evaluator JobListing for: AuraOne |
3 days ago
334.
Preference Dataset QA Reward Model Evaluator
IT/Tech (AI Evaluation, Data Annotation/ AI Labeling, IT QA Tester / Automation)
Preference Dataset QA Reward Model Evaluator is a remote evaluation track for reviewing preference dataset qa reward model evaluation...
Preference Dataset QA Reward Model Evaluator JobListing for: AuraOne |
3 days ago
335.
Data Science Experts
IT/Tech (Data Analyst, Data Scientist, AI Engineer (Applied/Software), AI Evaluation)
Data Science Experts is a remote review track for evaluating AI outputs across data science experts specialist operations workflows....
Data Science Experts JobListing for: AuraOne |
3 days ago
336.
Physical Affordance Failure Case Reviewer
Research/Development (AI Evaluation, Data Scientist)
Physical Affordance Failure Case Reviewer is a remote review track for evaluating AI outputs across physics reasoning, calculations, and...
Physical Affordance Failure Case Reviewer JobListing for: AuraOne |
3 days ago
337.
Remote Subject Matter Expert - AI Benchmarking for Pro Services
IT/Tech (AI Evaluation)
LILT is seeking an experienced Subject Matter Expert to support a cutting - edge AI benchmarking project focused on Japanese corporate,...
Remote Subject Matter Expert - AI Benchmarking for Pro Services JobListing for: Lilt |
3 days ago
338.
Secrets Detection Security Evaluator
IT/Tech (AI Evaluation)
Secrets Detection Security Evaluator is a remote evaluation track for reviewing secrets detection security evaluation prompts and...
Secrets Detection Security Evaluator JobListing for: AuraOne |
3 days ago
339.
Constraint Solving Model Evaluator
IT/Tech (AI Evaluation, Data Annotation/ AI Labeling)
Constraint Solving Model Evaluator is a remote evaluation track for reviewing constraint solving model evaluation prompts and responses...
Constraint Solving Model Evaluator JobListing for: AuraOne |
3 days ago
340.
AI Red Team Specialist - English & Norwegian - Remote
Science (AI Evaluation, Data Annotation/ AI Labeling)
Mercor is building a red - team for AI safety. The work involves reviewing AI outputs touching bias, misinformation, or harmful...
AI Red Team Specialist - English & Norwegian - Remote JobListing for: Neon |