Global opportunities

Remote job listings

Find your next remote opportunity from thousands of listings across the globe.

Filters

98 remote jobs found
Copyediting & Language Review Contractor ↻ Reposted
English Language Proficiency Linguistics Grammar & Syntax +12 Semantics & Pragmatics Discourse Analysis Copyediting Proofreading Technical Writing AI Model Evaluation Data Annotation (AI) Content Review Fact-Checking Localization Multilingual Communication Attention to Detail
  • Remote (Global)
  • Upto $20/hr
  • Jul 19, 2026

Role Overview In this hourly, remote contractor role, you will review AI-generated English-language responses and/or create expert-level language content. You will evaluate reasoning quality, perform step-by-step edits, and provide precise, actionable feedback to improve AI…

Red Team / Safety Evaluator Contractor Short-term ↻ Reposted
Cybersecurity Data Annotation Technical Writing +12 LLM Evaluation English AI Safety Prompt Injection Jailbreaking Adversarial Testing Vulnerability Analysis Risk Management Safety Benchmarking Punjabi Annotation Security Research
  • Remote (Global)
  • $20 - $22/hour
  • Jul 19, 2026

Mercor is seeking bilingual AI Safety Experts fluent in both English and Punjabi to help evaluate and strengthen the safety of frontier AI systems. This role focuses on red teaming AI models by identifying vulnerabilities, testing misuse scenarios, and generating high-quality…

AI Safety LLM Evaluation Trust & Safety +11 RLHF SFT Content Moderation Policy analysis AI Alignment Prompt Evaluation Risk Management Critical Thinking Analytical Reasoning Technical Writing Quality Assurance
  • Remote (Global)
  • $60–$70/hour
  • Jul 16, 2026

Evaluate the safety, quality, and alignment of frontier AI models by reviewing policy-sensitive content, applying AI safety standards, identifying model failures, and helping improve next-generation AI systems.

AI Safety Prompt Engineering Adversarial Testing +10 LLM Evaluation AI Alignment RLHF SFT Trust & Safety Jailbreak Testing Content Safety Cybersecurity Risk Management Technical Writing
  • Remote (Global)
  • $70–$84/hour
  • Jul 16, 2026

Help secure frontier AI models by designing adversarial prompts, identifying jailbreaks and safety vulnerabilities, evaluating AI behavior across high-risk domains, and improving AI alignment through structured red-team assessments.

Systems Engineer Contractor
Performance Engineering Systems Programming C++ +11 Python Rust Low-Level Optimization Compiler Engineering Runtime Optimization AI Infrastructure LLM Evaluation Technical Writing Performance Analysis Memory Optimization Latency Optimization
  • United States
  • $70–$110/hour
  • Jul 16, 2026

Design and evaluate performance engineering tasks for frontier AI systems using C++, Python, and Rust while improving runtime performance, systems optimization, compiler engineering, and AI infrastructure training data.

MLOps Engineer Contractor
MLOps Machine Learning Infrastructure JAX +10 PyTorch Pallas Triton GPU Programming Kernel Optimization Distributed Systems AI Infrastructure Training Pipelines LLM Evaluation Technical Writing
  • United States
  • $70–$110/hour
  • Jul 16, 2026

Design and evaluate MLOps engineering tasks for frontier AI systems using JAX, PyTorch, and custom GPU kernels with Pallas or Triton while improving ML infrastructure, distributed training, and AI model evaluation.

Model Context Protocol (MCP) AI Plugins AI Connectors +10 Prompt Engineering LLM Evaluation Rubric Design Quality Assurance Google Drive Notion Expedia Workflow Testing Technical Writing User Research
  • United States
  • $50–$190/hour
  • Jul 16, 2026

Evaluate frontier AI systems by testing complex real-world workflows using Model Context Protocol (MCP) and AI plugins/connectors, creating evaluation rubrics, and assessing AI performance across travel, productivity, health, and personal planning tasks.

Academic research AI Evaluation Data Annotation +9 data-labeling Research Technical Writing Critical Thinking Quality Assurance Benchmarking Rubric Evaluation Analytical Skills Written communication
  • United States, Canada, United Kingdom
  • $65–$75/hour
  • Jul 14, 2026

Help train frontier AI models by reviewing, evaluating, and annotating AI-generated content using academic research expertise and structured evaluation guidelines.

Brand Strategy Brand Positioning Creative Strategy +12 Creative Direction Advertising Campaign Development integrated-marketing Copywriting Marketing Communications client-presentations AI Evaluation LLM Evaluation Evaluation Rubrics Technical Writing Critical Thinking
  • Remote (Global)
  • $80 - $150/hr
  • Jul 11, 2026

Seeking experienced marketing professionals to design evaluation rubrics, assess AI-generated marketing work, and improve frontier AI systems through rigorous, evidence-based evaluation.

AI Expert - Sales Full-time
B2B Sales Enterprise Sales Account Executive +13 Sales Development Prospecting Discovery Calls Pipeline Management Sales Forecasting Territory Planning account-planning Sales Strategy AI Evaluation LLM Evaluation Evaluation Rubrics Technical Writing Critical Thinking
  • Remote (Global)
  • $100 - $150/hr
  • Jul 11, 2026

Seeking experienced B2B sales professionals to design evaluation rubrics, assess AI-generated enterprise sales work, and improve frontier AI systems through rigorous, evidence-based evaluation.

Accounting Financial Reporting US GAAP +12 Audit Assurance advisory Account Reconciliation Month-End Close Financial Statements Technical Accounting AI Evaluation LLM Evaluation Evaluation Rubrics Technical Writing Critical Thinking
  • Remote (Global)
  • $130 - $160/hr
  • Jul 11, 2026

Seeking experienced accounting professionals to design evaluation rubrics, assess AI-generated accounting work, and improve frontier AI systems through rigorous, evidence-based evaluation.

Data Science Machine Learning SQL +12 Python A/B Testing Experiment Design Statistical Analysis Product Analytics Growth Analytics dashboard-evaluation AI Evaluation LLM Evaluation Evaluation Rubrics Technical Writing Critical Thinking
  • Remote (Global)
  • $120 - $170/hr
  • Jul 11, 2026

Seeking experienced Data Scientists to design evaluation rubrics, assess AI-generated data science work, and improve frontier AI systems through rigorous, evidence-based evaluation.

Brand Strategy Growth Marketing Performance Marketing +9 Marketing Strategy Campaign Management Digital Marketing AI Evaluation LLM Evaluation Evaluation Rubrics Business Analysis Critical Thinking Technical Writing
  • United States
  • $60 - $80/hr
  • Jul 11, 2026

Seeking experienced marketing professionals with AI evaluation experience to design marketing tasks, evaluate LLM outputs, develop scoring rubrics, and improve the marketing reasoning capabilities of frontier AI models.

Insurance Underwriting Claims Management Risk Assessment +9 Risk Management Actuarial Analysis Insurance Operations AI Evaluation LLM Evaluation Evaluation Rubrics Business Analysis Critical Thinking Technical Writing
  • United States
  • $60 - $80/hr
  • Jul 11, 2026

Seeking experienced insurance professionals with AI evaluation experience to design insurance tasks, evaluate LLM outputs, develop scoring rubrics, and improve the insurance reasoning capabilities of frontier AI models.

retail-merchandising Category Management Retail Operations +9 buying-planning retail-strategy AI Evaluation LLM Evaluation Evaluation Rubrics Business Analysis Retail Analytics Critical Thinking Technical Writing
  • United States
  • $60 - $80/hr
  • Jul 11, 2026

Seeking experienced retail professionals with AI evaluation experience to design retail tasks, evaluate LLM outputs, develop scoring rubrics, and improve the retail reasoning capabilities of frontier AI models.

Financial Analysis Corporate Finance Investment Banking +9 Asset Management Financial Advisory AI Evaluation LLM Evaluation Evaluation Rubrics Financial Modeling Financial Reasoning Analytical thinking Technical Writing
  • United States
  • $65 - $90/hr
  • Jul 11, 2026

Seeking experienced finance professionals with AI evaluation experience to design finance tasks, evaluate LLM outputs, develop scoring rubrics, and improve the financial reasoning capabilities of frontier AI models.

Linguistics Instructional Design Technical Writing +9 AI Training RLHF Generative AI Evaluation Rubrics annotation-guidelines Documentation Prompt Evaluation Written communication Quality Assurance
  • United States
  • $45 - $65/hr
  • Jul 11, 2026

Seeking experienced linguists, instructional designers, and technical writers to create AI rater guidelines, evaluation rubrics, and annotation instructions that improve the consistency and quality of frontier AI training data.

AI Expert - Software Engineering Contractor · Full-time
Machine Learning Data Science LLM Evaluation +12 LLM Prompt Engineering Technical Writing AI Agent Workflows Autonomous AI Coding Agents AI Coding Assistants Software Engineering Code Refactoring Debugging AI-Generated Code Evaluation Workflow Documentation DevOps Machine Learning Engineering
  • Remote (Global)
  • $50–$100/hr
  • Jul 9, 2026

Collaborate with autonomous AI coding agents, evaluate AI-generated code, and help improve agentic software engineering workflows for next-generation AI systems.

AI Expert - Accounting Contractor · Part-time
Accounting Financial Reporting Financial Statement Analysis +11 GAAP IFRS Auditing Tax Corporate Accounting Public Accounting Accounting Advisory Corporate Finance CPA LLM Evaluation Technical Writing
  • Remote (Global)
  • $85/hr
  • Jul 8, 2026

Evaluate AI-generated responses to complex accounting problems, helping improve AI systems' accounting capabilities. Collaborate with leading AI researchers and apply your professional accounting expertise to real-world AI evaluation.

Data Annotation LLM Evaluation Content Review +10 Analytical thinking Structured Labeling Technical Writing Research Analysis Quality Assurance Documentation Annotation Tools Professional Judgment Citation Analysis Remote Collaboration
  • Remote (Global)
  • $25 - $60/hr
  • Jun 25, 2026

This is a remote, project-based opportunity for experienced professionals across any domain who can apply real-world expertise to AI data annotation and evaluation tasks. Contributors will review, label, and evaluate: Text samples Documents AI model outputs Domain-specific…

Mathematics mathematical-problem-solving Academic Writing +5 Content Review Problem Solving Analytical thinking Scientific Research Technical Writing
  • Remote (Global)
  • $80-$90/hr
  • Jun 25, 2026

Job Summary micro1 is engaging Math Experts (PhD) to contribute to an advanced AI training project for a customer. In this role, you will apply your expertise to help train next-generation AI systems. Your work will shape how models learn, reason, and perform through…

Chemistry Scientific Writing educational-content-development +5 Data Analysis research-methodology Technical Writing Scientific Research Quality Assurance
  • Remote (Global)
  • $80-$90/hr
  • Jun 24, 2026

Job Summary micro1 is engaging Chemistry Experts (PhD) to contribute their advanced subject-matter expertise to a customer's AI training initiative. In this role, you will apply your expertise to help train next-generation AI systems. Your work will shape how models learn,…

AI Expert - Biology Contractor
Biology Scientific Data Analysis critical-evaluation +5 Scientific Communication Data Analysis Scientific Research Technical Writing Quality Assurance
  • Remote (Global)
  • $80-$90/hr
  • Jun 24, 2026

Job Summary micro1 is engaging Biology Experts (PhD) to contribute to a dynamic customer project focused on advancing artificial intelligence. In this role, you will apply your expertise to help train next-generation AI systems. Your work will shape how models learn, reason, and…

AI Expert - Physics Contractor
Physics Scientific Data Analysis Technical Writing +6 Analytical thinking Problem Solving educational-content-development Quality Assurance Scientific Research Scientific Communication
  • Remote (Global)
  • $80-$90/hr
  • Jun 24, 2026

Job Summary micro1 is engaging Physics (PhD) experts to contribute their advanced knowledge to a high-impact AI development project. In this role, you will apply your expertise to help train next-generation AI systems. Your work will shape how models learn, reason, and perform…

Sciences (AI) Contractor
Calculus Data Analysis Literature Review +7 Experimental Design research-methodology Technical Writing Electrical Engineering Mechanical Engineering Chemical Engineering Scientific Research
  • Remote (Global)
  • $80-$90/hr
  • Jun 24, 2026

Job Summary micro1 is engaging PhD-level Engineers in Electrical, Mechanical, or Chemical disciplines to contribute to a high-impact customer project. In this role, you will apply your expertise to help train next-generation AI systems. Your work will shape how models learn,…

Automated Planning Symbolic AI Artificial Intelligence +10 Machine Learning Operations Research Knowledge Representation Search Algorithms Quality Assurance Technical Review LLM Evaluation Reasoning Systems Technical Writing Problem Validation
  • United States, United Kingdom, Canada, Australia, New Zealand
  • $55-$80/hour
  • Jun 23, 2026

Mercor is seeking Automated CS Planning QA Reviewers for a premier project with one of the world's leading AI laboratories. In this role, you will review and quality-check advanced symbolic AI and automated planning problems created by domain experts. Your work will help ensure…

Automated Planning Symbolic AI Artificial Intelligence +11 Machine Learning Operations Research Search Algorithms Knowledge Representation Planning Systems Decision Theory Reasoning Systems Problem Design LLM Evaluation Research Technical Writing
  • United States, United Kingdom, Canada, Australia, New Zealand
  • $55-$80/hr
  • Jun 23, 2026

Mercor is seeking Automated CS Planning PhDs and Domain Experts for a premier project with one of the world's leading AI laboratories. In this role, you will apply advanced expertise in automated planning, symbolic AI, artificial intelligence, machine learning, and related…

AI Expert - Mathematics Contractor Short-term
Olympiad Mathematics IMO Mathematical Proofs +11 Problem Solving Mathematical Reasoning Problem Writing Competition Mathematics Geometry Number Theory Combinatorics Algebra LLM Evaluation Research Technical Writing
  • Remote (Global)
  • $54-$93/hr
  • Jun 23, 2026

Mercor is partnering with a leading frontier AI research laboratory on an advanced mathematics project focused on improving AI reasoning capabilities. The project seeks individuals with demonstrated expertise in Olympiad-level mathematics, mathematical problem writing, and…

AI Expert - Mathematics Contractor Ongoing
Mathematical Research Proof Verification Proof Construction +14 Advanced Mathematics Logical Reasoning Technical Writing research-evaluation Academic Review Number Theory Algebra Topology Analysis Probability Combinatorics AI Evaluation LLM Evaluation Benchmark Development
  • United States
  • $90 – $150/hr
  • Jun 15, 2026

About the Role Cincinnatus LLC — in partnership with Mercor — is recruiting accomplished research mathematicians to contribute to the development of next-generation AI systems capable of advanced mathematical and scientific reasoning. Contributors will work with leading AI…

Computer Vision Machine Learning Vision Foundation Models +11 Model Fine-Tuning Image Classification Object Detection Defect Detection Benchmarking Model Evaluation Calibration Dataset Analysis Technical Writing Quality Scoring Deep Learning
  • Remote (Global)
  • $135 – $135/hr
  • Jun 15, 2026

About the Role Mercor is seeking a senior Computer Vision Machine Learning Engineer (MLE) for a remote, contingent W2 engagement focused on evaluating the feasibility of a computer vision system that identifies and grades physical objects from images. The initial engagement is…

AI Expert - Cybersecurity Contractor · Part-time Ongoing
Cybersecurity Software Engineering Application Security +11 Network Security Cloud Security Secure Coding Vulnerability Research Penetration Testing Threat Modeling Security Engineering Technical Writing AI Safety Risk Assessment Red Teaming
  • United States
  • $60 – $90/hr
  • Jun 13, 2026

About the Role Mercor is hiring Cybersecurity Software Engineers to help improve the safety and reliability of advanced AI systems. In this role, you will apply your cybersecurity and software engineering expertise to evaluate, annotate, and strengthen how AI models handle…

Mechanical Engineering Statics Dynamics +10 Thermodynamics Fluid Mechanics Heat Transfer Mechanics of Materials Machine Design Engineering Analysis Technical Review Quality Assurance Technical Writing Root Cause Analysis
  • Remote (Global)
  • $90 – $90/hr
  • Jun 12, 2026

About the Role Mercor is seeking experienced Mechanical Engineering professionals to support a high-impact quality assurance and technical review initiative focused on improving engineering content quality and accuracy. In this role, you will evaluate, validate, and improve…

Red Team / Safety Evaluator Contractor Short-term
Data Annotation Technical Writing Cybersecurity +12 LLM Evaluation English AI Safety Prompt Injection Jailbreaking Adversarial Testing Vulnerability Analysis Risk Management Safety Benchmarking Marathi Annotation Security Research
  • Remote (Global)
  • $20 - $22/hour
  • Jun 11, 2026

Mercor is seeking bilingual AI Safety Experts fluent in both English and Marathi to help evaluate and strengthen the safety of frontier AI systems. This role focuses on red teaming AI models by identifying vulnerabilities, testing misuse scenarios, and generating high-quality…

AI Expert - Software Engineering Contractor Short-term
Data Science Data Analysis Technical Writing +12 API Documentation Python Research LLM Evaluation Software Engineering Data Analytics Technical Documentation System Design Benchmark Creation Instruction Following Evaluation Code Review Rubric Design
  • Remote (Global)
  • $60-$75/hr
  • Jun 11, 2026

Mercor is building a benchmark dataset to evaluate AI models on professional document understanding and instruction following within the Technology domain. Contributors will create high-quality evaluation tasks based on real-world technical materials including: Technical…

Python Scientific Research Academic research +7 AI Evaluation Technical Writing Attention to Detail Scientific Computing Benchmark Design Seismology Geophysics
  • Remote (Global)
  • $70 – $100/hr
  • Jun 9, 2026

About the Project We're building a large-scale evaluation benchmark for advanced AI reasoning across scientific and engineering domains. Task designers create challenging computational problems that test whether AI systems can use real scientific software tools to solve…

AI Expert - Biology Contractor · Part-time
Python Scientific Research Academic research +7 AI Evaluation Technical Writing Attention to Detail Scientific Computing Benchmark Design Bioinformatics Single-Cell Genomics
  • Remote (Global)
  • $70 – $100/hr
  • Jun 9, 2026

About the Project We're building a large-scale evaluation benchmark for advanced AI reasoning across scientific and engineering domains. Task designers create challenging computational problems that test whether AI systems can use real scientific software tools to solve…

AI Expert - Physics Contractor · Part-time
Python Scientific Research Academic research +7 AI Evaluation Technical Writing Attention to Detail Scientific Computing Benchmark Design Astrophysics Cosmology
  • Remote (Global)
  • $70 – $100/hr
  • Jun 9, 2026

About the Project We're building a large-scale evaluation benchmark for advanced AI reasoning across scientific and engineering domains. Task designers create challenging computational problems that test whether AI systems can use real scientific software tools to solve…

AI Expert - Physics Contractor · Part-time
Python Scientific Research Academic research +7 AI Evaluation Technical Writing Attention to Detail Scientific Computing Benchmark Design Particle Physics Nuclear Physics
  • Remote (Global)
  • $70 – $100/hr
  • Jun 9, 2026

About the Project We're building a large-scale evaluation benchmark for advanced AI reasoning across scientific and engineering domains. Task designers create challenging computational problems that test whether AI systems can use real scientific software tools to solve…

AI Expert - Biology Contractor · Part-time
Python Scientific Research Academic research +7 AI Evaluation Technical Writing Attention to Detail Scientific Computing Benchmark Design Pharmacokinetics Systems Biology
  • Remote (Global)
  • $70 – $100/hr
  • Jun 9, 2026

About the Project We're building a large-scale evaluation benchmark for advanced AI reasoning across scientific and engineering domains. Task designers create challenging computational problems that test whether AI systems can use real scientific software tools to solve…

AI Expert - Mechanical Engineering Contractor · Part-time
Python Scientific Research Academic research +7 AI Evaluation Technical Writing Attention to Detail Scientific Computing Benchmark Design Structural Engineering Finite Element Analysis
  • Remote (Global)
  • $70 – $100/hr
  • Jun 9, 2026

About the Project We're building a large-scale evaluation benchmark for advanced AI reasoning across scientific and engineering domains. Task designers create challenging computational problems that test whether AI systems can use real scientific software tools to solve…

AI Expert - Electrical Engineering Contractor · Part-time
Python Scientific Research Academic research +8 AI Evaluation Technical Writing Attention to Detail Scientific Computing Benchmark Design Electrical Engineering RF Design Circuit Simulation
  • Remote (Global)
  • $70 – $100/hr
  • Jun 9, 2026

About the Project We're building a large-scale evaluation benchmark for advanced AI reasoning across scientific and engineering domains. Task designers create challenging computational problems that test whether AI systems can use real scientific software tools to solve…

AI Expert - Chemistry Contractor · Part-time
Python Scientific Research Academic research +7 AI Evaluation Technical Writing Attention to Detail Scientific Computing Benchmark Design Computational Chemistry Quantum Chemistry
  • Remote (Global)
  • $70 – $100/hr
  • Jun 9, 2026

About the Project We're building a large-scale evaluation benchmark for advanced AI reasoning across scientific and engineering domains. Task designers create challenging computational problems that test whether AI systems can use real scientific software tools to solve…

Python Developer Contractor
AI Evaluation Algorithms API Development +11 Backend Engineering CI/CD Code Review Containerization Data Structures Distributed Systems Performance Optimization Python System Design Technical Writing Unit Testing
  • Bangladesh, Bhutan, Brazil, Cambodia, Germany, India, Indonesia, Malaysia, Nepal, Pakistan, Singapore, Sri Lanka, Thailand, Philippines, United States, Timor-Leste, Vietnam
  • Up to $60/hr
  • Jun 7, 2026

<h2>About the Role</h2> <p>As a Senior Python Engineer, you will review AI-generated Python solutions and technical explanations while creating high-quality reference content that helps improve advanced AI systems.</p> <p>You will evaluate:</p> <ul> <li>Code correctness</li>…

Red Team / Safety Evaluator Contractor Short-term
Cybersecurity LLM Evaluation Technical Writing +11 English AI Safety Prompt Injection Jailbreaking Adversarial Testing Vulnerability Analysis Risk Management Safety Benchmarking Odia Annotation Security Research
  • Remote (Global)
  • $20 - $22/hour
  • Jun 6, 2026

Mercor is seeking bilingual AI Safety Experts fluent in both English and Odia to help evaluate and strengthen the safety of frontier AI systems. This role focuses on red teaming AI models by identifying vulnerabilities, testing misuse scenarios, and generating high-quality…

Red Team / Safety Evaluator Contractor Short-term
LLM Evaluation Data Annotation Technical Writing +12 Cybersecurity English AI Safety Prompt Injection Jailbreaking Adversarial Testing Vulnerability Analysis Risk Management Safety Benchmarking Gujarati Annotation Security Research
  • Remote (Global)
  • $20 - $22/hour
  • Jun 6, 2026

Mercor is seeking bilingual AI Safety Experts fluent in both English and Gujarati to help evaluate and strengthen the safety of frontier AI systems. This role focuses on red teaming AI models by identifying vulnerabilities, testing misuse scenarios, and generating high-quality…

Red Team / Safety Evaluator Contractor Short-term
LLM Evaluation Data Annotation Technical Writing +12 Cybersecurity English AI Safety Prompt Injection Jailbreaking Adversarial Testing Vulnerability Analysis Risk Management Safety Benchmarking Assamese Annotation Security Research
  • Remote (Global)
  • $20 - $22/hour
  • Jun 6, 2026

Mercor is seeking bilingual AI Safety Experts fluent in both English and Assamese to help evaluate and strengthen the safety of frontier AI systems. This role focuses on red teaming AI models by identifying vulnerabilities, testing misuse scenarios, and generating high-quality…

Page 1 of 3

Tips for finding remote jobs

  • Set up job alerts on multiple platforms to never miss an opportunity.
  • Highlight your remote work experience and self-management skills.
  • Prepare for video interviews and remote work assessments.
  • Customize your resume and cover letter for each remote position.
  • Build a strong online presence on LinkedIn and professional networks.

Stay in the loop.

One email per week, 5 hand-picked roles.