Global opportunities

Remote job listings

Find your next remote opportunity from thousands of listings across the globe.

Filters

408 remote jobs found
Mathematics Algebra Calculus +12 Geometry Topology Applied Mathematics Statistics Python Mathematical Proofs Scientific Computing AI Training Large Language Models (LLMs) LLM Evaluation Prompt Engineering Data Annotation
  • Remote (Global)
  • Jul 20, 2026

Help improve frontier AI models by designing advanced mathematics problems, evaluating AI reasoning, developing computational solutions in Python, and contributing to formal theorem-proving tasks using Lean in a flexible remote contractor role.

AI Expert - Chemistry Contractor · Full-time
Chemistry Physical Chemistry Organic Chemistry +12 Inorganic Chemistry Chemical Engineering Biochemistry Stoichiometry Thermodynamics Electrochemistry Reaction Mechanisms AI Training Large Language Models (LLMs) LLM Evaluation Scientific Writing Data Annotation
  • Remote (Global)
  • Jul 20, 2026

Help improve frontier AI models by creating advanced chemistry problems, evaluating AI reasoning, and developing multimodal scientific content featuring chemical equations, reaction mechanisms, and detailed explanations in a flexible remote contractor role.

AI Expert - Biology Contractor
Biology Molecular Biology Cellular Biology +11 Biochemistry Microbiology Scientific Research AI Training Large Language Models (LLMs) Prompt Writing LLM Evaluation Data Annotation Scientific Writing Analytical Skills English Communication
  • Remote (Global)
  • Jul 20, 2026

Help improve frontier AI models by designing advanced Biology questions, evaluating AI reasoning, and creating high-quality scientific solutions in this flexible remote contractor role for Master's and PhD-level Biology experts.

Business & Finance (AI) Contractor · Part-time Short-term
Indian Domestic Tax Corporate Tax Direct Tax +12 GST TDS TCS CBDT Circulars Tax Research Tax Review Tax Opinions Tax Litigation Advisory Memoranda Assessments and Appeals LLM Evaluation Quality Assurance
  • India
  • $55–$80/hr
  • Jul 20, 2026

Review AI-generated Indian domestic tax research, validate statutory authorities, improve grading rubrics, and ensure technical accuracy across Indian tax topics in this flexible remote contractor role.

Business & Finance (AI) Contractor · Part-time Short-term
Singapore Domestic Tax Corporate Income Tax Individual Income Tax +12 GST Withholding Tax Property Tax Stamp Duty IRAS Guidance Income Tax Act GST Act Tax Research Tax Review Tax Memoranda Advisory Opinions LLM Evaluation
  • Singapore
  • $95–$125/hr
  • Jul 20, 2026

Review AI-generated Singapore domestic tax research, validate IRAS guidance and statutory authorities, improve grading rubrics, and ensure technical accuracy across Singapore tax topics in this flexible remote contractor role.

Business & Finance (AI) Contractor · Part-time Short-term
UK Domestic Tax Corporate Tax Personal Income Tax +12 Capital Gains Tax VAT Stamp Duty HMRC Guidance UK Tax Legislation Tax Research Tax Review Tax Opinions Tax Memoranda Compliance Documentation Case Law Analysis LLM Evaluation
  • United Kingdom
  • $110–$140/hr
  • Jul 20, 2026

Review AI-generated UK domestic tax research, validate legal authorities, improve grading rubrics, and ensure technical accuracy across UK tax topics in this flexible remote contractor role.

Red Team / Safety Evaluator Contractor Short-term ↻ Reposted
Cybersecurity Data Annotation Technical Writing +12 LLM Evaluation English AI Safety Prompt Injection Jailbreaking Adversarial Testing Vulnerability Analysis Risk Management Safety Benchmarking Punjabi Annotation Security Research
  • Remote (Global)
  • $20 - $22/hour
  • Jul 19, 2026

Mercor is seeking bilingual AI Safety Experts fluent in both English and Punjabi to help evaluate and strengthen the safety of frontier AI systems. This role focuses on red teaming AI models by identifying vulnerabilities, testing misuse scenarios, and generating high-quality…

Personal Workflow Evaluator Contractor ↻ Reposted
LLM Evaluation Critical Thinking Attention to Detail +9 Research English Analytical Reasoning Written communication Reading Comprehension Quality Assessment Structured Evaluation Content Review Judgment & Decision Making
  • Remote (Global)
  • $70/hr
  • Jul 19, 2026

Oerview Mercor is seeking Generalist Experts to evaluate AI-generated responses and provide structured written feedback that helps improve frontier AI systems. This role is ideal for analytical thinkers with strong reasoning and communication skills who can assess complex…

Thai AI Product Management +12 Onboarding Programming Transcription Translation Analysis Testing Localization Verification Organization LLM Evaluation Data Services Linguistic analysis
  • United States
  • Jul 18, 2026

LIVE VIRTUAL ENROLLMENT EVENT – Thai AI Evaluators Needed! Earn $250 USD Plus, if you don't have a Google Pixel phone, we'll provide one for you! We're looking for Thai speakers living in the United States to participate in an exciting Google Pixel AI evaluation project.

Polish AI Product Management +12 Onboarding Programming Transcription Translation Analysis Testing Localization Verification Organization LLM Evaluation Data Services Linguistic analysis
  • United States
  • Jul 17, 2026

LIVE VIRTUAL ENROLLMENT EVENT – Polish AI Evaluators Needed! Earn $250 USD Plus, if you don't have a Google Pixel phone, we'll provide one for you! We're looking for Polish speakers living in the United States to participate in an exciting Google Pixel AI evaluation project.

Korean AI Product Management +12 Onboarding Programming Transcription Translation Analysis Testing Localization Verification Organization LLM Evaluation Data Services Linguistic analysis
  • United States
  • Jul 17, 2026

LIVE VIRTUAL ENROLLMENT EVENT – Korean AI Evaluators Needed! Earn $300 USD Plus, if you don't have a Google Pixel phone, we'll provide one for you! We're looking for Korean speakers living in the United States to participate in an exciting Google Pixel AI evaluation project.

English AI Product Management +12 Onboarding Programming Transcription Translation Analysis Testing Localization Verification Organization LLM Evaluation Data Services Linguistic analysis
  • United States
  • Jul 17, 2026

LIVE VIRTUAL ENROLLMENT EVENT – Indian English AI Evaluators Needed! Earn $225 USD Plus, if you don't have a Google Pixel phone, we'll provide one for you!

Catalan Catalan Language Language Evaluation +11 AI Training LLM Evaluation Data Annotation Text Evaluation Audio Evaluation Proofreading Grammar Localization Linguistics Translation Quality Assurance
  • Remote (Global)
  • $26/hour
  • Jul 17, 2026

Evaluate AI-generated Catalan text and audio, provide grammar and cultural corrections, and help improve AI language understanding through high-quality language evaluations completed on a flexible weekly schedule.

Evaluation & Quality Full-time ↘ +2 regions
Dutch AI Accuracy +12 Consistency Microsoft Teams Annotation English Communication Research LLM Evaluation Data Annotation Content Evaluation English Proficiency Research Skills Dutch Language
  • Spain
  • $27.97/hr
  • Jul 17, 2026

Get Paid as a Dutch Expert Rater | Remote | $27.97/hr Are you an experienced Dutch-speaking Rater looking for your next remote opportunity? Join Welo Data and help improve the quality of AI systems while working from anywhere.

German AI Accuracy +12 Consistency Microsoft Teams Annotation English Communication Research LLM Evaluation Data Annotation Content Evaluation English Proficiency Research Skills Google Workspace
  • Germany
  • From $23.7/hr
  • Jul 17, 2026

Get Paid as a German Expert Rater | Remote | $23.71/hr Are you an experienced German Rater looking for your next remote opportunity? Join Welo Data and help improve the quality of AI systems while working from home.

AI Safety LLM Evaluation Trust & Safety +11 RLHF SFT Content Moderation Policy analysis AI Alignment Prompt Evaluation Risk Management Critical Thinking Analytical Reasoning Technical Writing Quality Assurance
  • Remote (Global)
  • $60–$70/hour
  • Jul 16, 2026

Evaluate the safety, quality, and alignment of frontier AI models by reviewing policy-sensitive content, applying AI safety standards, identifying model failures, and helping improve next-generation AI systems.

AI Safety Prompt Engineering Adversarial Testing +10 LLM Evaluation AI Alignment RLHF SFT Trust & Safety Jailbreak Testing Content Safety Cybersecurity Risk Management Technical Writing
  • Remote (Global)
  • $70–$84/hour
  • Jul 16, 2026

Help secure frontier AI models by designing adversarial prompts, identifying jailbreaks and safety vulnerabilities, evaluating AI behavior across high-risk domains, and improving AI alignment through structured red-team assessments.

Systems Engineer Contractor
Performance Engineering Systems Programming C++ +11 Python Rust Low-Level Optimization Compiler Engineering Runtime Optimization AI Infrastructure LLM Evaluation Technical Writing Performance Analysis Memory Optimization Latency Optimization
  • United States
  • $70–$110/hour
  • Jul 16, 2026

Design and evaluate performance engineering tasks for frontier AI systems using C++, Python, and Rust while improving runtime performance, systems optimization, compiler engineering, and AI infrastructure training data.

MLOps Engineer Contractor
MLOps Machine Learning Infrastructure JAX +10 PyTorch Pallas Triton GPU Programming Kernel Optimization Distributed Systems AI Infrastructure Training Pipelines LLM Evaluation Technical Writing
  • United States
  • $70–$110/hour
  • Jul 16, 2026

Design and evaluate MLOps engineering tasks for frontier AI systems using JAX, PyTorch, and custom GPU kernels with Pallas or Triton while improving ML infrastructure, distributed training, and AI model evaluation.

Model Context Protocol (MCP) AI Plugins AI Connectors +10 Prompt Engineering LLM Evaluation Rubric Design Quality Assurance Google Drive Notion Expedia Workflow Testing Technical Writing User Research
  • United States
  • $50–$190/hour
  • Jul 16, 2026

Evaluate frontier AI systems by testing complex real-world workflows using Model Context Protocol (MCP) and AI plugins/connectors, creating evaluation rubrics, and assessing AI performance across travel, productivity, health, and personal planning tasks.

AI Expert - Legal Contractor · Part-time
Legal Research LLM Evaluation Civil Litigation +10 Pro Bono Law Access to Justice Housing Law Family Law Consumer Protection Foreclosure Law Debt Law Legal Writing Legal Reasoning Civil Legal Services
  • United States
  • $170/hr
  • Jul 15, 2026

Evaluate AI-generated legal analyses involving housing, family law, consumer protection, foreclosure, and debt matters while improving legal reasoning and access-to-justice guidance through expert civil legal review.

AI Expert - Legal Contractor · Part-time
Legal Research LLM Evaluation Quality Assurance +11 Civil Legal Procedures Paralegal Legal Operations Legal Documentation Housing Law Family Law Consumer Debt Bankruptcy Legal Writing Procedural Review Case Management
  • United States
  • $70/hr
  • Jul 15, 2026

Review AI-generated civil legal guidance involving housing, family law, consumer debt, and bankruptcy while evaluating procedural accuracy, documentation quality, and real-world legal workflows.

Management Consultant Contractor · Part-time
Microsoft PowerPoint Quality Assurance LLM Evaluation +9 Management Consulting Engagement Management Project Leadership Executive Presentations PowerPoint Storylining Slide Deck Development Consulting Deliverables Written communication
  • Remote (Global)
  • $100/hr
  • Jul 15, 2026

Evaluate and refine AI-generated consulting presentations, executive slide decks, and partner-ready deliverables using MBB-level engagement management and presentation expertise. This is a flexible remote consulting opportunity for experienced consulting leaders who want to apply their expertise to improving frontier AI systems.

AI Training Communication +12 Analysis Rubrics English Annotation RLHF SFT Engineering Research Writing Assurance Onboarding LLM Evaluation
  • Remote (Global)
  • $20 – $30/hr
  • Jul 15, 2026

Role Title: AI Evaluation Analyst Role Type: Contractor Location: Remote micro1 is engaging AI Evaluation Analysts to contribute to a customer’s project focused on advancing frontier language model capabilities.

AI Expert - Legal Contractor · Part-time Short-term ↻ Reposted
Legal Research Contract Drafting Contract Review +9 Regulatory Compliance LLM Evaluation Legal Reasoning Litigation Legal Procedure Issue Spotting Risk Management Legal Writing Citation Review
  • Bangladesh, Bhutan, Brazil, Cambodia, Germany, India, Indonesia, Malaysia, Nepal, Pakistan, Singapore, Sri Lanka, Thailand, Philippines, United States, Timor-Leste, Vietnam
  • Up to $120/hr
  • Jul 15, 2026

In this remote contractor role, you will work as an Attorney / Lawyer Subject Matter Expert (SME) reviewing AI-generated legal responses and creating expert legal content. The work focuses on evaluating legal reasoning, issue spotting, rule application, procedural analysis, and…

Law & Policy (AI) Contractor · Part-time Short-term ↻ Reposted
Contract Review Contract Drafting Negotiation +11 LLM Evaluation Issue Spotting Risk Allocation Clause Drafting Negotiation Support Commercial Agreements Indemnities Liability Management Data Privacy Redlining Legal Writing
  • Remote (Global)
  • Up to $100/hr
  • Jul 15, 2026

In this remote contractor role, you will work as a Contract Review Subject Matter Expert (SME) reviewing AI-generated contract analyses and drafting outputs while creating expert contract review content. The work focuses on evaluating contract interpretation, risk allocation,…

AI Expert - Privacy & Regulatory Compliance Contractor · Part-time Short-term ↻ Reposted
Regulatory Compliance GDPR LLM Evaluation +12 Policy Development Procedures Risk Management GRC Controls Testing Monitoring & Reporting Regulatory Research Audit Readiness Third-Party Risk AML/KYC CCPA Governance
  • Remote (Global)
  • Up to $95/hr
  • Jul 15, 2026

In this remote contractor role, you will work as a Compliance & Regulatory Subject Matter Expert (SME) reviewing AI-generated compliance, regulatory, and risk-related responses and creating expert compliance content. The work focuses on evaluating regulatory interpretation,…

AI Expert - Legal Contractor · Part-time Short-term ↻ Reposted
Legal Research Document Drafting Litigation Support +10 E-Discovery Case Management Contract Review Legal Writing Court Filings Compliance Basics Legal Operations Document QA Legal Documentation LLM Evaluation
  • Bangladesh, Bhutan, Brazil, Cambodia, Germany, India, Indonesia, Malaysia, Nepal, Pakistan, Singapore, Sri Lanka, Thailand, Philippines, United States, Timor-Leste, Vietnam
  • Up to $50/hr
  • Jul 15, 2026

In this remote contractor role, you will work as a Paralegal Subject Matter Expert (SME) reviewing AI-generated legal support responses and creating expert paralegal content. The work focuses on evaluating reasoning quality, legal support workflows, document drafting, legal…

Law & Policy (AI) Contractor · Part-time Short-term ↻ Reposted
Contract Review LLM Evaluation Intellectual Property +10 Copyright Trademark Patents Trade Secrets Licensing IP Assignments IP Risk Analysis IP Research Legal Writing Legal Research
  • Remote (Global)
  • Up to $140/hr
  • Jul 15, 2026

In this remote contractor role, you will work as an Intellectual Property (IP) Subject Matter Expert (SME) reviewing AI-generated IP-related responses and creating expert intellectual property content. The work focuses on evaluating legal reasoning, IP issue spotting, rights…

AI Expert - Clinical & Medical Contractor · Part-time ↻ Reposted
Clinical Medicine Evidence-Based Medicine Clinical Reasoning +11 Medical Research Biomedical Research Patient Care Diagnosis Treatment Planning Clinical Guidelines Healthcare LLM Evaluation AI Safety Medical Writing Quality Assurance
  • Remote (Global)
  • $150/hr
  • Jul 15, 2026

Evaluate AI-generated responses to complex medical and biomedical problems, helping improve the clinical reasoning and safety of frontier AI systems.

AI Engineering Command Line +11 Debugging Docker Writing GitHub Testing Verification Microsoft Teams Software Engineering Automated Testing LLM Evaluation Professional Experience
  • India
  • Jul 13, 2026

What We're Researching We are running a paid project focused on creating and validating complex coding tasks for AI systems. The goal is to build realistic, self-contained software engineering problems that push the boundaries of automated coding agents.

AI Expert - Finance Contractor · Part-time
Investment Banking Financial Modeling Three-Statement Modeling +12 DCF Valuation LBO Modeling Comparable Company Analysis Merger Modeling M&A Capital Markets Pitch Decks CIMs Valuation Financial Analysis LLM Evaluation Written communication
  • Remote (Global)
  • $150–$220/hr
  • Jul 11, 2026

Evaluate AI-generated investment banking deliverables and define what excellent work looks like by creating evaluation criteria and scoring AI- and human-generated work with rigorous, evidence-based written feedback.

Product & UX Design Contractor · Part-time
Graphic Design Brand Design Typography +10 LLM Evaluation Visual Design Layout Design Visual Hierarchy Color Theory Composition Brand Identity Creative Direction Design Critique Written communication
  • Remote (Global)
  • $80–$150/hr
  • Jul 11, 2026

Evaluate AI-generated design work and develop evaluation criteria for real-world design deliverables. This is a flexible, remote contract opportunity for experienced graphic, brand, and visual designers.

Brand Strategy Brand Positioning Creative Strategy +12 Creative Direction Advertising Campaign Development integrated-marketing Copywriting Marketing Communications client-presentations AI Evaluation LLM Evaluation Evaluation Rubrics Technical Writing Critical Thinking
  • Remote (Global)
  • $80 - $150/hr
  • Jul 11, 2026

Seeking experienced marketing professionals to design evaluation rubrics, assess AI-generated marketing work, and improve frontier AI systems through rigorous, evidence-based evaluation.

AI Expert - Sales Full-time
B2B Sales Enterprise Sales Account Executive +13 Sales Development Prospecting Discovery Calls Pipeline Management Sales Forecasting Territory Planning account-planning Sales Strategy AI Evaluation LLM Evaluation Evaluation Rubrics Technical Writing Critical Thinking
  • Remote (Global)
  • $100 - $150/hr
  • Jul 11, 2026

Seeking experienced B2B sales professionals to design evaluation rubrics, assess AI-generated enterprise sales work, and improve frontier AI systems through rigorous, evidence-based evaluation.

Accounting Financial Reporting US GAAP +12 Audit Assurance advisory Account Reconciliation Month-End Close Financial Statements Technical Accounting AI Evaluation LLM Evaluation Evaluation Rubrics Technical Writing Critical Thinking
  • Remote (Global)
  • $130 - $160/hr
  • Jul 11, 2026

Seeking experienced accounting professionals to design evaluation rubrics, assess AI-generated accounting work, and improve frontier AI systems through rigorous, evidence-based evaluation.

Data Science Machine Learning SQL +12 Python A/B Testing Experiment Design Statistical Analysis Product Analytics Growth Analytics dashboard-evaluation AI Evaluation LLM Evaluation Evaluation Rubrics Technical Writing Critical Thinking
  • Remote (Global)
  • $120 - $170/hr
  • Jul 11, 2026

Seeking experienced Data Scientists to design evaluation rubrics, assess AI-generated data science work, and improve frontier AI systems through rigorous, evidence-based evaluation.

Brand Strategy Growth Marketing Performance Marketing +9 Marketing Strategy Campaign Management Digital Marketing AI Evaluation LLM Evaluation Evaluation Rubrics Business Analysis Critical Thinking Technical Writing
  • United States
  • $60 - $80/hr
  • Jul 11, 2026

Seeking experienced marketing professionals with AI evaluation experience to design marketing tasks, evaluate LLM outputs, develop scoring rubrics, and improve the marketing reasoning capabilities of frontier AI models.

Insurance Underwriting Claims Management Risk Assessment +9 Risk Management Actuarial Analysis Insurance Operations AI Evaluation LLM Evaluation Evaluation Rubrics Business Analysis Critical Thinking Technical Writing
  • United States
  • $60 - $80/hr
  • Jul 11, 2026

Seeking experienced insurance professionals with AI evaluation experience to design insurance tasks, evaluate LLM outputs, develop scoring rubrics, and improve the insurance reasoning capabilities of frontier AI models.

retail-merchandising Category Management Retail Operations +9 buying-planning retail-strategy AI Evaluation LLM Evaluation Evaluation Rubrics Business Analysis Retail Analytics Critical Thinking Technical Writing
  • United States
  • $60 - $80/hr
  • Jul 11, 2026

Seeking experienced retail professionals with AI evaluation experience to design retail tasks, evaluate LLM outputs, develop scoring rubrics, and improve the retail reasoning capabilities of frontier AI models.

Financial Analysis Corporate Finance Investment Banking +9 Asset Management Financial Advisory AI Evaluation LLM Evaluation Evaluation Rubrics Financial Modeling Financial Reasoning Analytical thinking Technical Writing
  • United States
  • $65 - $90/hr
  • Jul 11, 2026

Seeking experienced finance professionals with AI evaluation experience to design finance tasks, evaluate LLM outputs, develop scoring rubrics, and improve the financial reasoning capabilities of frontier AI models.

AI Expert - Software Engineering Contractor · Full-time
Machine Learning Data Science LLM Evaluation +12 LLM Prompt Engineering Technical Writing AI Agent Workflows Autonomous AI Coding Agents AI Coding Assistants Software Engineering Code Refactoring Debugging AI-Generated Code Evaluation Workflow Documentation DevOps Machine Learning Engineering
  • Remote (Global)
  • $50–$100/hr
  • Jul 9, 2026

Collaborate with autonomous AI coding agents, evaluate AI-generated code, and help improve agentic software engineering workflows for next-generation AI systems.

AI Expert - Document & Presentation QA Contractor · Full-time
Microsoft Excel Microsoft PowerPoint Microsoft Word +12 Financial Modeling Data Analysis LLM Prompt Engineering LLM Evaluation Business Documentation Executive Presentation Development Strategic Proposal Writing Report Generation Feedback Documentation Business Scenario Design Written communication Verbal communication
  • Remote (Global)
  • $35–$50/hr
  • Jul 9, 2026

Design realistic business documentation scenarios, evaluate AI-generated Excel, PowerPoint, and Word deliverables, and provide expert feedback to improve next-generation AI systems.

AI Expert - Legal Contractor · Part-time
Legal Research Legal Writing Case Law Analysis +9 Contract Analysis Regulatory Analysis Legal Reasoning AI Evaluation model-output-evaluation LLM Evaluation Quality Assurance critical-analysis Written communication
  • Remote (Global)
  • $90/hour
  • Jul 9, 2026

Evaluate AI-generated legal responses, compare model outputs, and provide expert feedback to improve frontier AI systems' legal reasoning, accuracy, and practical usefulness.

AI Expert - Accounting Contractor · Part-time
Accounting Financial Reporting Financial Statement Analysis +11 GAAP IFRS Auditing Tax Corporate Accounting Public Accounting Accounting Advisory Corporate Finance CPA LLM Evaluation Technical Writing
  • Remote (Global)
  • $85/hr
  • Jul 8, 2026

Evaluate AI-generated responses to complex accounting problems, helping improve AI systems' accounting capabilities. Collaborate with leading AI researchers and apply your professional accounting expertise to real-world AI evaluation.

Page 1 of 9

Tips for finding remote jobs

  • Set up job alerts on multiple platforms to never miss an opportunity.
  • Highlight your remote work experience and self-management skills.
  • Prepare for video interviews and remote work assessments.
  • Customize your resume and cover letter for each remote position.
  • Build a strong online presence on LinkedIn and professional networks.

Stay in the loop.

One email per week, 5 hand-picked roles.