Global opportunities

Remote job listings

Find your next remote opportunity from thousands of listings across the globe.

Filters

92 remote jobs found
Personal Workflow Evaluator Contractor ↻ Reposted
LLM Evaluation Critical Thinking Attention to Detail +9 Research English Analytical Reasoning Written communication Reading Comprehension Quality Assessment Structured Evaluation Content Review Judgment & Decision Making
  • Remote (Global)
  • $70/hr
  • Jul 19, 2026

Oerview Mercor is seeking Generalist Experts to evaluate AI-generated responses and provide structured written feedback that helps improve frontier AI systems. This role is ideal for analytical thinkers with strong reasoning and communication skills who can assess complex…

Product & UX Design Part-time ↘ +20 regions
English AI Marketing +12 Communications Figma Consistency Verification Communication Webflow Framer MATCH Critical Thinking Domain Expertise Web Design Generative AI
  • Japan, Singapore, South Korea, Australia, Spain, Italy, Portugal, Greece, France, Belgium, Sweden, Finland, Denmark, United Kingdom, Romania, Poland, Hungary, Bulgaria, Czech Republic, Slovakia
  • $50/hr
  • Jul 17, 2026

Please submit your resume in English and indicate your level of English. Mindrift is looking for a highly skilled Web Designer to join the Tendem project ( https://tendem.ai/ ) and drive specialized data scraping workflows within our hybrid AI + human system.

View Details
AI Safety LLM Evaluation Trust & Safety +11 RLHF SFT Content Moderation Policy analysis AI Alignment Prompt Evaluation Risk Management Critical Thinking Analytical Reasoning Technical Writing Quality Assurance
  • Remote (Global)
  • $60–$70/hour
  • Jul 16, 2026

Evaluate the safety, quality, and alignment of frontier AI models by reviewing policy-sensitive content, applying AI safety standards, identifying model failures, and helping improve next-generation AI systems.

AI Ethics Consultant Contractor ↻ Reposted
AI Ethics Flexible +11 Organization Nuance Journalism Education Research AI Ethics Critical Thinking Social Impact Written Feedback AI Tools Content Moderation
  • Remote (Global)
  • $40-120/hr
  • Jul 16, 2026

AI Ethics Reviewer About the Role What if your sense of fairness and critical thinking could directly influence how AI behaves for millions of people?

AI Expert - Visual & Brand Design Part-time ↘ +18 regions
English AI Consistency +12 Training Communications Communication Typography Adobe Illustrator Adobe Photoshop Adobe InDesign Figma Architecture Brand Design Critical Thinking Domain Expertise
  • United Kingdom, Germany, France, Belgium, Sweden, Finland, Denmark, Spain, Italy, Portugal, Greece, Romania, Poland, Hungary, Bulgaria, Czech Republic, Slovakia, United States
  • $50/hr
  • Jul 16, 2026

Please submit your resume in English and indicate your level of English. Mindrift is looking for a highly skilled Brand Designer to join the Tendem project ( https://tendem.ai/ ) and drive specialized data scraping workflows within our hybrid AI + human system.

View Details
Collaboration Healthcare Make +12 AI Salesforce Critical Thinking Communication Channels Empathy Accuracy Management Culture Alignment Compliance Confidentiality
  • United States
  • $17.8 – $21/hr
  • Jul 15, 2026

Datavant is the data collaboration platform trusted for healthcare. Guided by our mission to make the world’s health data secure, accessible and actionable, we provide critical data solutions for organizations across the healthcare ecosystem - including providers, health plans,…

AI Expert - Legal Contractor
law Legal Research Legal Writing +9 Legal Analysis AI Evaluation Data Annotation data-labeling Quality Assurance Rubric Evaluation Critical Thinking Analytical Skills Written communication
  • United States, Canada, United Kingdom
  • $65–$75/hour
  • Jul 14, 2026

Help train frontier AI models by reviewing, evaluating, and annotating legal AI outputs using professional legal expertise and structured evaluation guidelines.

Academic research AI Evaluation Data Annotation +9 data-labeling Research Technical Writing Critical Thinking Quality Assurance Benchmarking Rubric Evaluation Analytical Skills Written communication
  • United States, Canada, United Kingdom
  • $65–$75/hour
  • Jul 14, 2026

Help train frontier AI models by reviewing, evaluating, and annotating AI-generated content using academic research expertise and structured evaluation guidelines.

Brand Strategy Brand Positioning Creative Strategy +12 Creative Direction Advertising Campaign Development integrated-marketing Copywriting Marketing Communications client-presentations AI Evaluation LLM Evaluation Evaluation Rubrics Technical Writing Critical Thinking
  • Remote (Global)
  • $80 - $150/hr
  • Jul 11, 2026

Seeking experienced marketing professionals to design evaluation rubrics, assess AI-generated marketing work, and improve frontier AI systems through rigorous, evidence-based evaluation.

AI Expert - Sales Full-time
B2B Sales Enterprise Sales Account Executive +13 Sales Development Prospecting Discovery Calls Pipeline Management Sales Forecasting Territory Planning account-planning Sales Strategy AI Evaluation LLM Evaluation Evaluation Rubrics Technical Writing Critical Thinking
  • Remote (Global)
  • $100 - $150/hr
  • Jul 11, 2026

Seeking experienced B2B sales professionals to design evaluation rubrics, assess AI-generated enterprise sales work, and improve frontier AI systems through rigorous, evidence-based evaluation.

Accounting Financial Reporting US GAAP +12 Audit Assurance advisory Account Reconciliation Month-End Close Financial Statements Technical Accounting AI Evaluation LLM Evaluation Evaluation Rubrics Technical Writing Critical Thinking
  • Remote (Global)
  • $130 - $160/hr
  • Jul 11, 2026

Seeking experienced accounting professionals to design evaluation rubrics, assess AI-generated accounting work, and improve frontier AI systems through rigorous, evidence-based evaluation.

Data Science Machine Learning SQL +12 Python A/B Testing Experiment Design Statistical Analysis Product Analytics Growth Analytics dashboard-evaluation AI Evaluation LLM Evaluation Evaluation Rubrics Technical Writing Critical Thinking
  • Remote (Global)
  • $120 - $170/hr
  • Jul 11, 2026

Seeking experienced Data Scientists to design evaluation rubrics, assess AI-generated data science work, and improve frontier AI systems through rigorous, evidence-based evaluation.

Brand Strategy Growth Marketing Performance Marketing +9 Marketing Strategy Campaign Management Digital Marketing AI Evaluation LLM Evaluation Evaluation Rubrics Business Analysis Critical Thinking Technical Writing
  • United States
  • $60 - $80/hr
  • Jul 11, 2026

Seeking experienced marketing professionals with AI evaluation experience to design marketing tasks, evaluate LLM outputs, develop scoring rubrics, and improve the marketing reasoning capabilities of frontier AI models.

Insurance Underwriting Claims Management Risk Assessment +9 Risk Management Actuarial Analysis Insurance Operations AI Evaluation LLM Evaluation Evaluation Rubrics Business Analysis Critical Thinking Technical Writing
  • United States
  • $60 - $80/hr
  • Jul 11, 2026

Seeking experienced insurance professionals with AI evaluation experience to design insurance tasks, evaluate LLM outputs, develop scoring rubrics, and improve the insurance reasoning capabilities of frontier AI models.

retail-merchandising Category Management Retail Operations +9 buying-planning retail-strategy AI Evaluation LLM Evaluation Evaluation Rubrics Business Analysis Retail Analytics Critical Thinking Technical Writing
  • United States
  • $60 - $80/hr
  • Jul 11, 2026

Seeking experienced retail professionals with AI evaluation experience to design retail tasks, evaluate LLM outputs, develop scoring rubrics, and improve the retail reasoning capabilities of frontier AI models.

Annotation AI Communication +9 Procedures Optimization Channels Accuracy Data Annotation Verbal communication Communication Skills Critical Thinking Attention to Detail
  • Remote (Global)
  • $30 – $80/hr
  • Jul 10, 2026

Role Title: Generalist for Data Annotator Role Type: Contractor Location: Remote micro1 is engaging Generalists for Data Annotation to support a customer's project focused on building high-quality datasets.

AI Expert - Legal Contractor · Full-time Ongoing
Legal Research Critical Thinking LLM Evaluation +9 LLM Prompt Engineering Attention to Detail Legal Writing Legal Reasoning Case Law Analysis Statutory Interpretation Citation Verification Rubric Development Analytical Writing
  • Remote (Global)
  • $50–$200/hr
  • Jul 3, 2026

Help train frontier AI systems by creating legal reasoning tasks and evaluating AI-generated legal analyses. Create realistic legal scenarios and develop high-quality reference answers and grading rubrics.

Audio Annotation Contractor · Part-time Short-term
Russian English Data Annotation +9 LLM Evaluation Critical Thinking Localization Translation Quality Assurance Audio Transcription Audio Annotation Linguistics Audio Analysis
  • United States (US: CA)
  • $50/hr
  • Jul 2, 2026

Seeking fluent Russian and English speakers in the San Francisco Bay Area to transcribe, annotate, and evaluate Russian audio content for training and benchmarking advanced AI language models. This short-term contract offers flexible hours and requires US work authorization.

Audio Annotation Contractor · Part-time Short-term
LLM Evaluation Data Annotation Critical Thinking +10 Localization Translation Quality Assurance English Hindi Audio Transcription Audio Annotation Linguistics Hinglish Audio Analysis
  • United States (US: CA)
  • $50/hr
  • Jul 2, 2026

Seeking fluent Hindi and English speakers in the San Francisco Bay Area to transcribe, annotate, and evaluate Hindi audio content for training and benchmarking advanced AI language models. This short-term contract offers flexible hours and requires US work authorization.

AI Expert - Music & Audio Freelancer · Part-time Short-term
Music Production Critical Thinking LLM Evaluation +10 Music Theory Music Annotation Music Evaluation Critical Listening Audio Analysis Music Captioning Lyric Alignment Audio Quality Assessment Musicology Generative AI
  • Remote (Global)
  • $30–$65/hr
  • Jul 2, 2026

Seeking experienced musicians, producers, composers, and musicologists to evaluate AI-generated music, annotate musical content, and help improve frontier generative music AI systems. This part-time, remote role involves structured evaluation, captioning, lyric alignment, and quality assessment to enhance AI understanding of music across genres and languages.

AI Expert - Legal Contractor · Part-time
Legal Research Legal Writing Contract Law +6 Constitutional Law Intellectual Property Law Case Analysis Critical Thinking LLM Evaluation Legal Reasoning
  • Remote (Global)
  • $100–$200/hr
  • Jun 30, 2026

Seeking Juris Doctor (JD) professionals to create legal reasoning challenges and evaluate AI-generated legal analysis for cutting-edge AI research projects. Contribute to cutting-edge AI research while applying your legal knowledge to challenging work.

Response Rater Freelancer · Part-time ↘ +1 regions
AI Training Flexible +10 Communication Reasoning Problem Solving Insurance Authorization Classification AI Training Artificial Intelligence Attention to Detail Critical Thinking
  • United States
  • $20 – $20/hr
  • Jun 25, 2026

We are offering a project-based opportunity for independent contributors who are curious about artificial intelligence and excited to learn how advanced AI models are built, evaluated, and improved.

Image & Video Annotation Contractor · Part-time
Critical Thinking Visual Attention to Detail Image Evaluation +7 Quality Assurance Content Moderation Data Annotation Written communication AI Training Visual Analysis Attention to Detail
  • Remote (Global)
  • $20 - $30/hr
  • Jun 25, 2026

About micro1 micro1 is a leading AI data lab that builds training datasets and evaluation systems for frontier AI models. The company works with domain experts across multiple fields to generate high-quality human feedback, annotations, and evaluation signals that improve model…

Response Rater Full-time
AI Flexible Training +10 Communication Reasoning Problem Solving Insurance Authorization Classification Artificial Intelligence Attention to Detail Critical Thinking AI Training
  • United States
  • Jun 23, 2026

AI Generalist (No Experience Required) We are offering a project-based opportunity for independent contributors who are curious about artificial intelligence and excited to learn how advanced AI models are built, evaluated, and improved.

AI Expert - Biology Contractor Short-term
Phylogenetics Evolutionary Biology Genetics +11 Genomics Bioinformatics Computational Biology Molecular Biology Ecology Scientific Research Data Analysis LLM Evaluation Scientific Writing Problem Creation Critical Thinking
  • United Kingdom, United States, Canada, Australia, New Zealand
  • $55-$80/hr
  • Jun 23, 2026

Mercor is seeking Phylogenetics PhDs and Domain Experts for a premier project with one of the world's leading AI laboratories. In this role, you will apply advanced subject matter expertise to help develop high-quality datasets used to train and evaluate state-of-the-art large…

Audio Transcription Annotation Localization +8 Linguistics Quality Assurance AI Evaluation Research Language Evaluation Written communication Critical Thinking Benchmarking
  • United Kingdom
  • $50/hour
  • Jun 18, 2026

Role Overview Mercor is seeking a Basque Audio Generalist Evaluator Expert to contribute to a high-impact audio AI research project with a leading research lab. In this role, you will work on transcription, annotation, evaluation, and quality assurance tasks that help train and…

Transcription & Audio Training Contractor · Part-time Short-term
Australian English Audio Transcription Annotation +11 Localization Linguistics Editing Proofreading LLM Evaluation Quality Assurance Research Critical Thinking Rubric Development Language Analysis Benchmarking
  • Singapore
  • $50/hr
  • Jun 17, 2026

Mercor is seeking an English (Australia) Audio Generalist Evaluator Expert to contribute to a high-impact AI audio research project with a leading research laboratory. In this role, you will work on transcription, annotation, evaluation, and quality assurance tasks that help…

AI & Data Training Contractor
Audio Transcription Annotation Localization +10 Linguistics Editing Proofreading AI Evaluation Quality Assurance Research Critical Thinking Rubric Development Language Analysis Benchmarking
  • Singapore
  • $50/hour
  • Jun 17, 2026

About the Role Mercor is seeking an English (New Zealand) Audio Generalist Evaluator Expert to contribute to a high-impact AI audio research project with a leading research laboratory. In this role, you will work on transcription, annotation, evaluation, and quality assurance…

Bilingual LLM & Translation Contractor · Part-time Short-term
Spanish (Mexico) English Audio Transcription +11 Annotation Localization Linguistics Editing Proofreading LLM Evaluation Quality Assurance Research Critical Thinking Rubric Development Language Analysis
  • United States, United Kingdom
  • $50/hr
  • Jun 17, 2026

Mercor is seeking a Spanish (Mexico) Audio Generalist Evaluator Expert to contribute to a high-impact AI audio research project with a leading research laboratory. In this role, you will work on transcription, annotation, evaluation, and quality assurance tasks that help train…

Bilingual LLM & Translation Contractor · Part-time Short-term
Spanish English Localization +12 Editing Proofreading LLM Evaluation Quality Assurance Research Critical Thinking Spanish (Spain) Audio Transcription Annotation Linguistics Rubric Development Language Analysis
  • United States, United Kingdom
  • $50/hr
  • Jun 17, 2026

Mercor is seeking a Spanish (Spain) Audio Generalist Evaluator Expert to contribute to a high-impact AI audio research project with a leading research laboratory. In this role, you will work on transcription, annotation, evaluation, and quality assurance tasks that help train…

Evaluation & Quality Contractor Ongoing
LLM Evaluation Rubric Design Quality Assessment +9 Prompt Engineering AI Training Critical Thinking Written communication Benchmark Development human-feedback productivity career-planning health-research
  • United States
  • $50 – $200/hr
  • Jun 15, 2026

About the Role A leading AI research organization is seeking experienced AI power users to evaluate how effectively advanced language models perform real-world, highly personalized life-assistance tasks. Contributors will assess AI outputs across domains such as productivity,…

Make Shell Scripting Accounting +12 Operations Accounts Payable Cross-Functional Collaboration Finance Onboarding Accuracy Management Communication Microsoft Excel Attention to Detail Critical Thinking Vendor Management
  • United States
  • $22 – $28/hr
  • Jun 12, 2026

At Underdog, we make sports more fun. Our thesis is simple: build the best products and we’ll build the biggest company in the space, because there’s so much more to be built for sports fans.

AI & Data Training Contractor Short-term
Proofreading Fact-Checking Research +12 Critical Thinking Data Annotation LLM Evaluation Dutch English Editing Quality Assurance Transcription Annotation Accuracy Instruction Following Analytical Reasoning
  • United Kingdom, United States, Singapore
  • $50/hr
  • Jun 11, 2026

Mercor is seeking Dutch Audio Generalist Evaluator Experts to contribute to a high-impact AI research project focused on audio understanding, transcription, annotation, and model evaluation. Contributors will help train and benchmark advanced language models by converting audio…

Personal Workflow Evaluator Contractor · Part-time
Academic research AI Evaluation Attention to Detail +7 Content Evaluation Content Review Critical Thinking Data Annotation Research Review RLHF Written Feedback
  • United States, United Kingdom, Canada, Australia, New Zealand, Ireland, South Africa
  • $50/hr
  • Jun 8, 2026

<h2>About Fleet AI</h2> <p>Fleet AI is an applied artificial intelligence company focused on human–AI collaboration at scale.</p> <p>Our goal is to accelerate the transition to the allocation economy—a future where humans direct work rather than perform it. This capability has…

Humanities Cultural Studies History +12 Literature Philosophy Art History Cultural Analysis Academic research Critical Thinking Scholarly Writing Microsoft Excel Google Sheets PowerPoint Google Slides AI Evaluation
  • Remote (Global)
  • $80 - $120/hour
  • Jun 7, 2026

About the Role Mercor is seeking expert evaluators with deep experience in humanities, arts, and cultural studies to assess AI-generated work products for accuracy, rigor, and domain quality. This is a remote, hourly contract opportunity focused on reviewing documents,…

AI Expert - Accounting Contractor · Full-time Short-term
Financial Analysis Financial Reporting Data Analysis +10 Critical Thinking Bookkeeping LLM Evaluation Accounting GAAP Financial Controls CPA CMA Audit Support Rubric Development
  • Remote (Global)
  • $45 - $65/hr
  • Jun 5, 2026

As an Accountant Expert, you will apply your accounting and financial analysis expertise to help train and evaluate next-generation AI systems. Your work will support the development of AI models through accounting-based reasoning, data analysis, rubric creation, and…

AI Expert - Management & Strategy Contractor · Full-time Short-term
Quality Assurance Communication Critical Thinking +8 Regulatory Compliance Research LLM Evaluation Document review Professional Writing Policy analysis Technical Review Content Evaluation
  • Remote (Global)
  • $45 - $65/hr
  • Jun 5, 2026

As a Consultant Expert, you will apply your professional expertise to help train and evaluate next-generation AI systems. Your work will involve reviewing, creating, and assessing domain-specific content while helping improve AI performance through expert feedback and…

AI Expert - Mechanical Engineering Contractor Short-term
Technical Writing Critical Thinking Quality Assurance +8 LLM Evaluation Mechanical Engineering Materials Science Scientific Research Technical Review Engineering Analysis Scientific Methodology Data Interpretation
  • Remote (Global)
  • $50-$90/hr
  • Jun 5, 2026

Mercor is seeking domain experts in Mechanical Engineering and Materials Science to evaluate simulated research environments and AI agent trajectories. Contributors will review AI-generated research workflows and outputs, assessing performance across multiple dimensions…

Transcription & Audio Training Contractor Short-term
Quality Assurance Editing Critical Thinking +11 Research Localization English LLM Evaluation Japanese Language Audio Transcription Audio Annotation Linguistics Content Review Benchmarking Language Analysis
  • Japan
  • $50/hr
  • Jun 5, 2026

Mercor is seeking a Japanese Audio Generalist Evaluator Expert to contribute to a high-impact audio AI research project with a leading research lab. This role focuses on transcription, annotation, evaluation, benchmarking, and quality assurance tasks that help train and assess…

Transcription & Audio Training Contractor · Part-time Short-term
LLM Evaluation English Quality Assurance +12 Editing Critical Thinking Research Localization Audio Transcription Audio Annotation English (US) Linguistics Content Review Writing Language Analysis Benchmarking
  • United States
  • $50/hr
  • Jun 5, 2026

Mercor is seeking an English (US) Audio Generalist Evaluator Expert to contribute to a high-impact audio AI research project with a leading research lab. This role focuses on transcription, annotation, evaluation, benchmarking, and quality assurance tasks that help train and…

LLM Evaluator (English) Contractor · Part-time
LLM Evaluation Editing Proofreading +7 Critical Thinking Communication Attention to Detail Writing Content Development English Grammar Content Review
  • New Zealand
  • $25-$30+/hr
  • Jun 4, 2026

DataAnnotation is seeking Secondary Education Teachers to help train and evaluate AI models. In this role, contributors will assess AI-generated responses, evaluate reasoning quality, and complete writing and editing tasks that help improve AI performance and accuracy.…

Health & Medicine (AI) Contractor Short-term
Clinical Medicine Public Health Health Communication +11 Health Journalism Taxonomy Evaluation Content Classification Research Analysis Health Claims Analysis Medical Reasoning Data Annotation LLM Evaluation Critical Thinking Annotation Quality Assessment
  • Remote (Global)
  • $130/hr
  • May 28, 2026

About Project Axiom — Track 01: Axis Sanity Check Mercor is recruiting clinicians and health-content researchers to evaluate and stress-test a four-axis taxonomy used for classifying health claims appearing across social media and podcast content. This project focuses on…

Linguistics (SME) Contractor
Linguistics Grammar Syntax +8 Semantics Pragmatics Phonetics Language Analysis LLM Evaluation Prompt Evaluation Analytical Writing Critical Thinking
  • Singapore
  • $8 – $65/hr
  • May 25, 2026

Are you an English language expert eager to shape the future of AI? Large‑scale language models are evolving from clever chatbots into powerful engines of linguistic discovery. With high‑quality training data, tomorrow’s AI can democratize world‑class education, keep pace with…

AI Expert - Biology Contractor Short-term
Biology Scientific Research Biological Data Analysis +11 Scientific Writing Analytical Reasoning Assessment Creation Research Analysis Technical Documentation Data Interpretation LLM Evaluation Critical Thinking Laboratory Experience Communication Skills Attention to Detail
  • Remote (Global)
  • $20-$50 per task
  • May 21, 2026

micro1 is seeking Biology Experts to contribute domain expertise toward training and improving next-generation AI systems. This role focuses on helping AI models learn biological reasoning, scientific interpretation, analytical problem-solving, and research comprehension…

AI Expert - Physics Contractor Short-term
Data Analysis Critical Thinking Problem Solving +12 Communication Attention to Detail Scientific Writing LLM Evaluation Physics Scientific Research Analytical Reasoning Technical Documentation Assessment Creation Scientific Computing Research Analysis Communication Skills
  • Remote (Global)
  • $20-$50 per task
  • May 21, 2026

micro1 is seeking Physics Experts to contribute domain expertise toward training and improving next-generation AI systems. This role focuses on helping AI models learn scientific reasoning, physics concepts, analytical problem-solving, and technical interpretation through…

Humanities & Education (AI) Contractor · Part-time
Humanities Arts & Culture Cultural Analysis +10 Arts Education Curation Historical Interpretation Creative Direction Cultural Programming LLM Evaluation LLM Prompt Engineering Critical Thinking Communication Skills Research
  • Remote (Global)
  • $50-$100/hour
  • May 21, 2026

Mercor is seeking experienced arts and culture program leaders, humanities educators, and curators to contribute expertise toward frontier AI training and evaluation projects focused on humanities, arts, and cultural reasoning. This role focuses on supporting AI systems…

Page 1 of 2

Tips for finding remote jobs

  • Set up job alerts on multiple platforms to never miss an opportunity.
  • Highlight your remote work experience and self-management skills.
  • Prepare for video interviews and remote work assessments.
  • Customize your resume and cover letter for each remote position.
  • Build a strong online presence on LinkedIn and professional networks.

Stay in the loop.

One email per week, 5 hand-picked roles.