RL.VENDORS

Market Segment

Data & Post-training Vendors

Vendors providing human or expert data, RLHF and post-training data, training datasets, trajectories, and related data used to train or improve models and agents.

Focus Area
Domain
Service / Capability
Company Type
Sort by
AfterQuery logo
AfterQueryData & Post-training

Applied research lab building training data, evaluation datasets, and reinforcement-learning environments around expert professional workflows.

RL EnvironmentsEvaluationsHuman Data
Anthromind logo
AnthromindData & Post-training

Post-training and evaluation company combining subject-matter experts with data workflows for LLM evaluation, RLHF, supervised fine-tuning, and scalable oversight.

Training DataRLHF / Post-trainingEvaluations
Appen logo
AppenData & Post-training

AI data provider offering end-to-end reinforcement-learning environment design, human data, evaluation, and verifier/reward construction for agentic AI.

RL EnvironmentsTraining DataRLHF / Post-training
Datacurve logo
DatacurveData & Post-training

Builds training and evaluation data, including reinforcement-learning environments and agent trajectories, for frontier model development.

CodingRL EnvironmentsTraining Data
Dissei logo
DisseiData & Post-training

Builds financial process data, graders, sealed evaluations, and long-horizon RL environments from real institutional-finance decisions.

RL EnvironmentsTraining DataRLHF / Post-training
Handshake AI logo
Handshake AIData & Post-training

Handshake's frontier-AI business spanning expert human data, evaluations, verifier research, and RL-environment work.

RL EnvironmentsTraining DataEvaluations
iMerit logo
iMeritData & Post-training

EXL-owned AI training and evaluation business providing expert-led model training, evaluation, RL-related data, and multimodal data services.

Training DataRLHF / Post-trainingRobotics / Physical AI
Invisible Technologies logo
Invisible TechnologiesData & Post-training

Provides RL environments, expert data, annotation, and evaluation infrastructure for model builders and enterprises across multiple professional verticals.

RL EnvironmentsTraining DataRLHF / Post-training
Labelbox logo
LabelboxData & Post-training

Provides reinforcement-learning data, environments, evaluations, and expert-feedback infrastructure for frontier AI teams.

CodingRL EnvironmentsTraining Data
Mercor logo
MercorData & Post-training

Expert marketplace providing human datasets, benchmarks, and reinforcement-learning environments for professional-workflow AI training.

RL EnvironmentsRLHF / Post-trainingEvaluations
micro1 logo
micro1Data & Post-training

Data lab combining expert human data, Realm RL environments, contextual agent evaluations, and robotics data.

RL EnvironmentsTraining DataRobotics / Physical AI
Prolific logo
ProlificData & Post-training

Human-data and evaluation platform providing verified participants and domain experts for AI training, alignment, safety testing, and model evaluation.

Training DataRLHF / Post-trainingEvaluations
ReasonCore AI logo
ReasonCore AIData & Post-training

Expert-data and evaluation company turning proprietary domain data into verified RL training sets, sandboxed environments, and adaptive evaluations.

RL EnvironmentsTraining DataRLHF / Post-training
Rise Data Labs logo
Rise Data LabsData & Post-training

Provides expert human data, RLHF, evaluations, agent training trajectories, and custom RL environments for frontier and domain-specific AI systems.

RL EnvironmentsTraining DataRLHF / Post-training
RO
Robotic DataData & Post-training

Physical-AI data infrastructure company, formerly Voxelmaps, providing world and human datasets for autonomous vehicles, humanoid robots, drones, and intelligent machines.

Training DataRobotics / Physical AIHuman Data
Sama logo
SamaData & Post-training

AI data company providing human-in-the-loop training data, model evaluation, annotation, and preference/alignment workflows for advanced AI systems.

Training DataRLHF / Post-trainingEvaluations
Scale AI logo
Scale AIData & Post-training

Data infrastructure company offering training data, evaluation platforms, and reinforcement learning environments for AI model development.

RL EnvironmentsRLHF / Post-trainingEvaluations
Snorkel AI logo
Snorkel AIData & Post-training

Develops data, environments, and evaluation infrastructure, including expert-data workflows, for specialized and agentic AI systems.

RL EnvironmentsTraining DataRLHF / Post-training
SuperAnnotate logo
SuperAnnotateData & Post-training

Human-data and RL-environment company providing expert data, environment tooling, trajectories, verifiers, evaluations, and post-training workflows for frontier AI teams.

Computer UseRL EnvironmentsTraining Data
Surge AI logo
Surge AIData & Post-training

Human-data and evaluation provider offering expert data, RLHF, and reinforcement-learning environments for frontier AI systems.

RL EnvironmentsRLHF / Post-trainingEvaluations
Toloka logo
TolokaData & Post-training

AI data company building RL gyms, virtual environments, trajectories, human-feedback data, evaluations, and safety datasets for AI agents.

Computer UseRL EnvironmentsTraining Data
Turing logo
TuringData & Post-training

Provides datasets, reinforcement-learning environments, expert contributors, and benchmarks for frontier AI model training and evaluation.

CodingRL EnvironmentsRLHF / Post-training
Ulam logo
UlamData & Post-training

Provides reasoning datasets, benchmarks, and verifier-backed RL gyms for mathematics, algorithms, science, and code.

RL EnvironmentsTraining DataRLHF / Post-training

About Data & Post-training

Data & Post-training vendors provide the human or expert data, RLHF and preference data, training datasets, and trajectories used to train, fine-tune, or evaluate models and agents — including annotation and data-labeling workflows, domain-expert review, and human-feedback collection.

This differs from Training Platforms, which run the post-training process itself, and from Evaluation & Safety, which measures a model's resulting behavior rather than supplying the data used to shape it. Data & Post-training vendors instead supply the raw material those processes consume.