# RL Atlas

Map the next intelligence.

Better models don’t happen in a vacuum. Meet the companies building what comes next.

## Company directory

80 companies.

| Company | Category | Capabilities | What they do | Website |
| --- | --- | --- | --- | --- |
| [Abundant](/companies/abundant.md) | RL startup, Data seller | Simulation, RL training, Coding | RL environments and datasets for learning through simulated experience. | [Visit](https://www.abundant.ai/) |
| [AfterQuery](/companies/afterquery.md) | Data seller, RL startup | Expert data, Human feedback, Computer use, Coding | Capturing how experts think, reason, and work as training data for AI. | [Visit](https://www.afterquery.com/) |
| [AIChamp](/companies/aichamp.md) | Data seller | Robotics, Multimodal, Evaluation | Video-derived training data and evaluations for physical AI. | [Visit](https://aichamp.com/) |
| [Akhara](/companies/akhara.md) | RL startup | Evaluation, Enterprise | Verification for agents using enterprise knowledge and expert judgment. | [Visit](https://akhara.ai/) |
| [Andon Labs](/companies/andon-labs.md) | RL startup | Long-horizon, Evaluation, Simulation | Benchmarks and experiments for autonomous agents running businesses. | [Visit](https://andonlabs.com/) |
| [Andromede](/companies/andromede.md) | RL startup | Long-horizon, Evaluation, Simulation | Programmatically generated RL tasks, environments, and verifiers. | [Visit](https://andromede.ai/) |
| [Anthromind](/companies/anthromind.md) | Data seller | Expert data, Human feedback, Evaluation | Expert human data for RLHF, fine-tuning, and evaluation. | [Visit](https://anthromind.com/) |
| [Appen](/companies/appen.md) | RL startup, Data seller | Expert data, Human feedback, Multimodal | Human training data, annotation, and agentic RL environments. | [Visit](https://www.appen.com/) |
| [Aptura](/companies/aptura.md) | RL startup, Data seller | Finance, Healthcare, Expert data, Evaluation | Expert datasets and RL environments for regulated industries. | [Visit](https://aptura.ai/) |
| [ARIMLABS](/companies/arimlabs.md) | RL startup | Security, Coding, Long-horizon, Evaluation | Verifiable RL environments for cybersecurity and technical work. | [Visit](https://arimlabs.ai/) |
| [BenchFlow](/companies/benchflow.md) | RL startup | Enterprise, Evaluation, Science | Environments, benchmarks, and runtimes for training and testing agents. | [Visit](https://benchflow.ai/) |
| [Bespoke Labs](/companies/bespoke-labs.md) | RL startup | Long-horizon, Coding, Evaluation | Company-scale environments for training agents on complex, long-horizon work. | [Visit](https://bespokelabs.ai/) |
| [Chakra Labs](/companies/chakra-labs.md) | RL startup, Data seller | Computer use, Enterprise, Evaluation | Software replicas and trajectory datasets for computer-use agents. | [Visit](https://www.chakra.dev/) |
| [Collinear](/companies/collinear.md) | RL startup, Data seller | Enterprise, Long-horizon, Evaluation | Enterprise RL environments, verifiers, and training data. | [Visit](https://collinear.ai/) |
| [Cua](/companies/cua.md) | RL startup | Computer use, Sandboxes, Evaluation, Open source | Computer-use sandboxes and tools for agent training and evaluation. | [Visit](https://cua.ai/) |
| [Datacurve](/companies/datacurve.md) | Data seller | Coding, Expert data, Evaluation | Research and expert data collection to expand what AI can do. | [Visit](https://datacurve.ai/) |
| [DataVendor](/companies/datavendor.md) | Data seller | Data licensing, Coding, Evaluation | A marketplace connecting private data, code, and expertise with AI buyers. | [Visit](https://datavendor.ai/) |
| [Daytona](/companies/daytona.md) | RL startup | Sandboxes, Coding | Isolated, programmable infrastructure for running agent code. | [Visit](https://www.daytona.io/) |
| [Deeptune](/companies/deeptune.md) | RL startup, Data seller | Computer use, Enterprise, Evaluation | Software-workflow training environments; joining Mercor. | [Visit](https://deeptune.com/) |
| [Defined.ai](/companies/defined-ai.md) | Data seller | Data licensing, Multimodal, Annotation | A marketplace for licensed, multimodal AI training datasets. | [Visit](https://www.defined.ai/) |
| [Dissei](/companies/dissei.md) | RL startup, Data seller | Finance, Long-horizon, Evaluation | Financial-workflow data, trajectories, and verifiable RL tasks. | [Visit](https://dissei.ai/) |
| [dmodel](/companies/dmodel.md) | RL startup | Alignment, Machine learning, RL training | RL environments for interpretability and alignment research agents. | [Visit](https://dmodel.ai/) |
| [E2B](/companies/e2b.md) | RL startup | Sandboxes, Coding, Computer use | Cloud sandboxes for coding, computer use, and RL rollouts. | [Visit](https://e2b.dev/) |
| [EdotEnv](/companies/edotenv.md) | RL startup | Finance, Long-horizon, RL training | Financial-market environments for training research agents. | [Visit](https://edotenv.com/) |
| [Emulated](/companies/emulated.md) | RL startup, Data seller | Coding, Machine learning, Evaluation | Post-training data and environments for coding and AI research. | [Visit](https://emulated.so/) |
| [Exabite](/companies/exabite.md) | Data seller | Data licensing, Multimodal | Text, document, and video datasets for model training. | [Visit](https://exabite.ai/) |
| [Fleet](/companies/fleet.md) | RL startup | Simulation, Evaluation | Simulated worlds and real-world challenges for more capable AI agents. | [Visit](https://www.fleetai.com/) |
| [General Reasoning](/companies/general-reasoning.md) | RL startup | Long-horizon, Simulation, Open source | Long-horizon reinforcement learning and open agent research. | [Visit](https://gr.inc/) |
| [Good Start Labs](/companies/good-start-labs.md) | RL startup, Data seller | Games, Simulation, Long-horizon, Multimodal | Game environments and gameplay data for learning agents. | [Visit](https://www.goodstartlabs.com/) |
| [Halluminate](/companies/halluminate.md) | RL startup | Finance, Enterprise, Computer use | RL environments for finance and professional-services workflows. | [Visit](https://www.halluminate.ai/) |
| [Handshake AI](/companies/handshake.md) | RL startup, Data seller | Expert data, Evaluation, Enterprise | Human experts, training data, and environments for frontier models. | [Visit](https://joinhandshake.com/ai/) |
| [Hillclimb](/companies/hillclimb.md) | RL startup, Data seller | Machine learning, RL training | Training data and environments for self-improving research agents. | [Visit](https://hillclimb.com/) |
| [HUD](/companies/hud.md) | RL startup | RL training, Evaluation, Computer use | Infrastructure for building, evaluating, and training agents in RL environments. | [Visit](https://www.hud.ai/) |
| [Human Native](/companies/human-native.md) | Data seller | Data licensing | AI data licensing marketplace joining Cloudflare. | [Visit](https://humannative.ai/) |
| [Huzzle Labs](/companies/huzzle-labs.md) | RL startup | Long-horizon, Computer use, Evaluation | Long-horizon environments for computer-use and enterprise agents. | [Visit](https://labs.huzzle.com/) |
| [Idler](/companies/idler.md) | RL startup | Coding, Evaluation | RL environments built around production engineering work. | [Visit](https://idler.ai/) |
| [iMerit](/companies/imerit.md) | Data seller | Annotation, Human feedback, Expert data | Specialist annotation, reasoning data, and human feedback. | [Visit](https://imerit.net/) |
| [Incalmo](/companies/incalmo.md) | RL startup | Security, Simulation, RL training | Cybersecurity environments for reinforcement learning and self-play. | [Visit](https://www.incalmo.ai/) |
| [Innodata](/companies/innodata.md) | Data seller | Annotation, Expert data, Multimodal | Data engineering, annotation, and expert services for generative AI. | [Visit](https://innodata.com/) |
| [Invisible Technologies](/companies/invisible.md) | Data seller | Expert data, Annotation, Evaluation | Human expertise and data operations for training AI models. | [Visit](https://www.invisible.co/) |
| [Labelbox](/companies/labelbox.md) | RL startup, Data seller | Expert data, Robotics, RL training, Evaluation | Expert data, RL environments, and robotics training supply. | [Visit](https://labelbox.com/) |
| [Latch](/companies/latch.md) | RL startup | Science, Evaluation | Scientific workflows and benchmarks for biological AI agents. | [Visit](https://latch.bio/) |
| [Markov](/companies/markov.md) | RL startup, Data seller | Computer use, Design, Expert data | Computer-use demonstrations and design-software environments. | [Visit](https://markovstudios.com/) |
| [Matrices](/companies/matrices.md) | RL startup | Computer use, Multimodal, Simulation | Computer-use environments for training multimodal agents. | [Visit](https://matrices.app/) |
| [Mechanize](/companies/mechanize.md) | RL startup | Coding, Evaluation | Software engineering environments that push frontier coding agents further. | [Visit](https://www.mechanize.work/) |
| [Mercor](/companies/mercor.md) | Data seller, RL startup | Expert data, Evaluation, Long-horizon | Expert-created datasets, benchmarks, and environments for frontier AI. | [Visit](https://www.mercor.com/) |
| [Metaphi](/companies/metaphi.md) | RL startup, Data seller | Coding, Enterprise, Long-horizon, Evaluation | Enterprise coding environments, datasets, and evaluations. | [Visit](https://metaphi.ai/) |
| [micro1](/companies/micro1.md) | RL startup, Data seller | Expert data, Robotics, Evaluation | Expert training data, simulated work environments, and robotics data. | [Visit](https://www.micro1.ai/) |
| [Modal](/companies/modal.md) | RL startup | Sandboxes, RL training | Compute and sandboxes for RL training and parallel agent rollouts. | [Visit](https://modal.com/) |
| [Morph](/companies/morph.md) | RL startup | Sandboxes, Coding | Branching execution environments and scalable infrastructure for agents. | [Visit](https://www.morph.so/) |
| [Normal](/companies/normal.md) | Data seller | Hardware, Expert data, Evaluation | Data and evaluations for AI systems that design hardware. | [Visit](https://normal.ai/) |
| [Ooak Data](/companies/ooak-data.md) | RL startup, Data seller | Enterprise, Long-horizon, Data licensing | Enterprise data and digital twins for training AI agents. | [Visit](https://ooakdata.com/) |
| [Pareto](/companies/pareto.md) | Data seller | Expert data, Human feedback, Evaluation | Human expertise and feedback for training and evaluating AI. | [Visit](https://pareto.ai/) |
| [Parsewave](/companies/parsewave.md) | Data seller | Coding, Expert data, Human feedback, Evaluation | Human-authored engineering tasks and traces for model training. | [Visit](https://parsewave.ai/) |
| [Patronus AI](/companies/patronus-ai.md) | RL startup | Simulation, Evaluation, Long-horizon | Simulated worlds and evaluations for training AI agents. | [Visit](https://www.patronus.ai/) |
| [Plato](/companies/plato.md) | RL startup | Browser, Simulation, Evaluation | Simulated browser environments for agent training and evaluation. | [Visit](https://plato.so/) |
| [pre.dev](/companies/pre-dev.md) | RL startup | Coding, Long-horizon, Evaluation | Verified software-engineering tasks for coding-agent training. | [Visit](https://pre.dev/) |
| [Preference Model](/companies/preference-model.md) | RL startup | Machine learning, Coding, RL training | RL environments for automated machine-learning research. | [Visit](https://www.preferencemodel.com/) |
| [Prime Intellect](/companies/prime-intellect.md) | RL startup | RL training, Evaluation, Open source | An integrated stack for RL environments, model training, and compute. | [Visit](https://www.primeintellect.ai/) |
| [Prolific](/companies/prolific.md) | Data seller | Human feedback, Evaluation, Expert data | Human participants and feedback for AI training and evaluation. | [Visit](https://www.prolific.com/) |
| [Proximal](/companies/proximal.md) | RL startup, Data seller | Coding, Evaluation, Long-horizon | Software-engineering training data and long-horizon coding benchmarks. | [Visit](https://www.proximal.ai/) |
| [ReasonCore](/companies/reasoncore.md) | Data seller | Expert data, Science, Coding, Finance | Expert-curated training data across technical and professional domains. | [Visit](https://reasoncore.ai/) |
| [Refresh](/companies/refresh.md) | RL startup | Coding, Computer use, Long-horizon | Software environments for coding and computer-use agent training. | [Visit](https://refresh.dev/) |
| [Rise Data Labs](/companies/rise-data-labs.md) | Data seller | Expert data, Human feedback, Evaluation | Human expert data for model training and evaluation. | [Visit](https://risedatalabs.com/) |
| [Runloop](/companies/runloop.md) | RL startup | Sandboxes, Coding, Evaluation | Coding sandboxes, benchmarks, and infrastructure for agent training. | [Visit](https://www.runloop.ai/) |
| [Sama](/companies/sama.md) | Data seller | Annotation, Multimodal, Evaluation | Image, video, and other annotated data for AI development. | [Visit](https://www.sama.com/) |
| [Scale AI](/companies/scale-ai.md) | Data seller | Expert data, Evaluation | Human-generated training data and evaluations for AI development. | [Visit](https://scale.com/) |
| [Snorkel AI](/companies/snorkel-ai.md) | RL startup, Data seller | Expert data, Coding, Evaluation | Expert-built datasets, environments, and benchmarks for AI agents. | [Visit](https://snorkel.ai/) |
| [Surge AI](/companies/surge-ai.md) | Data seller | Human feedback, Expert data | Human intelligence and expert data for training the next generation of AI. | [Visit](https://surgehq.ai/) |
| [Symbal](/companies/symbal.md) | Data seller | Expert data, Multimodal, Evaluation, Robotics | Multimodal post-training data and expert evaluations. | [Visit](https://www.symbal.ai/) |
| [Taste Labs](/companies/taste-labs.md) | Data seller | Design, Expert data, Evaluation | Human design judgment for training and evaluating AI. | [Visit](https://tastelabs.com/) |
| [Theta](/companies/theta.md) | RL startup, Data seller | Enterprise, Long-horizon, Expert data | Workspace environments and expert data for long-horizon agents. | [Visit](https://thetasoftware.com/) |
| [Toloka](/companies/toloka.md) | RL startup, Data seller | Expert data, Coding, Human feedback, Evaluation | Expert training data and environments for agents and language models. | [Visit](https://toloka.ai/) |
| [Trajectory Labs](/companies/trajectory-labs.md) | RL startup | Security, Alignment, Evaluation | Safety evaluations, red teaming, and RL environments. | [Visit](https://trajectorylabs.com/) |
| [Turing](/companies/turing.md) | RL startup, Data seller | Coding, Expert data, Computer use, Evaluation | Expert data and verifiable tasks for coding and computer-use agents. | [Visit](https://www.turing.com/) |
| [Ulam](/companies/ulam.md) | RL startup, Data seller | Math, Expert data, Evaluation, RL training | Mathematical reasoning data, private evaluations, and RL gyms. | [Visit](https://www.ulam.ai/) |
| [Veris AI](/companies/veris-ai.md) | RL startup | Enterprise, Simulation, Evaluation | Enterprise simulations for testing and training AI agents. | [Visit](https://veris.ai/) |
| [Verita AI](/companies/verita-ai.md) | Data seller | Expert data, Annotation, Design | Expert sourcing and operations for annotation and RL projects. | [Visit](https://verita-ai.com/) |
| [Vetto AI](/companies/vetto-ai.md) | RL startup, Data seller | Computer use, Expert data, Multimodal, Evaluation | Expert data, RL environments, and evaluations across modalities. | [Visit](https://vetto.ai/) |
| [Vmax](/companies/vmax.md) | RL startup | RL training, Evaluation | RL tooling that turns proprietary data and evaluations into environments. | [Visit](https://vmax.ai/) |

[About the index](/about.md) · [Machine-readable index](/lm.txt)
