Reinforcement Learning jobs
Reinforcement learning came back from the wilderness the moment reasoning models made RL-on-language the hottest recipe in the field. The jobs split between RL for LLMs — reward modeling, verifiable rewards, environment design — and the classical control end that never left robotics and operations research.
You'll want fluency in policy-gradient methods and their failure modes, plus enough engineering to build environments that don't leak reward. Code and math environments, agentic benchmarks, and reward-hacking forensics dominate current postings. Genuine RL experience is a seller's market, and interviews go deep on the algorithmic details.
23open roles right now
- Staff Research Scientist, Reinforce LearningWayveHybrid · Staff+ · Research
- Research Engineer, AI for Chip DesignOpenAIOn-site · Senior · Research$380k–$500k
- Research Engineer, Cybersecurity RL (Reinforcement Learning)AnthropicHybrid · Mid-level · Research
- Research Scientist - Humanoid RoboticsApplied IntuitionOn-site · Senior · Research$250k–$423k
- Member of Technical Staff - RL EnvironmentsCohereRemote (UK, EMEA) · Senior · ResearchCA$250k–CA$535k
- Research Engineer / Research Scientist - Personal AGI, PersonalizationOpenAIHybrid · Senior · Research$380k–$500k
- Research Engineer / Research Scientist - Personal AGI, MemoryOpenAIHybrid · Senior · Research$380k–$500k
- Research Scientist - World ModelLuma AIOn-site · Senior · Research
- Research Scientist / Engineer – Reinforcement LearningLuma AIOn-site · Senior · Research
- Research Engineer/Research Scientist- Personal AGI, Model ExperienceOpenAIHybrid · Senior · Research$380k–$500k
- Agent Post-Training ResearchOpenAIOn-site · Senior · Research$380k–$500k
- Research Engineer, RL Scaling ScienceAnthropicHybrid · Mid-level · Research£375k–£640k
- Research Engineer, Domain ScalingAnthropicHybrid · Mid-level · Research$350k–$850k
- Anthropic Fellows Program, ML Systems & Reinforcement LearningAnthropicRemote (US, UK, Canada) · Intern · Research$200k
- Research Intern - Reinforcement Learning, RoboticsApplied IntuitionOn-site · Intern · Research
- Research ScientistCursor (Anysphere)On-site · Senior · Research
- Researcher, Synthetic RLOpenAIHybrid · Senior · Research$295k–$445k
- Research Engineer, UniversesAnthropicHybrid · Senior · Research$500k–$850k
- Research Engineer / Research Scientist- Personal AGI (Post Training)OpenAIHybrid · Senior · Research$380k–$500k
- Research Engineer/Research Scientist, RL/ReasoningOpenAIHybrid · Senior · Research$295k–$445k
- Research Intern - Reinforcement Learning, Self-DrivingApplied IntuitionOn-site · Intern · Research
- Research Scientist - Reinforcement Learning, RoboticsApplied IntuitionOn-site · Research$126k–$423k
- Research Scientist, Multi-AgentAnthropicHybrid · Senior · Research$500k–$850k