Safety Evaluations jobs
Safety evals teams answer the pre-release question that matters most: what can this model do that it shouldn't, and how would we know? That means building dangerous-capability evaluations — bio, cyber, autonomy, persuasion — and running them rigorously enough that a frontier lab will gate a launch on the result.
The role sits between benchmark engineering and threat modeling, in a field still inventing its methodology in public through model cards and safety frameworks. Government AI institutes and third-party evaluators now hire alongside the labs, which has widened the door considerably. A biosecurity or offensive-security background can matter as much as ML depth.
64open roles right now
- Applied Risk Standards SpecialistOpenAIOn-site · Senior · AI Safety$171k–$280k
- Research Program Manager, Frontier AssuranceOpenAIHybrid · Senior · AI Safety$239k–$328k
- Product Manager, Safeguards (Generalist)AnthropicHybrid · Senior · AI Safety$385k–$460k
- Product Manager, Safeguards (Account Integrity & Abuse)AnthropicHybrid · Mid-level · AI Safety$385k–$460k
- Model Policy Manager, Multimodal SafetyOpenAIHybrid · Senior · AI Safety$266k–$335k
- Staff+ Software Engineer, Distributed SystemsAnthropicHybrid · Staff+ · AI Safety$320k–$485k
- Researcher, Safety Training, National SecurityOpenAIRemote (US) · Senior · AI Safety$380k–$500k
- Research Leader (Toxicology), Cambridge, MAIsomorphic LabsHybrid · Lead / Manager · AI Safety
- Senior/Staff Systems Safety Engineer, Platform SystemsNuroOn-site · Staff+ · AI Safety$132k–$291k
- Staff Engineer, Safety-Critical Software (R5826)Shield AIOn-site · Staff+ · AI Safety$200k–$300k
- Sensing and Perception System Safety EngineerZooxOn-site · Mid-level · AI Safety$170k–$267k
- Researcher, Agent Safety, Training and EvaluationsOpenAIHybrid · Senior · AI Safety$380k–$500k
- Research Manager, Biological SafetyAnthropicHybrid · Lead / Manager · AI Safety$405k–$485k
- Data Scientist - AI SafetyElevenLabsOn-site · Mid-level · AI Safety
- Staff Validation Systems EngineerWayveHybrid · Staff+ · AI Safety
- Staff Validation Systems EngineerWayveHybrid · Staff+ · AI Safety$276k–$303k
- Software Engineer, Safety EngineeringOpenAIOn-site · Mid-level · AI Safety$207k–$385k
- People Research Data Scientist, AI Fairness & BiasOpenAIOn-site · Senior · AI Safety$198k–$220k
- Technical Director, Safety CaseWayveHybrid · Staff+ · AI Safety$290k–$426k
- Technical Director, Safety CaseWayveOn-site · Lead / Manager · AI Safety
- Member of Technical Staff (Secure Intelligence Institute)PerplexityOn-site · Senior · AI Safety$220k–$405k
- Product Manager, Multimodal SafetyOpenAIOn-site · Senior · AI Safety$293k–$325k
- Product Policy Manager, Product RiskAnthropicHybrid · Mid-level · AI Safety$245k–$285k
- Software Engineer, API SafetyOpenAIOn-site · Senior · AI Safety$266k–$445k
- Member of Technical Staff, North Modelling (Evals)CohereRemote (UK, EU, Canada, …) · Senior · AI SafetyCA$250k–CA$535k
- Technical Program Manager, AI Safety & SafeguardsOpenAIHybrid · Senior · AI Safety$207k–$445k
- Researcher, Frontier Cybersecurity RisksOpenAIOn-site · Senior · AI Safety$380k–$500k
- Researcher, Multimodal SafetyOpenAIHybrid · Senior · AI Safety$380k–$500k
- Safety Transparency Editor, Safety SystemsOpenAIOn-site · Mid-level · AI Safety$220k–$245k
- Engineering Manager, Agent & Product SecurityCursor (Anysphere)On-site · Lead / Manager · AI Safety
- Research Engineer, PrivacyOpenAIOn-site · Mid-level · AI Safety$0–$500k
- Software Security Engineering Manager, Secure FrameworksAnthropicHybrid · Lead / Manager · AI Safety$405k–$485k
- Partner Manager, Global HealthAnthropicHybrid · Senior · AI Safety$215k–$300k
- Threat Intel Manager, CBRN-E & Advanced WeaponsAnthropicHybrid · Senior · AI Safety$375k–$455k
- Technical Program Manager, Strategic InitiativesOpenAIHybrid · Senior · AI Safety$257k–$445k
- Senior Security Engineer (AI Safety), London, LausanneIsomorphic LabsHybrid · Senior · AI Safety
- System Safety EngineerApplied IntuitionOn-site · Mid-level · AI Safety
- Senior Research Engineer - Safety Tooling and DataCohereRemote (US, Canada, UK, …) · Senior · AI SafetyCA$250k–CA$535k
- Product Security EngineerVercelHybrid · Senior · AI Safety$208k–$312k
- Product Manager, Safeguards Rare HarmsAnthropicHybrid · Senior · AI Safety$305k–$385k
- Staff+ Security Engineer, Risk EngineeringAnthropicHybrid · Staff+ · AI Safety$320k–$405k
- Data Scientist, SafeguardsAnthropicHybrid · Senior · AI Safety$285k–$380k
- Member of Technical Staff - Imagine SafetyxAIOn-site · Senior · AI Safety$180k–$440k
- Engineering Manager, Distillation & Detection PlatformOpenAIOn-site · Lead / Manager · AI Safety$400k–$445k
- Research Scientist, Safety Post TrainingScale AIOn-site · Senior · AI Safety$216k–$270k
- Product Manager, Safety MeasurementOpenAIOn-site · Senior · AI Safety$293k–$385k
- Research Scientist, Frontier Risk EvaluationsScale AIOn-site · Senior · AI Safety$216k–$270k
- Senior Member of Technical Staff, Safety and Security for AgentsCohereRemote (US, EU, UK, …) · Staff+ · AI SafetyCA$250k–CA$535k
- Research Scientist, Agent RobustnessScale AIOn-site · Senior · AI Safety$216k–$270k
- Research Scientist, AI Controls and MonitoringScale AIOn-site · Senior · AI Safety$216k–$270k