Trust & Safety jobs
Trust and safety at AI companies is the operational front line: abuse detection, content policy, moderation tooling, and the escalation queues where policy meets an actual user doing an actual strange thing. Generative products changed the job — the platform now produces content rather than just hosting it, which rewrites the classic playbooks.
Days mix policy writing, classifier development, and vendor management for human review, with LLMs increasingly moderating LLMs. Experience from platform T&S transfers well, and product-side pragmatism beats abstraction. Nearly every consumer AI company staffs this, not just the labs, making it the widest on-ramp in the safety category.
30open roles right now
- Safety Engineer - Free Tier AbuseElevenLabsRemote, worldwide · Senior · AI Safety
- Safeguards Enforcement Analyst, User Well-beingAnthropicRemote (US) · Mid-level · AI Safety$245k–$285k
- Safeguards Enforcement Analyst, Violence & ExtremismAnthropicRemote (US) · Mid-level · AI Safety$285k–$330k
- Safeguards Enforcement Analyst, Ban Evasion & RecidivismAnthropicRemote (US) · Mid-level · AI Safety$245k–$285k
- Safeguards Enforcement Analyst, Account Takeover & Credential AbuseAnthropicRemote (US) · Mid-level · AI Safety$245k–$285k
- Safeguards Enforcement Analyst, Access Controls & IdentityAnthropicRemote (US) · Mid-level · AI Safety$285k–$330k
- Staff+ Software Engineer, Safeguards Review ToolingAnthropicHybrid · Staff+ · AI Safety$320k–$485k
- Safeguards Enforcement Analyst, Bio HarmsAnthropicRemote (US) · Mid-level · AI Safety$245k–$285k
- Safeguards Enforcement Analyst, Chem & Explosives HarmsAnthropicRemote (US) · Mid-level · AI Safety$245k–$285k
- Safeguards Enforcement Analyst, Age-Appropriate DesignAnthropicRemote (US) · Mid-level · AI Safety$245k–$285k
- Safeguards Enforcement Analyst, Cyber HarmAnthropicRemote (US) · Mid-level · AI Safety$285k–$330k
- Safeguards Enforcement Analyst, Integrity & AuthenticityAnthropicRemote (US) · Mid-level · AI Safety$285k–$330k
- Threat Intel Manager, Influence Operations & SurveillanceAnthropicHybrid · Lead / Manager · AI Safety$375k–$455k
- Principal AI Security EngineerCerebrasRemote (US, Canada) · Staff+ · AI Safety
- Engineering Manager, Sensitive DeploymentsOpenAIOn-site · Lead / Manager · AI Safety$347k–$490k
- Engineering Manager, Safeguards Review ToolingAnthropicHybrid · Lead / Manager · AI Safety$405k–$485k
- Technical Threat Investigator, Threat Intel Engineering - UKOpenAIRemote (UK, US) · Mid-level · AI Safety
- Staff Software Engineer, RiskReplitHybrid · Staff+ · AI Safety$250k–$315k
- Senior Software Engineer, Trust & SafetyReplitHybrid · Senior · AI Safety$210k–$265k
- Data Scientist, SafetyOpenAIOn-site · Mid-level · AI Safety$230k–$325k
- Protection Scientist Engineer, IntegrityOpenAIOn-site · Mid-level · AI Safety$198k–$425k
- Senior Analyst, Safety Operations (Child Safety)xAIOn-site · Senior · AI Safety
- Senior Analyst, Safety Operations (Child Safety)xAIOn-site · Senior · AI Safety$91k–$130k
- Software Engineer, Trust & SafetyVercelRemote (US, UK, DE) · Senior · AI Safety$208k–$312k
- Staff+ Software Engineer, Safeguards InfrastructureAnthropicHybrid · Staff+ · AI Safety£325k–£395k
- Full Stack Engineer, Intelligence SystemsOpenAIHybrid · Mid-level · AI Safety$230k–$325k
- Staff+ Software Engineer, SafeguardsAnthropicHybrid · Staff+ · AI Safety$320k–$485k
- Protection Scientist Engineer, IntegrityOpenAIOn-site · Mid-level · AI Safety
- Software Engineer, AI SafetyOpenAIOn-site · Mid-level · AI Safety$185k–$325k
- Software Engineer, Integrity FoundationsOpenAIOn-site · Mid-level · AI Safety$230k–$385k