AI Safety Jobs in San Francisco, California, United States

Browse 57 AI Safety jobs in San Francisco, California, United States on Inference Jobs.

21-40 of 57 jobs
3w agoAnthropic logoAN

Research Engineer / Scientist, Alignment Science

Anthropic

San Francisco, California, United States (Hybrid)$350K – $500K Yearly
4w agoScale logoSC

Research Scientist, Frontier Risk Evaluations

Scale

San Francisco, California, United States (On-site)$216K – $270K Yearly
2w agoOpenAI logoOP

Researcher, Loss of Control

OpenAI

San Francisco, California, United States (On-site)$295K – $445K Yearly
5h agoOpenAI logoOP

Researcher, Misalignment Research

OpenAI

San Francisco, California, United States (On-site)$295K – $445K Yearly
2w agoAnthropic logoAN

Product Manager, Safeguards Rare Harms

Anthropic

San Francisco, California, United States (Hybrid)$305K – $385K Yearly
3w agoOpenAI logoOP

Analytics & Automation Lead, User Safety & Risk Operations

OpenAI

San Francisco, California, United States (Hybrid)$302K – $335K Yearly
1w agoAnthropic logoAN

Biological Safety Research Scientist

Anthropic

San Francisco, California, United States (On-site)$300K – $405K Yearly
2w agoOpenAI logoOP

Data Scientist, Preparedness

OpenAI

San Francisco, California, United States (On-site)$347K – $400K Yearly
2w agoAnthropic logoAN

Engineering Manager, Safeguards Interventions

Anthropic

San Francisco, California, United States (Hybrid)$405K – $485K Yearly
1w agoOpenAI logoOP
2w agoAnthropic logoAN

Product Manager, Safeguards (Beneficial Deployment)

Anthropic

San Francisco, California, United States (Hybrid)$305K – $385K Yearly
3w agoAnthropic logoAN

Product Manager, Safeguards Generalist-2

Anthropic

San Francisco, California, United States (Hybrid)$305K – $385K Yearly
3d agoOpenAI logoOP
2w agoOpenAI logoOP

Researcher, Automated Red Teaming

OpenAI

San Francisco, California, United States (On-site)$295K – $445K Yearly
2w agoAnthropic logoAN

Safeguards Enforcement Analyst, Bio Harms

Anthropic

San Francisco, California, United States (Hybrid)$245K – $285K Yearly
2w agoAnthropic logoAN

Safeguards Enforcement Analyst, Child Safety

Anthropic

San Francisco, California, United States (Hybrid)$245K – $285K Yearly
2w agoAnthropic logoAN

Software Engineer, Safeguards Evals

Anthropic

San Francisco, California, United States (Hybrid)$320K – $485K Yearly
1w agoOpenAI logoOP

Threat Modeler Lead

OpenAI

San Francisco, California, United States (On-site)$325K – $325K Yearly
Subscribe to this search

Get email updates when new jobs match this search.