1. Home
  2. Jobs
  3. Agent Safety Toolkit

Agent Safety Toolkit Jobs

Browse 59 Agent Safety Toolkit jobs on Inference Jobs.

59 jobs
1w agoScale logoSC

Research Scientist, Agent Robustness

Scale

San Francisco, California, United States (On-site)$216K – $270K Yearly
2w agoAnthropic logoAN

Software Engineer, Safeguards Evals

Anthropic

San Francisco, California, United States (Hybrid)$320K – $485K Yearly
4w agoCohere logoCO
2d agoDecagon logoDE
4w agoNVIDIA logoNV

Senior AI Safety Red Teamer

NVIDIA

Tel Aviv-Yafo, Tel Aviv District, Israel (On-site)
4w agoOpenAI logoOP

Agent Post-Training, Computer Use Research

OpenAI

San Francisco, California, United States (On-site)$295K – $445K Yearly
4w agoOpenAI logoOP

Agent Post-Training, Frontier Evals and Environments Research

OpenAI

San Francisco, California, United States (On-site)$295K – $445K Yearly
4w agoOpenAI logoOP

Agent Post-Training, API & Power Users

OpenAI

San Francisco, California, United States (On-site)$295K – $445K Yearly
2w agoAnthropic logoAN

Safeguards Enforcement Analyst, Safety Evaluations

Anthropic

San Francisco, California, United States (Hybrid)$230K – $270K Yearly
4w agoOpenAI logoOP

Model Policy

OpenAI

San Francisco, California, United States (Hybrid)$207K – $295K Yearly
Subscribe to this search

Get email updates when new jobs match this search.