Researcher, Safety Training, National Security

OpenAI
San Francisco, Washington, United States
Workplace: RemoteFull timeUSD 380,000 - 500,000 annuallyFunction: Research & Scientific (R&D)Experience: 4+ yearsSkills: ["Collaboration","Research skills","Deep learning expertise","Problem identification","Responsible judgment"]

Advance safety post-training for models intended for U.S. government use, with a focus on national security applications. Research and implement safety training, reinforcement learning, and adversarial robustness methods, and build evaluations to uncover model failure modes. Collaborate across research, engineering, security, and policy partners to improve training and support safe, reliable deployment in safety-critical settings.

Loading

Loading job details...

Preparing the role view and application actions.

FursaFursa
OpenAI
OpenAI
8 hours ago

Researcher, Safety Training, National Security

āœ“ Verified Job

Canonical indexed version, validated from employer's careers page.

Source: Company careers pageValidated by: Fursa AI
Last checked: 3 hours agoStatus: Live

Job Summary

Advance safety post-training for models intended for U.S. government use, with a focus on national security applications. Research and implement safety training, reinforcement learning, and adversarial robustness methods, and build evaluations to uncover model failure modes. Collaborate across research, engineering, security, and policy partners to improve training and support safe, reliable deployment in safety-critical settings.
Location: San Francisco, Washington, United States
Workplace: Remote
Employment Type: Full time
Job Function: Research & Scientific (R&D)

Key Responsibilities

  • •Research and implement safety training, reinforcement learning, and adversarial robustness methods.
  • •Develop evaluations to identify model failure modes and use findings to improve training.
  • •Train and evaluate models for U.S. government use focused on national security applications.
  • •Advance safety post-training and robustness so models follow nuanced policies while preserving usefulness.
  • •Partner with research, engineering, security, and policy teams to support safe, reliable deployment.

Pay and Benefits

Salary: USD 380,000 - 500,000 annually
Equity and Bonus:Equity

Key Requirements

  • •4+ years of relevant AI safety research experience, including RLHF, adversarial training, or robustness.
  • •Strong deep learning research or engineering skills.
  • •A degree in computer science, machine learning, or a related field.
  • •Experience improving model safety for deployment and comfort with collaborative research.
  • •Motivation for responsible use of AI in safety-critical settings.
Experience:4+ yearsAI safety researchMachine learningRLHFAdversarial trainingRobustnessNational security
Education:
Skills:CollaborationResearch skillsDeep learning expertiseProblem identificationResponsible judgment
Tech Stack:RLHFReinforcement learningAdversarial robustnessAdversarial trainingDeep learningModel evaluationsPost-training

Eligibility

Security Clearance:TS/SCI

Company Brief

OpenAI
Develops and deploys advanced generative AI models (including ChatGPT and DALLĀ·E) and AI infrastructure, providing APIs and consumer products to accelerate safe AGI for broad benefit.
Industry: AI & Machine Learning
Company Size: Enterprise (1,001+ employees)
Revenue: USD 1B+
Growth: Scaleup
Valuation: Hectocorn (USD 100B+)
Funding: Series E+
Headquarters: San Francisco, United States
Founded: 2015
Glassdoor
Glassdoor: 4.4
WebsiteLinkedInGlassdoor