AI Content Red Team Analyst - Trust and Safety
ByteDance
Singapore
Workplace: OnsiteFull timeFunction: Content & Editorial (Writing/Editing)Experience: 3+ yearsSkills: ["Analytical rigor","Strong judgment","Creativity","Communication","Cross-functional collaboration"]Conduct unstructured adversarial testing of generative AI models and product experiences to uncover emerging content-safety risks. Investigate jailbreaks, evasions, prompt-based attacks, and failure modes across contexts and user journeys. Document vulnerabilities with reproduction steps, severity, and mitigation recommendations, and partner with policy, product, engineering, data science, operations, and business teams to validate mitigations and drive root-cause closure. Stay current on evolving adversarial trends and contribute to testing playbooks.

