Mercor is assembling a panel of radiological safety experts to red-team frontier AI models. The work focuses on judging misuse potential of technical requests, while providing legitimate answers where appropriate.
You will write and classify prompts across benign, dual-use, and adversarial levels, evaluate model responses, and draft reference answers with clear rationales for non-specialists. This is writing-intensive work.
#J-18808-LjbffrRadiophysics AI Safety Red Team Specialist in san francisco at Unknown Company
This position is listed as full time and onsite.