Scale Labs, a leader in AI safety research, seeks a Research Scientist focused on Safety Post Training to advance post-training methods and interpretability techniques for safer frontier AI systems.
You will design post-training pipelines, study how training choices affect safety and alignment, and collaborate with policymakers, engineers, and researchers to translate findings into safety standards and evaluation benchmarks.
#J-18808-LjbffrAI Safety & Post-Training Scientist in san francisco at Unknown Company
This position is listed as full time and onsite.