총 2건 · 1/1 페이지
The Long-Term Benefit Trust
Automated Alignment Researchers: Using large language models to scale scalable oversight