Automated Alignment Researchers: Using large language models to scale scalable oversight - Anthropic
Automated Alignment Researchers: Using large language models to scale scalable oversight Anthropic
Covered by 1 source · 2 articles
- AAnthropic News↗Apr 14
- AAnthropic News↗Apr 14