Claude’s automated researchers close 26% to 96% of safety gap across alignment failures
Covered by 1 source · 1 article
AI's superior performance in closing safety gaps suggests a pivotal shift in AI safety research, potentially reducing reliance on human oversight. The post Claude’s automated researchers close 26% to 96% of safety gap across alignment failu…
Covered by